首页
产品服务
模型广场
Token工厂
算力市场算力商情行业资讯
注册

【成果发布】 2025大模型服务性能排行榜发布-评测中心

发布日期:2026-03-21 来源:无作者:无

《2025大模型服务性能排行榜》发布:AI Ping平台助力MaaS选型

4月13日举办的GOSIM2025大会上,中国软件评测中心与清华大学联合发布了《2025大模型服务性能排行榜》,并由清程极智提供技术支持,形成数据展示平台——AI Pinghttps://aiping.cn/),为企业用户、开发者选择MAAS服务提供全面、客观、真实的技术信息。

智算云模型即服务快速发展,极大地丰富了大模型产品市场的同时也带来应用开发者和开发商选型难题。不同模型服务商在延迟、吞吐量、可靠性、价格、上下文长度以及最大可输出长度等关键性能指标上存在显著差异。以国内知名互联网大厂、运营商为例,同样是DeepSeek模型,输出吞吐最高相差4.9倍,首字延迟最高相差4.3倍。

评测方法与维度

本次评测工作以开发者使用场景的服务质量追踪为主,对不同服务商所提供的MaaS API在相同模型、提示词、时间窗口下的性能表现进行持续监测,从延迟、吞吐、可靠性等关键指标切入,通过长周期、高频率、多时段的数据监测,榜单可直观呈现MaaS服务商的实时服务质量表现,最终形成了包含十个性能榜单和一个模型丰富度榜单的综合评测结果。

覆盖范围

测评涵盖了21家大模型服务商提供的226个模型服务,包括阿里云百炼、并行科技、硅基流动、火山方舟等知名平台,以及DeepSeek-R1-0528、DeepSeek-V3.1、Kimi-K2-Instruct、Qwen3-235B-A22B和Qwen3-32B等大模型。

重点模型性能榜单

各大MaaS服务商的DeepSeek、Qwen、Kimi等模型的平均吞吐和首字延迟的性能榜单如下。

模型名称 服务商 平均吞吐(tokens/s) 首字延迟(ms)
DeepSeek-R1-0528 服务商A 128.4 210
DeepSeek-R1-0528 服务商B 26.2 903
Qwen3-32B 服务商C 96.7 285
Qwen3-32B 服务商D 42.1 762
Kimi-K2-Instruct 服务商E 85.3 310
Kimi-K2-Instruct 服务商F 38.9 820
本文转载自无, 作者:无, 原文标题:《 【成果发布】 2025大模型服务性能排行榜发布-评测中心 》, 原文链接: https://k.sina.cn/article_7879848900_1d5acf3c401902ue50.html。 本平台仅做分享和推荐,不涉及任何商业用途。文章版权归原作者所有。如涉及作品内容、版权和其它问题,请与我们联系,我们将在第一时间删除内容!
本文相关推荐
暂无相关推荐
点击立即订阅