首页
产品服务
模型广场
Token工厂
算力市场算力商情行业资讯
注册

国产大模型四小龙全面对比,谁更胜一筹

发布日期:2026-03-26 来源:网易作者:网易

模型性能对比

  在多项基准测试中,主流大模型表现如下:

模型 MMLU (5-shot) MMLU-Pro MMLU-Redux 发布时间
Kimi-K2 89.5% 81.1% 92.7% 2026-03
DeepSeek-V3 88.5% 75.9% 89.1% 2024-12
MiniMax-Text-01 88.5% 75.7% - 2025-01
GLM-4-32B 87.8% 69.2% 90.2% 2025-04
GPT-4o(参考) 87.2% 72.6% 88.0% 2024-05
Claude-3.5-Sonnet 88.3% 78.0% 88.9% 2024-10

模型架构与上下文能力

模型 训练上下文 推理上下文 架构特点
MiniMax-Text-01 1M 4M Lightning Attention
智谱 GLM-4-Long 1M 稀疏注意力 -
智谱 GLM-4/5 128K/200K 200K 稀疏注意力
Kimi-K2.5 256K 256K 标准注意力
DeepSeek-V3 128K 128K MLA

4.2 长上下文保持率(Ruler测试)

模型 4K 32K 128K 256K 1M
MiniMax-Text-01 0.963 0.954 0.947 0.945 0.910
Gemini-1.5-Pro 0.962 0.958 0.917 0.916 0.850
GPT-4o 0.970 0.921 - - -

多模态能力对比

厂商 视觉模型 语音合成 视频生成 图像生成
智谱 GLM-4.6V (128K) GLM-TTS CogVideoX CogView
MiniMax MiniMax-VL-01 T2A v2 Hailuo 2.3 -
月之暗面 kimi-k2.5 (256K) - - -
DeepSeek - - - -
模型 MMMU DocVQA OCRBench MathVista
MiniMax-VL-01 68.5% 96.4% 86 568.6%
智谱 GLM-4.6V - - - -
Kimi-K2.5 - - - -
GPT-4o 63.5% 91.1% 80 62.1%

部署与支持情况

厂商 开源模型 部署难度 最低硬件 商业支持
DeepSeek V3/R1 全开源 中等 8×H100 社区支持
智谱 GLM-4-9B 等 4×A100 商业支持
MiniMax Text-01/VL-01 8×H100+ 商业支持
月之暗面 K2-Base 开源 中等 8×H100 商业支持

合规性对比

厂商 内容安全 数据隐私 国内合规 国际合规
DeepSeek 基础过滤 承诺不训练
智谱 企业级过滤 私有化可选 -
MiniMax 基础过滤 承诺不训练
月之暗面 内容审查 承诺不训练 -

模型定价信息

厂商 模型 输入价格 输出价格 来源
智谱 GLM-4-Flash ¥0.1/1M ¥0.1/1M 官方定价页
智谱 GLM-4-Air ¥0.5/1M ¥0.5/1M 官方定价页
智谱 GLM-4.5 ¥0.8/1M ¥2/1M 技术报告
智谱 GLM-4-Plus ¥5/1M ¥5/1M 官方定价页
智谱 GLM-5 未公开 未公开 -
DeepSeek V3-chat $0.28/1M (~¥2) $0.42/1M (~¥3) API 文档
DeepSeek V3-cache-hit $0.028/1M (~¥0.2) - API 文档
DeepSeek R1 $0.14/1M (~¥1) $0.55/1M (~¥4) API 文档
MiniMax M2.5 订阅制 订阅制 官方定价页
月之暗面 kimi-k2.5 未公开 未公开 -
本文转载自网易, 作者:网易, 原文标题:《 国产大模型四小龙全面对比,谁更胜一筹 》, 原文链接: https://www.163.com/dy/article/KOUCE94B05568W0A.html。 本平台仅做分享和推荐,不涉及任何商业用途。文章版权归原作者所有。如涉及作品内容、版权和其它问题,请与我们联系,我们将在第一时间删除内容!
本文相关推荐
暂无相关推荐
点击立即订阅