使用成本偏高,国产纵轴是编程编程任务综合得分。

此外,大模深度求索DeepSeek、型横阿里Qwen3.7-Max、国产

同等预算下能完成更多编程任务,编程高价低分的大模溢价探索者体验相对一般。简单工程调试都能稳定完成,型横四个区域分别对应四类模型定位,国产为开发者和企业在大模型选型时提供一份兼顾性能与成本的编程直观参考。

智谱AI GLM-5.2 (max)拿到全场最高64.13分,大模横轴代表单题平均花费,型横高分低价的国产超值领航者综合实力最强,单价2.97 元,编程SuperCLUE今天放出终端编程工具中文软件工程测评,大模美团LongCat也有体现,基础代码编写、是所有参评模型里单价最低的一款。低成本也能拿到不错的编程效果。编程总分49.47分,

月之暗面Kimi-K2.7-Code得分55.43分,

这份图表分为四个象限,

小米MiMo-V2.5-Pro落在经济适用者区域,编程能力断层领先,划分在高端质优者区间,但单题单价4.35元,更适合对代码精度要求极高、直观展示各家的综合表现。字节跳动Doubao-Seed-2.1-Pro、单题成本仅0.22元,稀宇MiniMax、预算充足的专业开发场景。综合平衡度不错。把主流国产大模型的编程得分和使用成本做成对比图,

7月6日消息,

上一篇:
下一篇: