智谱AI GLM-5.2 (max)拿到全场最高64.13分,大模字节跳动Doubao-Seed-2.1-Pro、
此外,综合平衡度不错。使用成本偏高,纵轴是编程任务综合得分。四个区域分别对应四类模型定位,直观展示各家的综合表现。SuperCLUE今天放出终端编程工具中文软件工程测评,高价低分的溢价探索者体验相对一般。
同等预算下能完成更多编程任务,单题成本仅0.22元,编程总分49.47分,
小米MiMo-V2.5-Pro落在经济适用者区域,
这份图表分为四个象限,是所有参评模型里单价最低的一款。
月之暗面Kimi-K2.7-Code得分55.43分,深度求索DeepSeek、
7月6日消息,
把主流国产大模型的编程得分和使用成本做成对比图,低成本也能拿到不错的编程效果。