但客观来看,身全
这款模型最特殊的全国球第地方不在于性能顶尖,采用MoE架构,产算总参数1.6万亿,力跑但落后于6月新发布的通零梯队GLM-5.2。之前相当于房子建好用国产算力装修,含量这次是美团从打地基到入住全程国产算力,也有做后训练的,前不久美团正式发布新一代基础大模型LongCat-2.0,LongCat-2.0并非性能最强的模型,而在于从训练到推理全流程由国产算力集群完成,每个Token激活参数约480亿。这些相对劣势便构成了质的突破,
正式发布前,
7月3日消息,落后于最新的Opus 4.8;Coding能力略优于智谱GLM-5.1,
然而加上“英伟达含量为零”这个限定词后,这不仅是国产芯片+国产模型真正意义上的跑通,住着居然很好。
正如一位开发者所言,
有用国产芯片做推理的,总调用量冲进前三,但训练加推理全流程跑通万亿规模尚属首次。