前端小测感觉是GLM5.3 Flash,Grok4.6的水平,后端未知。
最后附上个人私有benchmark排名
(fable5.1多轮迭代设计的21道题目答题,仅代表通用推理,完全不涉及任何coding场景)
前端小测感觉是GLM5.3 Flash,Grok4.6的水平,后端未知。
最后附上个人私有benchmark排名
(fable5.1多轮迭代设计的21道题目答题,仅代表通用推理,完全不涉及任何coding场景)
两个GLM5.3Flash是因为官方和第三方供应商的问题,这里没写。取最高的官方API的来看就可以了。
你这什么野榜?哈基米能和terra坐一桌?
直播训练的时候用美元单位其实是claude api消耗 ![]()
很多榜Gemini都和terra坐一桌啊,很奇怪吗
mimo也是杀出来了
以后会成为第四家知名模型吗,glm,kimi,ds,…
前沿快讯什么鬼…能不能别污染新闻区了
把分区调一下 不要放到前言里边
我发现了一个严重的问题,我不能给你编辑分区了。原来我的 3 级掉了,赶紧补一补课了
我很欣赏。
蒸!就使劲蒸!蒸死A/,气死他们。
就蒸馏怎么了,不服你打我呀!
只要模型有A/模型70%的能力,价格只有A/的5%,就能让A/急的哇哇叫。
为啥mimo发布的时候这个私人榜才放出来,而且还有的模型还有两个坑位