GLM-5.2体感 用数据说话


我来贴一下我的用量,从用量来说GLM-5.2在我这算是主力模型了。从斜率来看,效率其实比较差。后面的直线是因为额度干完了。从体感来说zhipu MAX接近5水平,国内卖400+符合正常5价格折算率,不算便宜。

42 个赞

额 接近 gpt-5.5的水平 还是别的5?肥波5? :grin:

9 个赞

你要说肥波5那我这个国模吹也是不信的. 你说GPT5又有点太low了.

12 个赞

哈 ,5.2确实是有进步,我这两天用claude+glm5.2还不错,也期望国产模型早日超过国外,不用经常断供了

不说排名,就现在这个体感已经超过我个人的预期了,不知道智谱怎么做到的,真的蒸了么?

2 个赞

敢问佬这是什么软件的统计呀!看起来不错

1 个赞

数据就是直接让codex去统计的会话时长。图让codex做了个霓虹酷炫~~~算token肯定是最准的,然鹅我没统计过。DeepSeek那一根飙升是5亿token,可以参考下。

2 个赞

乘号被吞掉了。补充下,复杂任务执行接近fable 5的水平,至少相对于其他任何模型都更接近。价格是指的100刀,也就是5倍用量的价格。海外z.ai价格是160刀,应该量是比国内bigmodel大的。所以从性价比角度来说,毫无性价比。。。

1 个赞

zhipu本身就是喜欢做长任务优化的,这个跟模型本身的倾向性有关系。

我试用了一下,体感与qwen 3.7 max没拉开差距 :rofl:,一个线程装饰器的bug他俩都找不出了,gpt一次就说到点上了(可能是运气好)

写代码肯定是codex,哪怕你去用DS V4应该都比zhipu强。zhipu的coding能力一直都比较一般。

1 个赞

国内coding model首选,谁能想到24年那会用智谱也只是用他的向量模型搞知识库 :melting_face: :melting_face:

你用过DS就应该知道,国模coding最好的一直是智谱,DS只是比minimax稍微好一点。。。

2 个赞

智谱模型的优势不就是也代码??

不写代码,那用智谱来做什么?

2 个赞

归拢任务,派活儿,多路合议,迭代规划,写文档。。。我的工作流里面zhipu写代码时候比较少,偶尔跟DS V4联手做代码审核。

1 个赞

你是不是说反了,智谱的coding能力不就是他的5.2的最强项么,至少现在国模没有能和智谱扳手腕的吧

3 个赞

见仁见智吧。在我这表现都很拉,首先我的工作环境大量是cupy+ray的并行,实话说表现最好的是Grok。任务内容绝大多数时候都是算法。普通coding用zhipu也行,就是太慢,一个任务要两个5H限额,这谁都得了,动不动周限,这特么强制休假一周至少休四天。基于效率考虑coding任务基本上都是codex跟DS。

是我用的方式不对么?前几天用Zcode去试了glm5.2。 也是执行复杂任务,结果真的很难评。

没法理解啊,大众的看法不一定对,但是你的说法完全不符合实际情况,glm5.2的代码能力国模最强啊,其他的能力伪人感和不说人话,水平实在非常一般般,远不如ds v4和qwnen3.7,但是你的体验完全相反

1 个赞

复杂任务跟开放任务不是一回事,开放任务阶段唯一选择就是opus 4.6 1m,任务边界探索结束zhipu才能接手。开放任务阶段zhipu极易钻牛角尖,陷在某个细节里出不来。我猜这是他们训练集问题。训练集不够大,造成暗角比较多,只能现场解决。非常花时间。