ollama pro的glm 5.2用量测试

测试于2026年8月9日。

调用方式:先接入sub2api,然后接入opencode review, cc switch, cursor, open webui。

主要消耗于claude code,cursor和open code review

用量(图1):5h跑满。周限额跑了17.9%

有几次请求其他模型,但主要是glm 5.2

token数量(图2)来自于sub2api统计。里面的g3是我为了让在cursor中使用起的别名,做了模型映射。

5h: 24.42 + 11.71 = 36.13m
周限额:36.13m / 17.9% = 202m
也就是周限额2亿token。

智谱官方lite套餐(图3)最多包含0.87亿token。价格略微低于ollama。

只做参考,欢迎大家讨论。

另外就是感觉响应速度还挺快的,比之前的glm 5.1好很多。不过还是比grok 4.5慢

12 个赞

智谱现在新套餐特别贵,怎么算都不划算。非必要不买

ollama的glm5.2很不合算,比codex消耗要快,而且,不如codex能力强

ollama pro已经取消订阅1个多月了,越来越差,原来5小时根本用不完,现在随便周就没了,建议不用他

1 个赞

为啥我的ollama Pro 5h能用49m:thinking:
我用的zcode自带的统计

我直接接入的zcode,每周可以用接近3亿

3 个赞

动态的,似乎也分低峰和高峰,倍率不一样

这样对比起来智谱的 lite 不是纯粹的冤种 :tieba_008: 而且 ollama 的模型速度是真的快到起飞

ollama自部署没有高低峰这一说吧,就算是有这一说我也不能次次都是将近50m的5h

我也是在站内看别人说的,这家的缺点就是这样额度消耗太不透明了,有没有缓存、缓存多少都不知道的,其他都还好

1 个赞

对智谱的第一印象不是很好, 使用模型不会优先考虑他, 千问也不是不能用…

第一印象不好的原因就是刚注册号, 发现邀请返两亿token, 点击进去后才看到小字, 最高… 从此智谱都不会是我第一考虑的模型厂商

1 个赞

佬,请问你现在在用着什么plan?我目前主力codex,其他都是到处买一些来尝鲜。

ollama好像是按照调用的gpu时长计费的,高峰期相同的调用时间输出少了,体感就是量少了。

昨天白嫖glm5.2 那响应问题的速度 我事后烟抽完都没整完呢:joy:


这是我上周把周限用到100%的用量,全程是在cc中使用

我之前200个gpt的free还活着,我自己一般用luna,公司token不限量,干活用这个

我感觉pro的5.2也挺耐操的,要不是有正式版ds,我还得订呢 :upside_down_face:

我听说ollama的ds消耗的也很快,不如opencode go划算,有类似体验吗

是这样的,之前群友试了试pro和flash,简单工作直接干翻5h用量

我智谱的Pro v2套餐,年付月均100出头,这才值得,新的V3看都不看一眼