gpt5.5和opus4.8现在真的是拉完了 ![]()
(实时更新的智力测试榜,能大概看到模型降智情况,仅供参考切勿当真)
9 个赞
主要是这类型的测试排行可不可信呢?AI的能力其实是不是不大好量化?
这个是每间隔一段时间就测试更新的,可以看个大概,有波动正常,不过也存在有模型低迷很长时间
写代码方面,4.8真不如4.6嘛,我现在还在用着4.8呢
这图哪儿来的,感觉也就一乐子吧?
GLM 5.2没有吗,按这个排法至少前三吧
你这啥榜单 是那个方面的评分 有些没头没尾啊 ![]()
ds flash比pro 高,glm 5.1在而5.2不在,这是什么榜
野榜吧,什么网站的,一般不会倒退更新吧
实时刷新的智力测试榜,模型降智情况能看个大概
看到跌到14、15了我脑袋都嗡嗡的, 怎么可能呢。
我不信gemini3.1pro有那么高![]()
这模型降智还不明显嘛,难道只是统计最近这段时间的
2 个赞
但是 但是, 但是, 体感方面, 我目前依然感觉 5.5 依然强的可怕哎。
我也不相信,说是3.5也就算了,3.1真没给人留下什么好印象![]()
这个榜很奇怪的,你点进去看某个模型的时间线,最近时间的一次分数一直会是降低的趋势,但是你隔天再点进去看那个时间点的分数很大概率又离奇的回归高水平了
是的 可惜any大善人不让用4.6
体感上4.6就是比4.8强啊,考虑的也全面
我在官网里面看定价是有4.6的呀,现在用着4.8,真感觉不行,提了有些需求它不做就汇报了


