总的来说,目前的顶级模型,无论是世界知识/综合能力,都超越了大部分人类。
那么,你认为以今年的高考试题(不限定哪套或自主命题),哪家模型能拿最高分?
可以加限定条件,比如:
- 模型不使用任何Agent工具/网络搜索(传统闭卷考试)。
- 在CC/Codex/OpenClaw/Hermes等Agent框架下火力全开(开卷考试)。
我对Gemini-3.1-pro的世界知识印象比较好,感觉它在闭卷下表现应该很不错,而开卷模式我更看好GPT-5.5。
总的来说,目前的顶级模型,无论是世界知识/综合能力,都超越了大部分人类。
那么,你认为以今年的高考试题(不限定哪套或自主命题),哪家模型能拿最高分?
可以加限定条件,比如:
我对Gemini-3.1-pro的世界知识印象比较好,感觉它在闭卷下表现应该很不错,而开卷模式我更看好GPT-5.5。
这问题还真有点意思,可以先做一套去年的真题试试
理科之类的应该都能拿满分左右了吧,文科这种主观性怎么都会扣点,但是也会很高,我觉得考个680以上还是很简单的
感觉 AI 选择题应该大多没问题,但非选择题不一定,毕竟很多非选择题大多是要套模板和看要点都答没答上的,然后理科方面应该也没问题,文科这种要靠老师判断
除了语文,数学英语之类的能拿满。画图的科目分数会低些
理科类的应该是接近满分的,如果你用gpt5.5的 X-high 或者是 pro 模型的话
至于说语文、政治这些科目,恐怕得看阅卷老师了
如果结果是固定的理科, 可以写Test自测修正, 我猜大概率是接近满分的. 文科的话 感觉就很不稳定了. AI 写的文章 有一股子味~
数学满分大部分模型都是可以的,文科满分难一点,物化生都还考验模型的视觉能力更难的得满分
综合看,如果和人类考生一样的要求,我觉得gemini-3.1-pro应该是最好的,文字功底可以,数理能力不差,多模态能力强(之前找手性碳的验证码只有Gemini找出来了)
从我那届难度来看的话,即使是数学,感觉目前模型应该还不至于大部分都满分,还是有一些奇怪题目和小细节的
感觉理科发挥应该很好,文科应该不咋地吧,AI模型对中文的支持还是差了一点
gemini-3.5-pro出来的话参加高考我认为可以得到市级前三或前五的水平。
去年的说不定都已经进自己的知识了(知识截止日期在25年7月之后的~)
前两年豆包都能考个600多分,更不用说这些顶级Ai厂商的模型了
我们学校平时的数学考试压轴题gemini-3.5-flash都能答对,我觉得大部分模型满分没问题,你要说Claude不能满分那还有肯可能,Claude数学连DeepSeek都不如
有没有佬友测试过往年的题目,我也很好奇哪个模型是最牛的
这。。。理科谁拿不了满分就可以嘲笑谁了
只能比谁在最少 token 数内拿到满分了
其实去年测试模型就已经能拿到接近满分的成绩了
反正理科这块满分没问题,而且要啥方法有啥方法,我现在就用来辅助考研,太爽了
而且 ocr 识别这块太牛了,我自己手写的笔记随便识别
不用 3.5 pro,2.5 pro 就可以了