花了5刀测了25遍,各个provider都测过了,客户端是claude code,用的模型是claude opus 4.6 (1M context),推理强度max,红绿色盲测试题一次都做不对
claude code接官方的Pro订阅,同样是claude opus 4.6 (1M context),推理强度max,20次倒是能完全做对16次
难道openrouter的api也掺水了吗 ![]()
花了5刀测了25遍,各个provider都测过了,客户端是claude code,用的模型是claude opus 4.6 (1M context),推理强度max,红绿色盲测试题一次都做不对
claude code接官方的Pro订阅,同样是claude opus 4.6 (1M context),推理强度max,20次倒是能完全做对16次
难道openrouter的api也掺水了吗 ![]()
讨论有啥用,又影响不了人家决策。唉,难蹦啊
没法子,谁叫别人闭源呢,llm智力周期。
真壕~
openrouter,我一个/init就花了一块钱,吓我一跳