先上图。
筛选依据: LinuxDO商家评价平台上评论数>20的中转站点,按综合评分从高到低排序。
省流: 如果模型对2025年底的世界知识毫无印象、且难以拼写中文引号“”,那么你用的Opus很可能是中转站映射的Sonnet 4.5/Haiku 4.5。
每次当中转群有群友抱怨Kiro Claude智商低时,就会有人(比如客服)出来解释说Kiro天然这么笨。然而, 笔者体验了市面上多家Kiro/AWSQ后(AWSQ就是企业Kiro),却发现不同商家的Kiro智商天差地别: 知名站点的Kiro Opus5体感智商接近CCMAX,大半站点的Kiro却糖的流口水。笔者不经生疑:
为什么同样是Kiro,智商差异如同Sol和4o?
Kiro Opus5也是Opus5,真的就糖到流口水吗?
经过一番研究(和爆米),为佬友们端上今天这份测评。
测试方法:
- Opus5知识截止日期2026年5月,能够清楚记忆2025年底的世界知识,是市面上知识最新的模型之一。
- Opus 4.7开始,A社升级了Claude模型的Tokenizer,新的Claude模型能正确拼写中文全角引号“”,而Claude 4.6及以前的旧模型则总是会把中文全角引号拼写为英文半角引号""。
如图,佬友可以使用Kiro订阅/Claude订阅验证 Opus 5 和 Sonnet 4.6 的这一行为差异
不联网搜索,凭记忆列出下列模型的发布日期:
Claude Sonnet 3.5
Claude Sonnet 3.7
Claude Opus 4.1
Claude Opus 4.5
格式要求:回答格式为“yyyy-mm-dd”,
使用中文引号“”而非英文引号""包裹
笔者遂Vibe了这个测评工具,批量跑了十来家富可敌国,结果即本文首图。
尽管写这个App是为了 Kiro/AWSQ(企业Kiro),但由于本测试只检测Opus5的固有能力,测试方案并不渠道敏感,所以顺手测了几家站点的其他渠道Claude (如Cursor/CCMAX)。结果也是非常惊人。可以看到有些站点连CCMAX Opus5都跑出了Claude 4.6以前的行为特征。
你也可以使用中文引号测试/任何2025年底的重要新闻事件复现本测评,或验证你在用的中转站。
背景知识: 据初步调研,Kiro分为Free订阅/Pro订阅/企业(AWSQ)订阅。
其中Pro订阅和企业订阅提供最新 Opus 模型,但是成本高风控严,良心的商家仅使用此类账号,并且会添加90%合成缓存。
而Kiro Free 成本低产量大,但无Opus模型,仅提供Sonnet 4.5和Haiku 4.5。不良心的商家会映射为 Opus,并且合成低缓存和较高的Usage。
PS
- 这只是个极简测试,用于鉴别明显的 Kiro Free Sonnet 4.5掺水方案。目前还需要补充更多测试才能验证模型为 Opus 5。
- Kiro 倍率参考价值不大,不建议对着0.2以下的低价冲。由于 Kiro 原生无缓,市售 Kiro 缓存均为商家合成,缓存率多高全看商家良心。0.05x的0缓Kiro可能比0.3x的95缓Kiro还贵。
回到一开始的问题: Kiro真的笨吗?或许只是市面上假 Kiro 太多罢了。
如果有你感兴趣的高级推广没有列出,欢迎评论区建议,起充不高我会抽查补测^_^
感谢阅读,希望此测评能为佬友选站带来帮助。
往期测评帖子:
【Codex降智测评】抽检了10家热门富可敌国
【Codex降智测评0909】抽检13家高级推广,2家Juice指纹为Luna
后续应该会发布更多测评贴hh,欢迎关注 Sparxie~
PS
不要私信笔者推荐站点,笔者仅做测评,不会回复此类信息。
Codex和Kiro Claude的测试网页已写好。但笔者在L站一般潜水,不了解怎么在L站合规发布API检测站点、以及在测评贴中添加站外中转是否合适?(也许后续测评贴会考虑发在扬帆起航?)欢迎佬友指点。










