OpenCode免费给的Flash.
OpenCode加了一个Fastctx.
MIMO它自己开了个子代理,每一个关键词都狂搜, 直接狂搜三百次, 直接把上下文橄榄死循环了
老老实实花钱用DS Flash 4.1了现在
老老实实花钱用DS Flash 4.1了现在
死循环好像是因为有点训练刷点刷的过拟合了,之前qwen有几个模型特别容易出现,不过qwen都是小参数的模型会这样
2.6 flash 没有测试这个,但是2.6 pro发现了在pi里工具10连发导致输出截断然后失败。感觉也是训练时惩罚低效率的原因。但是mimo token plan不错,没有5小时/周限,可以做很好地补充。
可是mimo 2.6系列说话依然很自然,没有为了token效率变成caveman,我真的太讨厌caveman和 grok的输出风格了。属于牺牲了沟通能力,错误的优化token效率。
其实我在Hermes里因为一些系统提示词,我见过gpt的思考,gpt的思考也是自然的语言,不是碎片。
同时只是一般雷霆大思考,不是ds的超雷霆大思考。
Glm 5.3 在pi里有时也会思考过长被截断,在不用调用太多工具的时候。调工具就能重新计算长度了,多一次缓存读取的差别。
总体来说感觉 2.6 pro,ds v4pro, glm 5.3, kimi 2.8 preview 是差不多的模型,但因为订阅的原因5.3 我用的最多,感觉代码似乎有时可以,有时经常给出错误的推断和过度设计的方案
哇原来已经有issue了,我是在pi里遇到的,而且模型自己发现了问题,跟我说接下来一次一个工具调用 (另一个极端
)
死循环老问题了
以前如果提示词有排比或者重复思考经常就雷霆重复思考循环
只能说正版了![]()
实测的确一般,虽然看分挺高的,但不接地气,不好用。
看起来实用方面还是不行啊,光刷分了