MIMO-V2.5-Pro到底什么水平啊,怎么两极分化了


要不打一架吧哈哈哈哈

20 个赞

当主力模型用了一段时间,感觉还是不错的,项目比较简单,用不出来什么差别 :joy:

2 个赞

我看社区的风评也是两极分化,但是说不好用的,都没截图,举出自己实际遇到的问题,没有依据。我看要么是他们不会用,要么是使用场景差异。反正我个人而言,agentic能力和编程能力 很不错。他们说的问题,claude code使用体验差,我也都没遇到,因为我主力是hermes agent

7 个赞

别的不好说,但我测了一下他们那个网页版的文本转语音,感觉非常好,准备对接。

4 个赞

我觉得很拉 写的真的很烂 可能我的场景偏复杂一点

3 个赞

目前使用写一些生成架构图svg的任务发现比较拉胯,即便给了一个很好的示例也无法总结要点和还原出来

2 个赞

大部分模型都有自己适用场景,说好的找到自己使用场景,就像早上有个说deepseek怎样怎样,deepseek不能满足就贬低

2 个赞

简单项目用了两天,感觉不错还挺稳的,节后开工试试高强度的表现怎么样。反正我觉得比minimax好用,能不能比得上glm不好说

1 个赞

mimo-v2.5-pro,这模型只能说相当一般,我感觉:不太行

5 个赞

感觉一堆吹的一堆喷的,AA 榜狂吹,nao 榜狂黑。我就没见过这么迷惑的风评

4 个赞

当初 mimo 2.0 pro 限免的时候用了一阵,稳定地 git diff 不加 no pager 参数,还得我手动给它翻页,不知道什么毛病

1 个赞

我用的Kay佬从Mimo Claw反代的API,实际使用体验还不错,速度快,改代码基本上一遍过,也有可能我写的东西都比较简单吧。

3 个赞

一个小龙虾更新后的BUG问题,用mimo半天修不好。换了gpt5.4一下给我干好了

3 个赞

简单任务感觉不错 试了几个常见的网页测试效果都很顶 然后逻辑题正确率也挺高的
但是给一个复杂工程让他去分析去改感觉效果就不太行了 不知道是不是1m上下文没优化好

1 个赞

网页版的文本转语音的入口在哪里啊?能贴个链接吗?

2 个赞

拿了雷总送的plan在用,简单任务还可以,复杂任务还是差一点意思,我用的一样的框架,跟5.4和4.6都好差很远,待我再尽力测试一下。有一点比较确定,就是搜索插件做的很不理想,千万别用

3 个赞

怎么说呢,一方面是用新的gpt和claude模型用久了,用这种存在差距的模型,体验确实差了不少,抛开单纯的性能问题,小米这个模型,我感觉问题还是不少。

今天正好codex出了goal这个可以一直跑到交付任务的模式,我从上午陆陆续续用mimo2.5pro跑一个小说剧情提取成知识库供外部查询的cli,确实交付了,能跑,能提取,但是和我最开始交给的方案存在很多差距,整个方向相当于跑偏了。

不过上面说的,毕竟是没有人工干预且模型硬实力导致的,所以我还是能理解,毕竟不可能比opus和gpt,而且哪怕是这两个只拿一个方案从头搞起也肯定不可避免的出问题。

但是有的问题不能理解,比如提取小说内容回传json,一段内容大概几千字,结果频繁出现“✗ AI 返回内容无法解析为 JSON”的报错,然后让mimo2.5pro修了三回,靠兼容非json来解决的,本身问题没能解决。
然后就是涉及小说人物卡的提取,可以说完全没任何灵性,我拿的西游记作为示例小说,一次只提取一章,结果提取出的人物全七八糟莫名奇妙,“凌霄大殿”、“群猴”、“四个老猴”这是人物名吗?
再之就是我方案一直强调是通过自然语言交互驱动cli,但实际一直是要带各种参数启动,而且一开始搞出来的的cli本身ai只负责提取小说,完全不参与交互,这个就不说了,但我强调要变成通过自然语言和cli交互,cli调用ai来干活之后,改完还是做什么都要带上一堆的参数启动cli,反复对话之后,我直接强调不应该cli启动带参数,而是通过AI来解析用户的话,然后AI按要求调用相应脚本和工具,这才把这个问题修了。结果安排和用户交互的这个ai,连任何提示词都没预设,甚至连工具权限都没给,单纯安排了一个纯对话ai给我,还是一次性的,回我消息就自动退出cli了,然后反复对话好几次,才勉强搞好了。

截止到现在,这个西游记的剧情提取和人物卡生成依然只完成一小部分,看了看,提取质量可以说挺烂的。我的感觉就是,如果写代码,你手把手教他要做什么,那他确实也能做,但是你不讲非常细致,他就知敷个表面。

6 个赞

就是让他改点小 bug 写个小代码 拉取下开源项目之类的可以 要是想要搞个复杂的最好别用 或者做好准备反复 review 日常用与 sonnet 没有区别 主力用与国外模型第一梯队差距较大

1 个赞

讲道理CC、opencode里用mimo2.5pro用起来也都还好,就是能力没显著差距的情况下,性价比远不如DeepSeek v4,但是D神毕竟是D神,mimo能做到这样已然不错

2 个赞

说他好是可以因为可以主力每天使用了,肯定赶不上第一梯队CC和GPT。
我感觉连GLM5.1也赶不上,没用过DS4不好说。对于别的国产模型应该是可以超越了

1 个赞