kimi-k2.5有点猛啊,搜索能力上这波直追gpt-5.2-pro

kimi这个真的好 尤其是搜索和多模态,国产里无敌

大家有没有发现,kimi网页版回答会夹杂英文

image

3 个赞

正常,再迭代一个版本就好了

是呀,我也是在一直用qwen和cc一起切换使用,自我感觉编程还是cc那比较好用,思索能比较全,qwen的还待优化

我刚看到的时候也很意外。不过这个模型好像确实有点说法。不只是搜索能力,代码能力也好像还不错。我刚看了知乎上某个答主做的代码测试,编程方面的性能也算是排进第一梯位下游水平了
不过我自己没有用过。

我用API的测下来总结类搜索还是干不过5.2,不过也还可以,但是和glm ds之流似乎差的倒也不是那么多,ds输出可是3块,7倍差距

1 个赞

对啊,主要搜索跟视觉输入挺搭配的。Kimi的这个模型刚好卡在了一个甜点区间,成本不高,性能够用,还有多模态。所以我刚看到的时候还是挺惊喜的。原来我用的是GPT 5.2,但说实话,绝大部分搜索场景预期回报是很低的,甚至干脆就没有任何回报,不产生任何收益,这种情况下GPT 5.2的成本是真扛不住。

编程方面,闭源模型确实普遍强于开源模型,这方面差距还是挺大的。

编程在cc用过minimax,glm,小米的,还在cursor里面用过minimax,给我的感觉完差距还挺大的,对比gpt5.2来说,差挺多的 :rofl:

从我做的一点测试来看,kimi k2.5在长上下文下的指令遵循还不如ds3.2,这个长其实也没多长,不到50k,kimi就已经开始出现忽略指令的情况了;感觉它现在除了知识库比较新外以及支持多模态外,没有什么特别亮眼的点

2 个赞

肯定没法比啊,glm/minimax最多对标sonnet,还差一点,sonnet比opus是差一个级别,opus比gpt 5.2又差一个级别,差的远呢

这么厉害的吗

确实,上次的K2感觉全是软广,平替claude,各种牛逼,结果热度过去就凉了,大家还是用minimax、glm

2 个赞

话糙理不糙

我这边体验经常会工具调用失败,目前成功率最高的居然是DeepSeek。其次是minimax,再次glm。

指的是K2.5哪个模式的搜索能力啊?

qwen3网页和客户端,我用的时候感觉它不记上下文,至少豆包会记得上下文

千问口碑现在又差了?

搜索用哪个模式?

KIMI K2.5的多模态和知识储备意外的不错,能和Gemini掰掰手腕