个人感觉deepseek纯用来分析还是不错的。分析后整个可落地的执行方案,后边执行基本要求就不高了,随便来个都能实现
主要是coding 能力不行,缺乏优质的后训练数据
glm这么强么我去 真得用用了呀
可以适当的进行选择调整,glm 的输出速度比 sonnet 还是慢
dsv4p > glm>kimi > qwen>mimo
长上下文很重要的
国内还是卡太少了 希望国产加速吧
是的 上下文长了是真的不一样质变
主要场景,agent,很聪明。干活很聪明,但是最聪明的还得是断档领先的GPT-5.5
是我使用的姿势不对吗?mimo我安装个php的laravel后台管理系统框架filamentv3都失败,这框架在国外还挺火的,也不是冷门的那种,而且最新已经是v5了,codex我都是直接上v5的,mimo为了确保训练数据时间够,我特地选的v3,然后安装失败了,codex擦屁股,迁移数据库后,做一个登录跳转到dashboard,一下午了还是失败,后来codex擦屁股又擦好了,一个框架自带的登录都做不好,我不知道这个模型能干嘛?还是我使用的姿势不对。
国模目前只用d老师,但是d老师今天帮我对 shardingsphere 进行版本提升跑了10轮报错才修好,d老师你要支棱起来啊
在这个站混了这么久应该已经可以脱敏了
裤子都脱了,结果透心凉了,你说有没有性冲冲。
deepseekv4pro 思考开max >= glm5.1 > kimi k2.6 >deepseekv4flash>minimax 2.7 小米我没用过,mimi2.5pro据说和glm5.1差不多级别,不过如果是使用体验上来说dsv4远远大于glm5.1,因为该死的智谱的破codingplan下午太卡了,kimi k2.6也是,一到下午就卡卡的,dsv4 的api还巨便宜,而且还不卡,配合cc缓存命中率95%左右,一天也就3-10块钱,我觉得比某些看起来便宜但是卡了吧唧的codingplan强多了。
但是dsv4这代模型感觉后训练不咋样,神起来特别神,但是也有特别弱智的时候。它还有一个优点就是几乎没审查,你让它去开发游戏外挂,逆向加密js数据,包括干一些nsfw的事情,它都是断档领先其他国模包括gpt5.5 和opus4.7的。
glm5.1 > k2.6 >= ds4p > qwen3.6 >= mimo2.5p > m2.7
k2.6 or ds4p 和 qwen3.6 or mimo2.5p取决于场景需要长上下文还是多模态
个人目前还是DeepseekV4(主要接Openclaw),GLM5.1和Mimo2.5pro在CC上轮着用
可以在主贴弄个统计,让大家选一下心目中的top1,根据投票数来判断排名
感觉glm5.1最好,k2.5/v4-pro思考久一点,体验稍差
真要花钱还是买gpt量大,还便宜
glm5.1,因为最近一批国模他出的早哈哈,而且能力确实在线,