佬友们有这种感觉吗? 用opus5.5写的后端会遗漏特别多的细节 只有前端效果好 而数据库 性能算法相关的后端代码 gpt写的最稳 除了前端比较弱 前端不如国模glm5.3flash
(帖子已被作者删除)
Opus5.5后端会遗漏特别多的细节 X
GPT 是 细节狂魔 O
不降智的Astra或者6.1sol确实后端更强一点
gpt 就是纯力工、老师傅
但死脑筋
开放性项目让 opus 出方案,让他监督,让 gpt 去干活
高情商:细节狂魔;低情商:防御性编程拉满
gpt6.1-sol用起来确实不错,我在opencode中用起来很舒服。比Codex好用多了。 ![]()
前端比较没问题,只是因为前端通常有后端的数据流指引,所以取到什么做什么
而且前端比较容易直觉观察到问题
从GPT5 开始,GPT就进入疯狂查核的做法
到GPT5.2到了极致,之后5.3 codex 、5.4 、5.5、5.6、6 一直尝试平衡
但这也是GPT的独特之处,
所以GPT的代码可能设计烂,可能屎山,
但跑出来一直都是比Claude稳
你有用过Fable + Opus + Astra + sol 的多模型协作就会知道
即使Fable也会漏掉很多sol 能找得到的问题
但这是取舍
Claude就是有那个灵性,可以避免过度设计,但取舍是很多edge case或交互行为没GPT仔细
GPT就是慢、兜底,但做出来的系统一般都比较稳
你作为人,就是要做 帮Claude 补漏,或告诉GPT边界的人,或作为同时使用两者的平衡管理
佬,有和sonnet 5.5 模型比较吗?
gpt 去干活,就会屎山
用Fable做review 保证会出问题
正确做法就是Fable 设计,Astra做复核,Opus实作,Astra/ sol 6.1 做review
需要时你做裁决及介入(介入避免GPT又无限过度设计)
什么时候能不降智再说吧…降智很大程度上败坏了对GPT6系列的印象
如果给足够多的细节,是不是 ds4.1f 都够了?
对,这也是为什么 gpt 挨骂
如果要用户把什么都说的那么准
那为什么不用更便宜的模型
我是 claude 直接派发 codex 干活
互相校验
codex写的代码很屎山,架构很冗余
Claude做的比较合理工程设计
而且与Claude讨论架构,比较讲人话也比较不会死脑筋
我是opus干活,每次提交前让gpt review,然后opus一直修改直到没问题
幻觉,漏细节,过度自信,不靠谱不是A家模型传统艺能吗
opus 5.5 显著好了很多
我做了 stop hook 用不同的模型审查是否有幻觉
opus 5.5适合写原型,这是个写原型特别猛的模型,但是真落地总会有意想不到的mismatch情况,这也是小模型的病症了,Gpt写原型太慢太拖拉,也就是有大家广为流传的防御性编程问题。搞得人也很难受,但二者其实写清楚文档和约束表现都还可以。如果是裸跑想落地建议先opus实现原型然后就让gpt大人帮你做好兜底。算是一个不错的trade off
opus5.5/fable适合干架构 每次next to do都非常合理
astra/sol6.1适合当经验丰富的老程序员 完成各种繁琐的测试和代码验收 维护屎山
让gpt设计架构会充满大量毫无意义的防御性代码 让claude维护屎山会遗漏细节
总之两个模型特色侧重比较鲜明吧 适合的场景不太一样