想知道不同的工具调用同一个模型完成同一个任务会有区别吗

最近自己测试了一下claude和trae,都用的deepseek-v4-flash,生成出的东西还是很不一样的,但是又听说模型一样生成的东西就一样,那到底一样吗?

我也想问类似问题。比如 ChatGPT 5.4 在 Claude Code 和在 Codex 中的表现有什么差异?编码能力以及 Token 用量之类的。

当然有区别呀,每个工具的提示词不一样。多试几个就知道哪家工具更适合你的项目了。

3 个赞

这个从底层就可以知道…
你就算是同一个问题.得出来的结果也可能不一样.
现在大模型的本质.还是猜测下一个字是什么.
那么多的组合.怎么可能一样呢. :rofl:

2 个赞

会有区别的,像内置提示词不一样,就比如kiro里面的opus用起来就感觉流口水

2 个赞