DeepSeek‑v4‑flash真的好用吗

由于gpt和claude都没额度了,所以试着用了一下DeepSeek‑v4‑flash,真是用过好的再去用差的,没有比较就没有伤害,反应慢,中间还截停,以前一小时完成的任务现在做了一天一夜后跟我说做不了,而且我还不知道中间搞了什么幺蛾子,不知各位佬怎么驾驭它的?是我用错了方法吗?

18 个赞

用错了,以前的是模型太强,帮你兜底了,现在这个是决策能力不够,需要你参与设计和决策

13 个赞

用牛逼的模型先做规划,每个阶段验收,最后审查,对了记得要用pi agents

4 个赞

v4给我最大的感觉就是,有时候你说不清楚他就会瞎干,实际上先诶做计划,这个是个问题

4 个赞

规划能力和决策能力一般,但是代码质量还能看,所以要手动做决策和需求,然后让他执行好一点

我写了具体任务要求的skill,执行下来和gpt的没啥差别,现在一部分任务已经交给ds了,速度很快

我感觉已经降智了,官方和opencode都已经大不如前

你用Sol\Opus的用法毫无变通去用V4-Flash那肯定是不好用的,只会给你拉一堆。你就当他是个外包,只会根据输入的接口文档需求文档输出代码就行了。

2 个赞

写代码来说,实际上就是一般,性价比高是真的,但是也不可能和gpt claude一起对比。

专写代码还是很强的,用来规划和架构宏观不怎么行

你花 10k 一月请的员工和 3k 一月的能一样吗?

12 个赞

感觉不能把一些决策交给他,但是性价比还可以

护栏失效或者太长了吧

ds确实是不如sol省心就是

但真的便宜啊,一小时不到两块钱,跟租算力差不多

我用来逆向反正感觉不好用,莫名奇妙自动停了,甚至还出现过无限循环。

用过一段时间的ds完全没办法生产使用,幻觉严重总是虚构api,而且经常失忆!!明确说了不要使用某个工具他非要用,重复说好几遍就是不听

考虑到价格和速度,在能力覆盖范围内,那是真的好用

不考虑价格和速度,我用glm和k3

我的ds-v4-flash主要用来一般日常问答,在hermes agent下使用。感觉正式版发布后反而不如之前:输出长篇大论,无端联想甚至前后矛盾,回复内容“没主见”。现在单ds-v4-flash不好用了,我又重新用上了ChatGPT网页版对话,虽然也有类似问题,但感觉没那么严重。

中短任务好用啊,指望v4f跑长任务和指望luna跑长任务一个性质

目前我是感感觉官方的 v4 降智了一大截…
真的大不如前了

跑批或者小功能实现用的,和大的模型结合使用能帮你平摊成本