DeepSeek r1 0528是不是给媒体充值了?

先叠个甲:DeepSeek r1确实是一个很优秀的模型,这一次比上一代也有不小的提升

但是一个常规的版本提升,在很多媒体口中却被吹的天花乱坠,变成了一次“大更新”

我看到媒体口中的提升点主要集中在这几个方面:

  • 幻觉得到抑制
    我目前试下来反而觉得幻觉更高了()编文献编数据的情况好像反而严重了不少。甚至这个版本提示词遵循还变差了,输出的文章和代码经常会偏离要求,自己添油加醋
  • 代码能力得到“巨大”提升
    确实能体验到比上一代有不少的进步,但远远称不上巨大,更达不到媒体口中那种“拳打Claude 4,脚踢Gemini 2.5”的程度。自己做了几个页面发现其实还是不如Gemini 2.5 Pro,页面虽然变好看了但是页面中还是经常出现很多bug
  • 文学能力得到提升
    很多媒体都说这一次AI味变淡了,但我并没有体会到,写出来的文章依旧只是词藻的堆砌、疯狂地使用陌生化的修辞手法,依然脱离不了强烈的DS味

很多媒体对DeepSeek的评价是夸张的、测评是荒谬的
像是APPSO这个公众号,评测DeepSeek的逻辑问题像是一两年前GPT-4时代的时候我们会问的问题,还说DeepSeek是唯一能答对9.9-9.11的模型,但是事实上并不是这样

我就感觉这一次更新,媒体的评价很高,但是用户的评价反而没有这么高了

44 个赞

营销号都是sb,吹的天花乱坠,给DS招黑

83 个赞

你说的这几个点,可以去看一下官方仓库的模型卡,有说的。

4 个赞

搞培训的需要流量恰饭而已

7 个赞

是的我看到了,但是自己感觉有点货不对版

不是充值,是媒体需要流量,需要营造虚假的狂欢,简而言之,就是赢麻了 :tieba_025:

32 个赞

官方都说是小更新,只是架不住有流量啊

3 个赞

用下来跟官方给自己的评价差不多

5 个赞

是这样的()

感觉有点幻觉还挺有意思的,感觉可能幻觉高能力高的模型并不多(

1 个赞

自媒体是这样的,那有流量往哪里钻,还是不要命的钻,谁都想吸一口

4 个赞

怎么会不多呢()小参数模型幻觉普遍都很高啊
再不行回去找GPT-3.5 GPT-3幻觉一样很高
这算不上有意思吧:thinking:

能力强(

主要是Deepseek的量子味比较好玩,有一种闷头搓句子的感觉

大概就类似于,别人的幻觉是幻觉,他的幻觉可能有点用处()

:melting_face:错误的,自媒体闻着味就回来。此事在“用dicksuck,三天赚N万中”亦有记载

20 个赞

这么说吧,这个模型是毫无疑问的开放模型的最强模型

同时也是所有大模型里面,排名在前几名之内的模型

关注度自然高。。。不关注这个模型的话,也没别的可以关注的了

6 个赞

对于自媒体来说有流量就行,其他不重要

1 个赞

等R2出了,我也想 dicksuck三天赚两万 :innocent:

7 个赞

我指的是吹太过了()不是关注太多了

这是自媒体蹭热度吧

想suck dick

5 个赞