在我催更三天之后,ds火速上线了多模态

从话说都V4了,DeepSeek现在还不是多模态吗继续讨论:

大号没有 小号反而有
真随机啊


感觉可能是中等梯队 看博主测试并不是非常惊艳,大部分其他也会错的,他也会错

我还是比较关心文字OCR,我去试一下

ds经典的OCR错误率90%,太离谱了(手写文字 相对于豆包专家的30%,哈基米3.1的10%)

有趣

ds选择了不写:

整体感觉应该错的明显更高
不过实践出真知 之后我会让哈基米进行验证
(而且给ds的图是从哈基米那里下载的图 被压缩了 虽然对人类来说识别没问题,对AI估计有问题的 )

8 个赞

其实是因为我昨天带了两箱旺仔牛奶去找梁文峰谈下来的。

16 个赞

肯定是提了果篮去催的吧,为了大伙属实是破费了

4 个赞

看起来比较普通,右侧高亮的人物才是希尔米,还把变暗的角色皮肤识别成了深色。

1 个赞

ds 的多模态终于上线了,虽然 OCR 确实拉胯,但作为刚起步的多模态能力来说已经很不错了。期待后续迭代,毕竟 DS 的文字模型能力还是很强的,补齐视觉短板后会更全面。

1 个赞

你是不是给梁文峰送小礼了 :rofl:,你都送了啥

1 个赞

多模态吗?是说在灰度测试中呢。 :bili_071:
说起来,就是识别图片吗?还是音频,视频呢?
目前国模里多模的有哪些呀,qwen/glmv系列/…

1 个赞

把mimo-v2.5送给了梁文峰是吧 :rofl:

1 个赞