之前那些b站上,用所谓的v4GA生成的上大量的3d游戏,现在看来,这算什么呢?模型已经正式发布了,DS官方也没解释路由风波,难道这笔糊涂账就这么过去了吗?
还是说,新模型真的有fable的能力?
是真官方路由还是有人蹭热度拿肥波冒充dpsk啊?
有没有佬友复刻一下之前那几个样例?
其实当时 b 站的测试视频里有很多人的观点是在 opus4.8 到 fable 之间,有些人觉得比 fable 好。但刚刷到了一个用新版本 onshot 出我的世界的测试,目前看来确实不如之前灰度的版本。
但之前据传言说 deepseek 内部从没灰度测试过什么模型。另外至今也没见过哪个从业者出来讨论这件事技术上的可行性,虽然确实有很多人拿出了可疑的证据。
b站那些小号发的视频,可信度很低。。。
我在Zhipu的同学说dpsk的蒸馏能力天下第一(并非贬低dpsk,会蒸馏也是一种本事,天下乌鸦一般黑,据我了解除了字节几乎没有不蒸的)
也没必要追着不放,就明牌告诉A/,我就是蒸你fable了hhh,要不你就别卖
当时那件事情确实是真的,因为我也是在opencode中用deepseek v4 pro然后感觉有非常强大的能力,但仅限于opencode
我的感觉也是,所谓灰度模型真的是ds4pro吗。体验完我再也不敢反驳那些质疑声音
这才一个小时不到就跑出来了吗 ![]()
没准是 OpenCode 也打算自研模型在狠狠路由蒸馏了
。OpenCode 的数据质量也不差
所以有对比吗,反正灰测案例这么多
那很有可能是opencode自己搞的?
智谱蒸馏能力也不差啊,国模第一个蒸出opus4.6级别的模型吧 ![]()
b 站有人 oneshot 试了,具体不太清楚
这事最奇怪的就是,为什么l站佬友一个都没灰度到?而都是在b站呢!
那些都是炒流量的高手,两个模型参数差距那么大,正式版就后训练了一下,咋可能就直接追上了
B站那些根本不能算证据,鬼知道他们用什么跑的。
有,就一两个,你只是没有看到话题
我是明确当时7月17号那波“灰度”到的,只能是官方路由
但为啥昨天那边很火的论文证明GLM和Kimi似乎干了,DS没干?【那篇论文已经在X上200w浏览了】
豆包是最能蒸馏的公司之一了。张一鸣看不下去了叫停了而已
怎么就变成只有豆包不蒸馏了这都什么鬼啊