benchmark的话,0年,或者30天,多模态就不晓得了,他们认为不重要
我感觉多模态对于老梁并不是什么难题,单纯不重视罢了
几年也太悲观了,现在 llm 发展神速,我觉得最多一年
小模型就算 benchmark 分数高,实际使用终归是比大模型差的。就像 openai 的 5.3 codex 虽然分数高,但是实际上真正用起来比 5.2 要差得多。不过拿来干固定工作流是很爽的。
过年后没多久吧,这次pro个人预测能干掉opus4.8和terra,再加上现在的迭代速度,几个月后远超opus4.8感觉都不是问题,至于多模态,接个好用的识图模型帮忙搞,问题不是很大
一年吧,本来想说半年,但是v3到v4间隔太久了。
因为我觉得要看v5,如果v4后面只是纯靠后训练,很难达到fable5的能力
技术早就是不是瓶颈了,看的就是卡的数量,fable可能有5-10t,国内现在最大的才不到3t,但也有可能ds另辟蹊径也不是不可能,总之,啥时候把卡解决了啥时候就来了
不带多模态下个月就行,带上的话不好说诶。
deepseek几年内想要的是通用人工智能,AI界的大一统
根本不会做音视频视觉识别的