qwen团队新开源的1m上下文模型,感觉还可以啊

我试着总结了两本长篇小说剧情测试了一下,感觉比gemini的实在很多,第三四条对话仍然能清晰记住正文内容,gemini很多时候会在后续对话中出现幻觉。蹲一下佬们后续的测评
模型链接:

技术报告:

体验链接:

12 个赞

显存要求,对于处理 1M 长度的序列
Qwen2.5-7B-Instruct-1M:至少需要 120GB 显存(多 GPU 总和)。
Qwen2.5-14B-Instruct-1M:至少需要 320GB 显存(多 GPU 总和)。

你试了吗,感觉咋样

这成本不如直接用qwen的turbo和long付费api,很便宜
turbo上下文1M,0.3rmb/Mt和0.6rmb/Mt
long上下文10M,0.5rmb/Mt和2rmb/Mt

国内的AI厂商卷起来了啊

开始卷了

只能看看:sweat:

1 个赞

此话题已在最后回复的 30 天后被自动关闭。不再允许新回复。