我试着总结了两本长篇小说剧情测试了一下,感觉比gemini的实在很多,第三四条对话仍然能清晰记住正文内容,gemini很多时候会在后续对话中出现幻觉。蹲一下佬们后续的测评
模型链接:
技术报告:
体验链接:
我试着总结了两本长篇小说剧情测试了一下,感觉比gemini的实在很多,第三四条对话仍然能清晰记住正文内容,gemini很多时候会在后续对话中出现幻觉。蹲一下佬们后续的测评
模型链接:
技术报告:
体验链接:
显存要求,对于处理 1M 长度的序列
Qwen2.5-7B-Instruct-1M:至少需要 120GB 显存(多 GPU 总和)。
Qwen2.5-14B-Instruct-1M:至少需要 320GB 显存(多 GPU 总和)。
你试了吗,感觉咋样
这成本不如直接用qwen的turbo和long付费api,很便宜
turbo上下文1M,0.3rmb/Mt和0.6rmb/Mt
long上下文10M,0.5rmb/Mt和2rmb/Mt
国内的AI厂商卷起来了啊
开始卷了
只能看看![]()
此话题已在最后回复的 30 天后被自动关闭。不再允许新回复。