佬们,现在的需求是要在各个业务场景下面搞智能体,但是原先的模型配置的模型还是deepseek-R1和v3这种版本。
最近打算升级一下,国产开源模型或者能用上的模型里面,从多模态,文本推理和工具调用这几个角度考虑,哪个模型是体验最好的?
可以支持本地部署(不过满血的够呛)和API
佬们,现在的需求是要在各个业务场景下面搞智能体,但是原先的模型配置的模型还是deepseek-R1和v3这种版本。
最近打算升级一下,国产开源模型或者能用上的模型里面,从多模态,文本推理和工具调用这几个角度考虑,哪个模型是体验最好的?
可以支持本地部署(不过满血的够呛)和API
国模开源还有多模态+工具调用支持,我只知道Qwen系列的有的模型可以,请佬们补充
企业内部用v4 flash 能部署的话,应该是性价比比较高的了
表面上有很多可选项,实际上要是能用只有deepseek一家可选
DeepSeek 吧,其实你最需要解决的是让老登们相信有问题了不是你的问题。
老登们比较了解的就是 DeepSeek 和豆包,什么 kimi glm 他们都不知道,到时候不好用就会觉得是搞得杂牌模型。
我们这边基本确定DeepSeek flash了,目前的性价比天花板了
补充一下,主要是便宜,买的推理机根本部署不了多大的模型。
如果有信创要求,首选 DeepSeek v4 、Qwen3.5 、glm5.x,这些模型应该有信创适配版本,性能也不错。
如果没有信创要求,而且没有要求必须国内模型,那么Gemma4 是个不错的选择。
ds现在的问题就是多模态能力还是偏弱了,有些场景还是需要识图的
你要多模态那不就基本只有qwen可选了,kimi估计你硬件不一定能部署的了吧?
不考虑本地部署的情况下还是推荐qwen,而且阿里本身也专门就是搞政企服务的,qwen3.7 算是第一梯队的了,可惜的是MAX没有多模态,plus才有 ,3.7 max我这边实测某些特定情况下的很不错的
纯干活能力glm5.2,综合多模态能力的话qwen3.7。
同样某国企,去年拿的联通那边的一体机,当时整的还是deepseek-r1:70b,和qwen的。
你要明白,国企内部合规使用的情况下,很难说花大几百万买一套信创设备让你部署满血版的…
综上所述,选qwen的小一号的模型已经是最优解了。
当然如果能部署满血版当我没说,开源权重都下载一下也没问题
要支持多模态,不一定是一个模型,可以组合着来用
| 开源、可本地部署模型 | Deepseek-V4-Flash | Qwen3.6-27B/Qwen3.5-397B-A17B | GLM-4.6V | Minimax-M3 | Mimo-V2.5 |
|---|---|---|---|---|---|
| 多模态支持 | 不支持 | 支持视觉 | 支持视觉 | 支持视觉 | 支持视觉、音频 |
| Agent性能 | 在本表范围内,强 | 在本表范围内,较强 | 在本表范围内,较弱 | 在本表范围内,强 | 在本表范围内,还行 |
| 国企内的老登熟悉? | 是 | 否 | 否 | 否 | 否 |
| 文本写作 | 在本表范围内,中等 | 在本表范围内,397B强,27B中等 | 在本表范围内,中等 | 在本表范围内,强 | 在本表范围内,中等 |
想必你司是部署不了500B以上的模型的,大多数国企口号吹得响亮,但是一看算力几乎没有。上面的模型基本上是500B以下能选的几款了。
为什么不是 Qwen3.6-27B 和 Qwen3.6-35B-A3B放一起
Qwen3.5-397B这个性价比不是被Qwen3.6-27B薄纱了
一个是Qwen系列里面Dense模型目前最强的,一个是MoE目前最强的。
deepseek v4 flash + qwen 3.6 plus,其中以deepseek v4 flash为主,qwen3.6只做VLM
你这套方案我觉得还是比较合适的。打算配个Qwen3.6-35B-A3B
先要看你们公司算力的情况如何,上下文能撑到多少。
Qwen3.5-397B-A17B 和 Qwen3.6-35B-A3B 都是MoE模型啊,那不应该也是替换关系?