国企内部要搞Agent,在模型选取上有什么推荐吗?

佬们,现在的需求是要在各个业务场景下面搞智能体,但是原先的模型配置的模型还是deepseek-R1和v3这种版本。

最近打算升级一下,国产开源模型或者能用上的模型里面,从多模态,文本推理和工具调用这几个角度考虑,哪个模型是体验最好的?

可以支持本地部署(不过满血的够呛)和API

国模开源还有多模态+工具调用支持,我只知道Qwen系列的有的模型可以,请佬们补充

企业内部用v4 flash 能部署的话,应该是性价比比较高的了

表面上有很多可选项,实际上要是能用只有deepseek一家可选

DeepSeek 吧,其实你最需要解决的是让老登们相信有问题了不是你的问题。
老登们比较了解的就是 DeepSeek 和豆包,什么 kimi glm 他们都不知道,到时候不好用就会觉得是搞得杂牌模型。

我们这边基本确定DeepSeek flash了,目前的性价比天花板了:joy:补充一下,主要是便宜,买的推理机根本部署不了多大的模型。

如果有信创要求,首选 DeepSeek v4 、Qwen3.5 、glm5.x,这些模型应该有信创适配版本,性能也不错。

如果没有信创要求,而且没有要求必须国内模型,那么Gemma4 是个不错的选择。

ds现在的问题就是多模态能力还是偏弱了,有些场景还是需要识图的

你要多模态那不就基本只有qwen可选了,kimi估计你硬件不一定能部署的了吧?

不考虑本地部署的情况下还是推荐qwen,而且阿里本身也专门就是搞政企服务的,qwen3.7 算是第一梯队的了,可惜的是MAX没有多模态,plus才有 ,3.7 max我这边实测某些特定情况下的很不错的

纯干活能力glm5.2,综合多模态能力的话qwen3.7。

同样某国企,去年拿的联通那边的一体机,当时整的还是deepseek-r1:70b,和qwen的。

你要明白,国企内部合规使用的情况下,很难说花大几百万买一套信创设备让你部署满血版的…

综上所述,选qwen的小一号的模型已经是最优解了。

当然如果能部署满血版当我没说,开源权重都下载一下也没问题

要支持多模态,不一定是一个模型,可以组合着来用

开源、可本地部署模型 Deepseek-V4-Flash Qwen3.6-27B/Qwen3.5-397B-A17B GLM-4.6V Minimax-M3 Mimo-V2.5
多模态支持 不支持 支持视觉 支持视觉 支持视觉 支持视觉、音频
Agent性能 在本表范围内,强 在本表范围内,较强 在本表范围内,较弱 在本表范围内,强 在本表范围内,还行
国企内的老登熟悉?
文本写作 在本表范围内,中等 在本表范围内,397B强,27B中等 在本表范围内,中等 在本表范围内,强 在本表范围内,中等

想必你司是部署不了500B以上的模型的,大多数国企口号吹得响亮,但是一看算力几乎没有。上面的模型基本上是500B以下能选的几款了。

为什么不是 Qwen3.6-27B 和 Qwen3.6-35B-A3B放一起
Qwen3.5-397B这个性价比不是被Qwen3.6-27B薄纱了

一个是Qwen系列里面Dense模型目前最强的,一个是MoE目前最强的。

deepseek v4 flash + qwen 3.6 plus,其中以deepseek v4 flash为主,qwen3.6只做VLM

你这套方案我觉得还是比较合适的。打算配个Qwen3.6-35B-A3B

先要看你们公司算力的情况如何,上下文能撑到多少。

Qwen3.5-397B-A17B 和 Qwen3.6-35B-A3B 都是MoE模型啊,那不应该也是替换关系?