公司打算做智能客服

公司的智能客服项目,目前已经在测试阶段了,目前接的腾讯的千问Max,看了一下账单,成本有点高,打算自己部署个开源模型,佬们有推荐的吗,ds-v4行不行,在L站看了两天,有好评也有差评,纠结了

不会差到哪去,主要问题是要治好幻觉、不能随便回答,而幻觉任何模型都有。所以有一个好的知识库是最重要的

自己部署的成本不是更高吗。v4需要什么配置

可以考虑下千问3.6 35B,DeepSeek可以考虑v4 flash

我也做政府行业的智能客服,用的数据局的qwen3-32B模型,说是智能客服,99%都是走知识库.让他自由发挥总会有千奇百怪的问题

佬用的RAG还是文件检索呀
qwe3-32B这个模型我们也在用
实际感觉agent工具调用能力不太行
单纯RAG总是会有幻觉的问题,没法消除

长期的话 可以自己搭 然后用自己的知识库

我们单位用的是qwen-32b的开源模型,自己部署的
回答速度和质量还不错吧

这种QA客服用小模型32B就完事了,你们居然用max,太有实力了 :superhero:

RAG , bge-m3 和bge-reranker-v2-m3

客服用千问max这么奢侈的吗?感觉v4 flash就够用了吧

自己部署ds-v4,成本不是更爆炸?感觉Qwen3.6 27B这种模型就能胜任

嵌入我们也是用的bge,重排暂时没上
想请教一下佬怎么分片的,需不需要用父子块,Context Retrieval之类的花里胡哨的东西,最近我们确实遇到了瓶颈
当然应该也跟语料有关系,如果语料本身都是QA的话,可能效果会好一些。我们语料是产品描述、案例之类的材料,检索的时候容易串,现在正在尝试加元信息

看你们的智能客服项目是自己公司用还是卖个客户用,如果是给别人用,自部署大模型就不现实

确实,自己用倒是没问题,对外的话,客服代表了公司前台。确实如果幻觉随便回答,会影响的,主要是社会层面的

分块是最坑的,每个文章都要人工处理,没有什么好的方法,具体问题具体处理.人工越多越智能,毕竟才32B,算力不够人力来凑

我们做问数的相关知识库的时候用的父子块,其他政策类的没有

确实,目前我们来看也是,基本上都会走知识库,要解决的问题也很多,包含随意承诺,随意乱聊,幻觉信息等

公司花钱我不心疼哈哈哈,但是成本确实是个问题,所以目前是在做调研,看看要不要自己部署模型,主要是并发要上的去,要支撑几千人的客服团队

但是日常生活中 比如电信 狗东这些 想要找客服的时候还是更希望找到一个真人 来对接