公司的智能客服项目,目前已经在测试阶段了,目前接的腾讯的千问Max,看了一下账单,成本有点高,打算自己部署个开源模型,佬们有推荐的吗,ds-v4行不行,在L站看了两天,有好评也有差评,纠结了
不会差到哪去,主要问题是要治好幻觉、不能随便回答,而幻觉任何模型都有。所以有一个好的知识库是最重要的
自己部署的成本不是更高吗。v4需要什么配置
可以考虑下千问3.6 35B,DeepSeek可以考虑v4 flash
我也做政府行业的智能客服,用的数据局的qwen3-32B模型,说是智能客服,99%都是走知识库.让他自由发挥总会有千奇百怪的问题
佬用的RAG还是文件检索呀
qwe3-32B这个模型我们也在用
实际感觉agent工具调用能力不太行
单纯RAG总是会有幻觉的问题,没法消除
长期的话 可以自己搭 然后用自己的知识库
我们单位用的是qwen-32b的开源模型,自己部署的
回答速度和质量还不错吧
这种QA客服用小模型32B就完事了,你们居然用max,太有实力了 ![]()
RAG , bge-m3 和bge-reranker-v2-m3
客服用千问max这么奢侈的吗?感觉v4 flash就够用了吧
自己部署ds-v4,成本不是更爆炸?感觉Qwen3.6 27B这种模型就能胜任
嵌入我们也是用的bge,重排暂时没上
想请教一下佬怎么分片的,需不需要用父子块,Context Retrieval之类的花里胡哨的东西,最近我们确实遇到了瓶颈
当然应该也跟语料有关系,如果语料本身都是QA的话,可能效果会好一些。我们语料是产品描述、案例之类的材料,检索的时候容易串,现在正在尝试加元信息
看你们的智能客服项目是自己公司用还是卖个客户用,如果是给别人用,自部署大模型就不现实
确实,自己用倒是没问题,对外的话,客服代表了公司前台。确实如果幻觉随便回答,会影响的,主要是社会层面的
分块是最坑的,每个文章都要人工处理,没有什么好的方法,具体问题具体处理.人工越多越智能,毕竟才32B,算力不够人力来凑
我们做问数的相关知识库的时候用的父子块,其他政策类的没有
确实,目前我们来看也是,基本上都会走知识库,要解决的问题也很多,包含随意承诺,随意乱聊,幻觉信息等
公司花钱我不心疼哈哈哈,但是成本确实是个问题,所以目前是在做调研,看看要不要自己部署模型,主要是并发要上的去,要支撑几千人的客服团队
但是日常生活中 比如电信 狗东这些 想要找客服的时候还是更希望找到一个真人 来对接