小参数量模型推荐

如题,我想在自己的电脑上部署个小参数量的模型,为了速度所以期望是 1-5B 大小的 有没有哪个小模型适合的,要求就是日常使用不吃太多性能 智商够用,
我问了deepseek他说是 Phi-3-mini 在数学和推理上比较好 这个可以吗?
qwen3的4b量化小模型怎么样?

看你的需求,这种小参数最好部署特化的模型,就是数据精简到最适合某个方向

需求很杂,我的想法是把图片路由到某个多模态好的 复杂任务就用推理强的,其他一些简单但麻烦的就丢给干活快智商还行的
这样搞几个模型来切换

还是得看具体需求, 现在5B以下的小模型能够把话说清楚的都不太多, 更不要提多模态方向的了. 基本上就只能做一些表格整理或者玩玩角色扮演之类的了, 需要逻辑或者知识量的任务都不太行.

为什么追求本地小模型呢,现在到处公益站 deepseek-v4-flash 也够用了吧

智商够用这个需求就太模糊了,不同的任务里面所谓智商够用的标准差异很大,不过话说回来小模型也没太多选择,26年发布的小模型可以都试试

1-5这个太小了智商应该不可能够用吧话说 :face_in_clouds:

我觉得Gemma还不错,轻量好用

可以试试最近新出的1bit版本的Bonsai-27B,基于Qwen3.6-27B量化,大小和4B的模型差不了多少,但是智商应该是吊打的,而且支持视觉

qwen 的 moe 还行,35b-a3b 那个,性能比 27b 稠密模型稍差一点,但是推理速度比 27b 快多了

我在 dgx spark 上跑的 nvfp4 量化,算力大约是 5070 水平,能有 60+的 tps

可以试试这个模型推荐器

感觉1~5b确实有点太小了
能力体感上又不太够用啊

如果说能上大一点的qwen35b-a3b就好多了
速度的话,我体感上还好,毕竟是个稀疏模型
不过这个常驻的话又比较占内存

最近那个新的南北阁3b,不过需要自己编译llamaserve

1-5B 太小,话都说不清楚。建议 12B 左右,有条件最好 32B

否则很有可能变成这样:

可以试一下 gemma-4的 12B 或 31B 版本,并且最好联网

phi3 都啥年代的模型了,推荐 qwen 吧

小模型太容易幻觉了,感觉能本地部署的模型都难以避免,哪怕是 30b 以上的小模型也挺容易幻觉

小模型只有qwen和gemma有价值 :smiling_face_with_tear: