RT,不考虑电费的情况下,想部署qwen 3.8 27b,目前比较好的方案是啥?看现在170hx好像性价比挺高的
我用5060TI*2=32GB显存跑的 NVFP4版本,220k上下文差不多,40t/s,prefill=5000+ 一个人基本够用了。并发的话 110两人也可以。成本便宜带保修。
不考虑电费,考虑房费嘛?噪音比电费烦… ![]()
也心痒痒了 ![]()
刚刚用两块4090来部署作为本地识图
我查了这玩意很慢真的值得买吗??
4卡V100 16G,或者双卡2080ti 22G
两个2080ti 22g用nvlink应该是性价比最高的了
Mac Studio应该没那么大噪音吧
v100 搞两张,不放心的话就2080ti 22g的搞两张
mac studio没试过诶,涡轮显卡噪音大
个人用完全足够了, M5 ultra 的带宽也不错。
主要是现在这模型真有点儿东西,干点儿啥事儿调研相关的和生成一些小工具非常够用,我是本地7900XT部署的UD_Q3,prefill速度可以达到五六百,生成速度40左右。对了上下文128K。
我也蹲一下,说实话,单位不允许使用外部的API,如果能有这样一个本地部署的方案拿到工位上,还是非常的美滋滋的,反正铲子到时候也可以拿来学习训练之类
有人关注过小米最新的那个AI主机吗?那个可以作为未来的备选吗?
确实是一种选择 不过感觉还比较遥远 明年才能商用 价格估计也不会便宜 生态也需要慢慢建立
不省钱,性价比高,RTX Pro 6000 WKS
老实说。。。你算一下自己每天用多少token先,先让AI给你算一笔账,怎么样划算。。
本地模型很蠢很笨,很多事情做不到的,我觉得有这个钱不如上Gemini 3.7flash,性能绝对比你本地跑的qwen好不知道多少倍
当然如果只能内网跑除外
闲鱼或者京东去搜3090 40G 有实力的话2张,风扇用好点,基本没噪音
我之前好像看到有人测过每秒大概5t,但是应该也能用吧
