官方博客:PrismML — Introducing Bonsai 2 27B: Near-Lossless Compression in a 9x Smaller Footprint
25 个赞
我去画个鹈鹕试一试,看起来大小还好
耗时5分钟把16k上下文干满了,调整128k试下
耗费33k token q2 5080 laptop 初始44/stoken 最后37,降速曲线大概是平方曲线

5 个赞
怎么Agentic 和 Coding, 3.8 比 3.6 还低?
3 个赞
等佬友的测试 感觉8G就能跑起来了 不知道速度怎么样
1 个赞
1 个赞
之前Qwen3.6时候也是这家 量化到Q1说是有95%的性能 一直不知道是什么黑科技
可以的,unsloth以前就宣传用1bit写代码来着。不过尽量用2bit吧。
等个实测,看看到底有多猛
这么小,可以本地部署玩了,不知道智商跟不跟得上
2 个赞
大概率是吹的,上一代就拉完了。
1 个赞
等个佬测试反馈,我是不信的,这些人的数据真的离谱
等大佬测试,看看这个PQ2的效果如何
等大佬们的测试结果,看一下性能怎么样?
急急急,速更,日不能寐,在写一千万token的 ![]()
这个跟qwen3.5-9b-6bits的官方量化版本哪个好一些…看起来显存基本都一样大






