Bonsai-2-27B:基于Qwen3.8 27B的究极量化几乎无损性能版

官方博客:PrismML — Introducing Bonsai 2 27B: Near-Lossless Compression in a 9x Smaller Footprint

权重:Bonsai-2 - a prism-ml Collection

25 个赞

我去画个鹈鹕试一试,看起来大小还好
耗时5分钟把16k上下文干满了,调整128k试下
耗费33k token q2 5080 laptop 初始44/stoken 最后37,降速曲线大概是平方曲线
PixPin_2026-09-18_11-14-26

5 个赞

怎么Agentic 和 Coding, 3.8 比 3.6 还低?

3 个赞

等佬友的测试 感觉8G就能跑起来了 不知道速度怎么样

1 个赞

Ternary-Bonsai-2-27B-PTQ1_0.gguf

Q1_0 还能正常用吗? :laughing:

PTQ1_0(密集三进制) 这好像不是我们平时理解的 Q1

1 个赞

之前Qwen3.6时候也是这家 量化到Q1说是有95%的性能 一直不知道是什么黑科技

可以的,unsloth以前就宣传用1bit写代码来着。不过尽量用2bit吧。

等个实测,看看到底有多猛

这么小,可以本地部署玩了,不知道智商跟不跟得上

2 个赞


尝尝咸淡

4 个赞

大概率是吹的,上一代就拉完了。

1 个赞

等个佬测试反馈,我是不信的,这些人的数据真的离谱

等大佬测试,看看这个PQ2的效果如何

等大佬们的测试结果,看一下性能怎么样?

PTQ1:


糖果问题雷霆大思考之后还是29


这也太能思考了吧… 等的着急

不知道是不是死循环了

1 个赞

急急急,速更,日不能寐,在写一千万token的 :distorted_face:

这个跟qwen3.5-9b-6bits的官方量化版本哪个好一些…看起来显存基本都一样大


折磨人