@xenovacom: Bonsai 27B 彻底改变了本地 LLM 的游戏规则。1位量化将其从 54GB 缩小到仅 3.8GB(减少 93%),同时……
摘要
Bonsai 27B 通过 1 位量化实现了 93% 的体积缩减,同时保留了 90% 的智能,借助自定义 WebGPU 内核实现本地浏览器推理。
Bonsai 27B 刚刚彻底改变了本地 LLM 的游戏规则。
1 位量化将其从 54GB 缩小到仅 3.8GB(减少 93%),同时保留了 90% 的智能。这太疯狂了。
借助由 Fable 5 和 GPT 5.6 Sol 编写的自定义 WebGPU 内核,该模型现在可以在你的浏览器中本地运行!https://t.co/I30M8u1qVW
查看缓存全文
缓存时间: 2026/07/16 14:19
Bonsai 27B 彻底改变了本地大语言模型的游戏规则。
1比特量化将其从54GB缩小到仅3.8GB(减少93%),同时保留了90%的智能。这简直不可思议。
借助由 Fable 5 和 GPT 5.6 Sol 编写的自定义 WebGPU 内核,该模型现在可以在你的浏览器中本地运行!https://t.co/I30M8u1qVW
相似文章
Bonsai 27B:使用自定义WebGPU内核在浏览器中本地运行的1比特密集型大语言模型
Bonsai 27B是一个1比特密集型大语言模型,通过使用自定义WebGPU内核可以在浏览器中本地运行,实现高效的设备端推理。
浏览器中的1位LLM
一款1位LLM(Bonsai)现在可以通过WebGPU在浏览器中运行,实现高效的设备端推理。
Bonsai 27B(1位LLM):首个能在手机上运行的27B级别模型
PrismML宣布推出Bonsai 27B,这是Qwen3.6 27B的1位与三元量化版本,可在手机和笔记本电脑上运行,保留基线性能的90-95%,占用3.9GB空间,支持自主智能体与多模态的端侧AI。
@sudoingX: 这个实验室将 Qwen 3.6 27B(这个我整个月都称之为 24GB 层级霸主的模型)压缩到了 3.9GB。……
PrismML 宣布推出 Bonsai 27B,这是 Qwen3.6 27B 的二值量化版本,可在手机上运行,每个权重仅使用 1.125 比特,声称保留了 89.5% 的智能。该模型正由 @sudoingX 独立测试以验证性能。
在本地定期使用Bonsai 27b 1b量化版
一位用户分享了在16GB MacBook Air上本地使用Bonsai 27b的1-bit量化版进行日常聊天、辅导Go语言以及分析个人笔记的积极体验,称赞其智能性和小巧的体积。