@xenovacom: Bonsai 27B 彻底改变了本地 LLM 的游戏规则。1位量化将其从 54GB 缩小到仅 3.8GB(减少 93%),同时……

X AI KOLs Timeline 模型

摘要

Bonsai 27B 通过 1 位量化实现了 93% 的体积缩减,同时保留了 90% 的智能,借助自定义 WebGPU 内核实现本地浏览器推理。

Bonsai 27B 刚刚彻底改变了本地 LLM 的游戏规则。 1 位量化将其从 54GB 缩小到仅 3.8GB(减少 93%),同时保留了 90% 的智能。这太疯狂了。 借助由 Fable 5 和 GPT 5.6 Sol 编写的自定义 WebGPU 内核,该模型现在可以在你的浏览器中本地运行!https://t.co/I30M8u1qVW
查看原文
查看缓存全文

缓存时间: 2026/07/16 14:19

Bonsai 27B 彻底改变了本地大语言模型的游戏规则。

1比特量化将其从54GB缩小到仅3.8GB(减少93%),同时保留了90%的智能。这简直不可思议。

借助由 Fable 5 和 GPT 5.6 Sol 编写的自定义 WebGPU 内核,该模型现在可以在你的浏览器中本地运行!https://t.co/I30M8u1qVW

相似文章

浏览器中的1位LLM

Hacker News Top

一款1位LLM(Bonsai)现在可以通过WebGPU在浏览器中运行,实现高效的设备端推理。

在本地定期使用Bonsai 27b 1b量化版

Reddit r/LocalLLaMA

一位用户分享了在16GB MacBook Air上本地使用Bonsai 27b的1-bit量化版进行日常聊天、辅导Go语言以及分析个人笔记的积极体验,称赞其智能性和小巧的体积。