在本地定期使用Bonsai 27b 1b量化版
摘要
一位用户分享了在16GB MacBook Air上本地使用Bonsai 27b的1-bit量化版进行日常聊天、辅导Go语言以及分析个人笔记的积极体验,称赞其智能性和小巧的体积。
我一直在本地使用prismml的bonsai 27b的1比特量化版进行对话、闲聊和文献回顾(我会从笔记应用里随机扔点东西进去,看它如何分析,这些文本在互联网上不存在)。我在很多情况下把它当作“导师”,比如我目前正在学习Go语言,它给出的解释相当不错。我坚信,如果我们能在保持模型90%智能的同时拥有小巧的体积,这就是未来在包括低端设备在内的广泛设备上进行本地推理的道路。我在一台16GB的MacBook Air上运行它。它的小巧体积所提供的实用性给我留下了深刻印象,希望未来能有更多模型发布。说真的,即便它不能一次性搞定超大型项目,我仍然珍视它作为一个小型本地模型所拥有的智能。
相似文章
我在8GB显存下在Terminal-Bench 2.0上运行了Ternary-Bonsai-27B(2-bit)和Bonsai-27B(1-bit)
一位用户在Terminal-Bench 2.0上测试了27B参数Bonsai模型的量化1-bit和2-bit版本,在8GB显存内获得了结果。
Bonsai 27B(1位LLM):首个能在手机上运行的27B级别模型
PrismML宣布推出Bonsai 27B,这是Qwen3.6 27B的1位与三元量化版本,可在手机和笔记本电脑上运行,保留基线性能的90-95%,占用3.9GB空间,支持自主智能体与多模态的端侧AI。
@xenovacom: Bonsai 27B 彻底改变了本地 LLM 的游戏规则。1位量化将其从 54GB 缩小到仅 3.8GB(减少 93%),同时……
Bonsai 27B 通过 1 位量化实现了 93% 的体积缩减,同时保留了 90% 的智能,借助自定义 WebGPU 内核实现本地浏览器推理。
在Jetson Orin NX 16GB上本地运行了一个27B模型(1-bit),仍然有点惊讶它能工作
用户报告在Jetson Orin NX 16GB边缘设备上成功运行了量化到1-bit的27B参数模型,对可行性表示惊讶。
@sudoingX:每天都有人问我如何在理论上跑不动的硬件上运行bonsai 27b。所以这里全部内容在此……
一份详细指南,介绍如何在仅有8GB显存的硬件上运行27B Bonsai模型,使用1位量化版本和PrismML分支的llama.cpp,包含精确的服务器命令和配置。