@0x0SojalSec: 你可以在MacBook本地运行无审查版Bonsai 2-27B。 - 在24 GB的MacBook上每秒token数。 - 但基础模型没有达到我期望的水平……
摘要
一篇推文讨论了在配备24 GB RAM的MacBook上本地运行无审查版Ternary-Bonsai-27B AI模型,突出其在编码任务中的性能。
你可以在MacBook本地运行无审查版Bonsai 2-27B。
- 在24 GB的MacBook上每秒token数。
- 但基础模型没有达到我期望的水平
https://t.co/qW2FhwTMHa
查看缓存全文
缓存时间: 2026/09/19 09:01
您可以在MacBook上本地运行Bonsai 2-27B无审查模型。
- 在24GB内存的MacBook上运行速度约达到tok/s。
- 但基础模型表现未达预期
https://t.co/qW2FhwTMHa
Md Ismail Šojal 🕷️ (@0x0SojalSec): 您可以在7.2GB内存设备上本地运行全新的三值化Bonsai-27B无审查模型
- 拒绝响应几乎消失,具备母语级编程能力
- 对打包三值化权重进行了完全擦除
- 低程度擦除实现最大化HC伤疤模型效果
- 编程能力仍保持19/20水准
适合研究/离线使用,仍属通用模型,可在您的
相似文章
我在8GB显存下在Terminal-Bench 2.0上运行了Ternary-Bonsai-27B(2-bit)和Bonsai-27B(1-bit)
一位用户在Terminal-Bench 2.0上测试了27B参数Bonsai模型的量化1-bit和2-bit版本,在8GB显存内获得了结果。
在本地定期使用Bonsai 27b 1b量化版
一位用户分享了在16GB MacBook Air上本地使用Bonsai 27b的1-bit量化版进行日常聊天、辅导Go语言以及分析个人笔记的积极体验,称赞其智能性和小巧的体积。
@sudoingX:每天都有人问我如何在理论上跑不动的硬件上运行bonsai 27b。所以这里全部内容在此……
一份详细指南,介绍如何在仅有8GB显存的硬件上运行27B Bonsai模型,使用1位量化版本和PrismML分支的llama.cpp,包含精确的服务器命令和配置。
Bonsai 27B:使用自定义WebGPU内核在浏览器中本地运行的1比特密集型大语言模型
Bonsai 27B是一个1比特密集型大语言模型,通过使用自定义WebGPU内核可以在浏览器中本地运行,实现高效的设备端推理。
@TheAhmadOsman: 天哪!27B模型低于6GB和4GB,本地AI将成为默认。附注:我们将尽快在ODS上由@OsmanticAI优化此功能…
Ternary Bonsai 27B,一个大型语言模型,被演示在NVIDIA RTX 5090 GPU上本地运行,内存需求低于6GB,使消费级硬件上实现端到端的智能代理工作流成为可能。