bonsai

标签

Cards List
#bonsai

现在可以微调 Prism-ML 的三元 Bonsai 模型

Reddit r/LocalLLaMA · 4天前

Prism-ML 宣布他们的三元 Bonsai 模型现在可以进行微调,提供了示例代码,并建议使用较高的学习率。

0 人收藏 0 人点赞
#bonsai

@sudoingX:每天都有人问我如何在理论上跑不动的硬件上运行bonsai 27b。所以这里全部内容在此……

X AI KOLs Timeline · 4天前 缓存

一份详细指南,介绍如何在仅有8GB显存的硬件上运行27B Bonsai模型,使用1位量化版本和PrismML分支的llama.cpp,包含精确的服务器命令和配置。

0 人收藏 0 人点赞
#bonsai

浏览器中的1位LLM

Hacker News Top · 2026-07-16 缓存

一款1位LLM(Bonsai)现在可以通过WebGPU在浏览器中运行,实现高效的设备端推理。

0 人收藏 0 人点赞
#bonsai

@sudoingX: 这个实验室将 Qwen 3.6 27B(这个我整个月都称之为 24GB 层级霸主的模型)压缩到了 3.9GB。……

X AI KOLs Timeline · 2026-07-16 缓存

PrismML 宣布推出 Bonsai 27B,这是 Qwen3.6 27B 的二值量化版本,可在手机上运行,每个权重仅使用 1.125 比特,声称保留了 89.5% 的智能。该模型正由 @sudoingX 独立测试以验证性能。

0 人收藏 0 人点赞
#bonsai

对于拥有12GB GPU的用户,现在可以通过新的Ternary版本运行QWEN 3.6 27B,损失很小。

Reddit r/ArtificialInteligence · 2026-07-15

Qwen3.6 27B的新三元量化版本,名为Bonsai 27B,可以在12GB GPU上运行,内存需求减少10倍,性能达到原版的95%,使其适用于本地部署。

0 人收藏 0 人点赞
#bonsai

那么关于1-bit模型的共识是什么?它仍然是一个幻想吗?

Reddit r/LocalLLaMA · 2026-07-14

讨论关于Bonsai 8b和27b等1-bit模型的可行性,这些模型在保持功能的同时实现了较小的文件大小,质疑其主要用例和未来。

0 人收藏 0 人点赞
#bonsai

Prism-ML 的 Bonsai-27B 基准测试

Reddit r/LocalLLaMA · 2026-07-14

Prism-ML 发布了其 Bonsai-27B 模型的基准测试结果。

0 人收藏 0 人点赞
#bonsai

@TheAhmadOsman: 天哪!27B模型低于6GB和4GB,本地AI将成为默认。附注:我们将尽快在ODS上由@OsmanticAI优化此功能…

X AI KOLs Timeline · 2026-07-14 缓存

Ternary Bonsai 27B,一个大型语言模型,被演示在NVIDIA RTX 5090 GPU上本地运行,内存需求低于6GB,使消费级硬件上实现端到端的智能代理工作流成为可能。

0 人收藏 0 人点赞
#bonsai

@populartourist: 我可以在我的经济型笔记本上运行27B而不是9B。这简直令人难以置信。

X AI KOLs Timeline · 2026-07-14 缓存

PrismML宣布推出Bonsai 27B,这是一个基于Qwen3.6 27B的多模态模型,可以在手机上运行,支持本地多步推理、工具使用和长上下文工作流。

0 人收藏 0 人点赞
#bonsai

Bonsai 27B(1位LLM):首个能在手机上运行的27B级别模型

Hacker News Top · 2026-07-14 缓存

PrismML宣布推出Bonsai 27B,这是Qwen3.6 27B的1位与三元量化版本,可在手机和笔记本电脑上运行,保留基线性能的90-95%,占用3.9GB空间,支持自主智能体与多模态的端侧AI。

0 人收藏 0 人点赞
#bonsai

Prism-ML Bonsai Qwen 3.6 27B

Reddit r/LocalLLaMA · 2026-07-14 缓存

Prism ML 发布了 Ternary-Bonsai-27B,这是 Qwen3.6-27B 的三元量化版本,在约 7.2 GB 的占用下保留了 FP16 智能的 95%,能够在笔记本电脑和单 GPU 上实现完整的 27B 级推理,在 Apple M5 Pro 上速度可达 26 tok/s。

0 人收藏 0 人点赞
#bonsai

prism-ml/Ternary-Bonsai-27B-mlx-2bit

Hugging Face Models Trending · 2026-07-04 缓存

Prism ML 发布了 Ternary-Bonsai-27B-mlx-2bit,这是一个三元量化的 27B 参数语言模型,在约 7.2 GB 内存下实现了 FP16 性能的约 95%,使笔记本电脑能够进行完整推理。

0 人收藏 0 人点赞
#bonsai

Strace-ui、Bonsai_term 与 TUI 复兴

Hacker News Top · 2026-06-02 缓存

Jane Street 的工程师介绍了 strace-ui,这是一个用于 strace 的交互式终端 UI,通过过滤、PID 追踪和手册页集成简化了系统调用调试,并强调了由其 Bonsai 框架推动的 TUI 复兴。

0 人收藏 0 人点赞
#bonsai

PrismML-Eng/Bonsai-demo

GitHub Trending (daily) · 2026-07-16 缓存

PrismML发布了Bonsai 27B,一个支持代理工具调用和长上下文的视觉语言模型,以及1-bit和ternary变体。该演示仓库允许在多种硬件上本地运行这些模型。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈