@NielsRogge: 没错,一个3.9GB的文件在Math 500上取得了99.2%的准确率。这个数据集由@OpenAI在论文《Let's verify step by step》中引入…
摘要
PrismML的Bonsai-27B模型在Math 500数据集上取得了99.2%的准确率,超越了DeepSeek-R1和Kimi K2。
查看缓存全文
缓存时间: 2026/07/16 04:05
没错,一个3.9GB的文件在Math 500上达到了99.2%的成绩 🤯
这是@OpenAI在论文《Let’s verify step by step》中引入的数据集。
它的表现超越了DeepSeek-R1和Kimi K2等模型。https://t.co/QZ5vt74LQ6
Niels Rogge(@NielsRogge): @PrismML 的 Bonsai-27B 技术报告正在Papers with Code上登顶热门。
点击此处查看报告、评估结果、Hugging Face模型等更多内容:
相似文章
@NielsRogge: @PrismML 的 Bonsai-27B 技术报告在 Papers with Code 上成为热门趋势。在此处查看,以及评估、HF 模型等…
PrismML 的 Bonsai-27B 模型的技术报告在 Papers with Code 上备受关注,提供了评估和 Hugging Face 模型。
prism-ml/Bonsai-27B-gguf
Prism ML 发布了 Bonsai-27B-gguf,这是一个拥有 270 亿参数的语言模型,采用二进制(1.125 位)权重,实现了约 14 倍的尺寸缩减,同时保留了约 90% 的 FP16 推理性能。它可以在消费级硬件上运行,并具有高吞吐量。
@sudoingX: 这个实验室将 Qwen 3.6 27B(这个我整个月都称之为 24GB 层级霸主的模型)压缩到了 3.9GB。……
PrismML 宣布推出 Bonsai 27B,这是 Qwen3.6 27B 的二值量化版本,可在手机上运行,每个权重仅使用 1.125 比特,声称保留了 89.5% 的智能。该模型正由 @sudoingX 独立测试以验证性能。
@TheAhmadOsman: 一直在玩@PrismML的新模型,该模型将Qwen 3.5 27B变成了子4GB和子6GB的权重,令我印象深刻 C…
PrismML发布了一个压缩版的Qwen 3.5 27B,可以装入子4GB和子6GB内存中,实现了令人印象深刻的本地AI性能。
我对 PrismML 的 1-bit Bonsai-8B 与 IBM 的 Granite 在 CPU 工具调用上进行了基准测试。1-bit 模型胜出,但仅在语法约束解码下。
对 PrismML 的 1-bit Bonsai-8B 与 IBM 的 Granite 及其他模型在 CPU 工具调用上的独立基准测试显示,在语法约束解码下,Bonsai-8B 的通过率达到 92%,超越了更大的模型,但在无约束条件下失败。Granite 是原始表现最好的模型,通过率为 72%。