PrismML 推出 Qwen-3.6-27B 压缩版 - Khosla 支持的初创公司声称在 iPhone 上运行有史以来最大 AI 模型取得突破
摘要
Khosla 支持的初创公司 PrismML 发布了 Qwen-3.6-27B 的压缩版本,声称这是有史以来在 iPhone 上运行的最大 AI 模型。
暂无内容
相似文章
@TheAhmadOsman: 一直在玩@PrismML的新模型,该模型将Qwen 3.5 27B变成了子4GB和子6GB的权重,令我印象深刻 C…
PrismML发布了一个压缩版的Qwen 3.5 27B,可以装入子4GB和子6GB内存中,实现了令人印象深刻的本地AI性能。
Prism ML 在与 Apple 洽谈缩小模型以便在手机上本地使用
Prism ML 正在与 Apple 洽谈部署模型缩小技术,使得强大的AI模型能够直接在iPhone上运行,提升隐私性并减少对云端推理的依赖。
@sudoingX: 这个实验室将 Qwen 3.6 27B(这个我整个月都称之为 24GB 层级霸主的模型)压缩到了 3.9GB。……
PrismML 宣布推出 Bonsai 27B,这是 Qwen3.6 27B 的二值量化版本,可在手机上运行,每个权重仅使用 1.125 比特,声称保留了 89.5% 的智能。该模型正由 @sudoingX 独立测试以验证性能。
Qwen 3.8 27b 发布:本地AI的重大新闻
Qwen 3.8 27b,一个参数小于300亿的AI模型,已经发布,适合在消费级硬件如RTX 3090或M4 Pro上进行本地推理,有可能取代基于云的AI订阅,并将工作流程转移到本地。
Bonsai 27B(1位LLM):首个能在手机上运行的27B级别模型
PrismML宣布推出Bonsai 27B,这是Qwen3.6 27B的1位与三元量化版本,可在手机和笔记本电脑上运行,保留基线性能的90-95%,占用3.9GB空间,支持自主智能体与多模态的端侧AI。