标签
本文提出了一种将视觉-语言模型量化到每参数2.7位的框架,通过将Llama 3.2 11B Vision Instruct模型压缩至3.7 GB,实现高效移动部署,同时保持视觉问答任务上的性能。
PrismML 发布 Bonsai Image 4B,这是一系列紧凑型图像生成模型,使用 1-bit 和三进制权重,能够在笔记本电脑和 iPhone 等本地设备上实现高质量扩散推理,同时显著减少内存占用。