@seclink: 这款拥有120亿参数的模型采用统一的 Transformer 架构,能够高效处理原始的多模态输入,且仅需 16GB 内存即可运行,完美适配 MacBook Pro 等设备。 它在各项基准测试中表现卓越,例如在 GPQA Diamond 上…
摘要
一款120亿参数的多模态模型开源发布,采用统一Transformer架构,仅需16GB内存即可运行,在多项基准测试中表现优异,支持256K上下文窗口和140多种语言。
查看缓存全文
缓存时间: 2026/06/04 03:57
这款拥有120亿参数的模型采用统一的 Transformer 架构,能够高效处理原始的多模态输入,且仅需 16GB 内存即可运行,完美适配 MacBook Pro 等设备。
它在各项基准测试中表现卓越,例如在 GPQA Diamond 上取得了 78.8% 的成绩,在 DocVQA 上更是高达 94.9%,其性能足以媲美规模更大的模型;
与此同时,它还支持 256K 的上下文窗口、140 多种语言以及逐步推理能力。
目前,该模型已在 Hugging Face 上以 Apache 2.0 许可证开源发布;得益于社区开发者的适配工作,用户现可实现快速的本地部署与运行。包括 Sundar Pichai 在内的业界领袖均对其给予高度评价,称赞其在日常硬件上为智能体(Agent)工作流找到了完美的平衡点。
相似文章
@FeitengLi: Hy-MT2 新的开源多语言翻译模型 能力可以跟顶尖大模型匹配、支持 33 种语言之间的互译,而且具备灵活的 Instruct 能力,实现了 2-bit 量化不足 500MB 的空间占用 可以很好的跑在端侧 https://modelsc…
Hy-MT2 is a new open-source multilingual translation model from Tencent Hy that supports 33 languages, offers flexible instruction capabilities, and achieves 2-bit quantization under 500MB for on-device deployment.
@Phoenixyin13: 这是全新的最佳美国开源模型。 Thinking Machines Lab 直接放出一个 975B 参数MoE 多模态巨兽,Apache-2.0 完全开源!在常规基准上,它甚至干掉了 NVIDIA 的 Nemotron 强项模型。 它的核心…
Thinking Machines Lab 发布了全新的 975B 参数 MoE 多模态开源模型,Apache-2.0 许可,在常规基准上超越 NVIDIA Nemotron,支持文本、图像、音频全模态,激活参数仅 41B,高效且友好部署。
@QingQ77: 从0训练一个0.1B的端到端全模态模型,一个权重搞定文字、语音、图片输入,输出文字和流式语音。 https://github.com/jingyaogong/minimind-o… MiniMind-O 是一个只有0.1B参数的全模态模型…
MiniMind-O 发布了一个仅 0.1B 参数的端到端全模态模型,支持文本、语音和图片输入及流式语音输出。该项目开源了代码、权重、训练数据和技术报告,强调在普通 GPU 上即可快速训练和推理。
@hank_aibtc: 家人们,本地 LLM太香了! 刷到 Hugging Face 上这个 gpt-oss-20b-tq3,真的有点上头! OpenAI 官方开源的 20B+ 参数 MoE 模型,被社区用 TurboQuant 3-bit 量化 + MLX 优…
The article highlights the gpt-oss-20b-tq3 model, a quantized version of an OpenAI MoE model that runs efficiently on standard 16GB MacBook Airs using TurboQuant and MLX optimizations.
@berryxia: Apple 一直其实在赌端侧模型的应用! 统一架构内存就是端侧模型的天然温床! 统一内存也就是,内存即显存。 也看到越来越多的优秀端侧模型出现。 OpenBMB 把 MiniCPM-V 4.6 这个 1.3B 的多模态模型放出来了,我看完…
OpenBMB 发布了 MiniCPM-V 4.6,一个 1.3B 参数的多模态模型,通过高分辨率视觉处理和高效压缩技术,在消费级硬件和手机上实现快速推理,性能超过同类大模型,且全面开源支持多种推理和量化框架。