@AdinaYakup: MiniCPM5-1B 是 1B 参数级别中的一款令人印象深刻的发布!@OpenBMB https://huggingface.co/collections/openbmb/minicpm5… 1B …
摘要
MiniCPM5-1B 是 OpenBMB 推出的全新 1B 参数 AI 模型,具有 Think/No-Think 模式的混合推理能力、128K 上下文窗口、Apache 2.0 许可证,并可在多种硬件上运行。
查看缓存全文
缓存时间: 2026/05/25 18:43
MiniCPM5-1B 是 1B 参数级别中令人印象深刻的发布!@OpenBMB
https://t.co/1JwnRUYeEW
✨ 1B - Apache 2.0 ✨ 混合推理,支持思考/不思考模式 ✨ 128K 上下文长度 ✨ 支持 CPU / Apple Silicon / GPU 运行 ✨ 同一参数级别中出色的评估结果 https://t.co/dnEMpHuaWk
MiniCPM5 - openbmb 模型合集
来源:https://huggingface.co/collections/openbmb/minicpm5 更新于约5小时前
- — #### openbmb/MiniCPM5-1B 文本生成• 1B• 更新于约8小时前 • 2 • 67 (https://huggingface.co/openbmb/MiniCPM5-1B)
- — #### openbmb/MiniCPM5-1B-SFT 文本生成• 1B• 更新于约7小时前 • 2 • 7 (https://huggingface.co/openbmb/MiniCPM5-1B-SFT)
- — https://huggingface.co/spaces/openbmb/MiniCPM5-1B-Demo
- — #### openbmb/MiniCPM5-1B-MLX 文本生成• 0.2B• 更新于约8小时前 • 2 (https://huggingface.co/openbmb/MiniCPM5-1B-MLX)
- — #### openbmb/MiniCPM5-1B-GGUF 文本生成• 1B• 更新于约8小时前 • 9 (https://huggingface.co/openbmb/MiniCPM5-1B-GGUF)
- — #### openbmb/Ultra-FineWeb 查看器• 更新于2025年12月10日 • 1.29B • 52.4k • 342 (https://huggingface.co/datasets/openbmb/Ultra-FineWeb)
- — #### openbmb/Ultra-FineWeb-L3 更新于约10小时前 • 115 • 44 (https://huggingface.co/datasets/openbmb/Ultra-FineWeb-L3)
- — #### openbmb/UltraData-Math 查看器• 更新于4月15日 • 181M • 51.4k • 307 (https://huggingface.co/datasets/openbmb/UltraData-Math)
相似文章
MiniCPM5 1B - 这是什么?
MiniCPM5-1B 是 OpenBMB 推出的一款新型小语言模型,据称是从头构建的,拥有自己的分词器和独特行为,作为一款功能强大的 1B 模型引发了热议。
MiniCPM5-1B
OpenBMB 发布了 MiniCPM5-1B,这是一个密集型1B参数Transformer模型,在开源1B级模型中达到SOTA,专为设备端部署设计,支持混合推理和长上下文。
MiniCPM5-1B 表明小模型竞赛尚未结束
MiniCPM5-1B 是 OpenBMB 推出的一个拥有 10 亿参数的模型,在 AIME 2025 和 τ2-Bench Telecom 上取得了令人瞩目的成绩,超越了更大的模型。它从单个检查点同时提供快速模式和推理模式,这得益于包括监督微调、强化学习和在线策略蒸馏在内的三阶段后训练过程。
@ModelScope2022: MiniCPM5-1B 现已完全开源,包含权重、训练数据和部署代码。1B参数,在Artificial Analysis上排名第一…
MiniCPM5-1B 已完全开源,包含权重、训练数据和部署代码;它在2B以下模型中取得最高评分,并可在边缘设备上运行。
@AdinaYakup: MiniCPM V4.6 一个真正能在手机上运行的 1B 多模态大语言模型,由 @OpenBMB 刚刚发布 1B - Apache2.0 支持 iOS、Android,…
OpenBMB 发布了 MiniCPM V4.6,这是一个专为移动设备优化的 1B 参数多模态大语言模型,采用 Apache 2.0 许可证。它具备混合视觉 token 压缩功能,声称在 iOS、Android 和 HarmonyOS 上原生运行时,吞吐量比 Qwen3.5 0.8B 快约 1.5 倍。