@AdinaYakup: MiniCPM5-1B 是 1B 参数级别中的一款令人印象深刻的发布!@OpenBMB https://huggingface.co/collections/openbmb/minicpm5… 1B …

X AI KOLs Following 模型

摘要

MiniCPM5-1B 是 OpenBMB 推出的全新 1B 参数 AI 模型,具有 Think/No-Think 模式的混合推理能力、128K 上下文窗口、Apache 2.0 许可证,并可在多种硬件上运行。

MiniCPM5-1B 是 1B 级别中的一款令人印象深刻的发布!@OpenBMB https://t.co/1JwnRUYeEW ✨ 1B - Apache 2.0 ✨ 混合推理,支持 Think / No-Think 模式 ✨ 128K 上下文 ✨ 可在 CPU/Apple Silicon/GPU 上运行 ✨ 在同类尺寸模型中表现出色 https://t.co/dnEMpHuaWk
查看原文
查看缓存全文

缓存时间: 2026/05/25 18:43

MiniCPM5-1B 是 1B 参数级别中令人印象深刻的发布!@OpenBMB

https://t.co/1JwnRUYeEW

✨ 1B - Apache 2.0 ✨ 混合推理,支持思考/不思考模式 ✨ 128K 上下文长度 ✨ 支持 CPU / Apple Silicon / GPU 运行 ✨ 同一参数级别中出色的评估结果 https://t.co/dnEMpHuaWk


MiniCPM5 - openbmb 模型合集

来源:https://huggingface.co/collections/openbmb/minicpm5 更新于约5小时前

  • — #### openbmb/MiniCPM5-1B 文本生成• 1B• 更新于约8小时前 • 2 • 67 (https://huggingface.co/openbmb/MiniCPM5-1B)
  • — #### openbmb/MiniCPM5-1B-SFT 文本生成• 1B• 更新于约7小时前 • 2 • 7 (https://huggingface.co/openbmb/MiniCPM5-1B-SFT)
  • — https://huggingface.co/spaces/openbmb/MiniCPM5-1B-Demo
  • — #### openbmb/MiniCPM5-1B-MLX 文本生成• 0.2B• 更新于约8小时前 • 2 (https://huggingface.co/openbmb/MiniCPM5-1B-MLX)
  • — #### openbmb/MiniCPM5-1B-GGUF 文本生成• 1B• 更新于约8小时前 • 9 (https://huggingface.co/openbmb/MiniCPM5-1B-GGUF)
  • — #### openbmb/Ultra-FineWeb 查看器• 更新于2025年12月10日 • 1.29B • 52.4k • 342 (https://huggingface.co/datasets/openbmb/Ultra-FineWeb)
  • — #### openbmb/Ultra-FineWeb-L3 更新于约10小时前 • 115 • 44 (https://huggingface.co/datasets/openbmb/Ultra-FineWeb-L3)
  • — #### openbmb/UltraData-Math 查看器• 更新于4月15日 • 181M • 51.4k • 307 (https://huggingface.co/datasets/openbmb/UltraData-Math)

相似文章

MiniCPM5 1B - 这是什么?

Reddit r/LocalLLaMA

MiniCPM5-1B 是 OpenBMB 推出的一款新型小语言模型,据称是从头构建的,拥有自己的分词器和独特行为,作为一款功能强大的 1B 模型引发了热议。

MiniCPM5-1B

Reddit r/LocalLLaMA

OpenBMB 发布了 MiniCPM5-1B,这是一个密集型1B参数Transformer模型,在开源1B级模型中达到SOTA,专为设备端部署设计,支持混合推理和长上下文。

MiniCPM5-1B 表明小模型竞赛尚未结束

Reddit r/ArtificialInteligence

MiniCPM5-1B 是 OpenBMB 推出的一个拥有 10 亿参数的模型,在 AIME 2025 和 τ2-Bench Telecom 上取得了令人瞩目的成绩,超越了更大的模型。它从单个检查点同时提供快速模式和推理模式,这得益于包括监督微调、强化学习和在线策略蒸馏在内的三阶段后训练过程。