DFM Mimir v1:一个开源 HRM,仅使用允许的后训练数据,在 10 亿参数下提供前沿性能

Hugging Face Daily Papers 论文

摘要

Mimir v1 是一个 10 亿参数的层级推理模型,在道德来源的数据上训练,实现了具有竞争力的英语性能,并为丹麦语设定了最新成果,匹配更大的前沿模型。

当前大型语言模型开发依赖于庞大的、通常不允许的数据集,这为致力于开源和道德来源数据的研究人员创造了高门槛。我们推出 Mimir v1,这是一个基于层级推理模型 (HRM) 架构的 10 亿参数语言模型,从头开始训练,仅使用允许的后训练数据,为英语提供高度竞争力的性能,并为丹麦语设定新的最新成果。Mimir v1 在 161 个数据集的混合物上训练,超越了原始的 HRM-Text 1B,并与更大的前沿模型如 Qwen 3.5 4B 和 Gemma 4 E2B 竞争,在 20 个基准测试中对英语、数学和代码以及丹麦语进行了测试。该模型可在 Hugging Face Hub 上获取:https://huggingface.co/danish-foundation-models/DFM-Mimir
查看原文
查看缓存全文

缓存时间: 2026/08/17 15:48

论文页面 - DFM Mimir v1:基于许可后训练数据实现1B参数前沿性能的开放HRM

来源:https://huggingface.co/papers/2608.13517

摘要

Mimir v1是一个10亿参数的层级推理模型,仅通过许可数据训练,在多个基准测试中实现了具有竞争力的英文性能和最先进的丹麦语表现。

当前大语言模型(https://huggingface.co/papers?q=language%20model)的开发依赖大规模、常非许可数据集,为坚持开源与伦理数据的研究者设置了高门槛。我们推出Mimir v1——一个基于层级推理模型(https://huggingface.co/papers?q=Hierarchical%20Reasoning%20Model)(HRM)架构的10亿参数语言模型(https://huggingface.co/papers?q=language%20model)。该模型从零开始训练,仅使用许可的后训练数据(https://huggingface.co/papers?q=post-training%20data),在英语领域表现极具竞争力,并在丹麦语领域创下新的技术前沿标准。通过161个数据集的混合训练,Mimir v1不仅超越了原版HRM-Text 1B,更在涵盖英语、数学与代码及丹麦语的20个基准测试(https://huggingface.co/papers?q=benchmarks)中与Qwen 3.5 4B、Gemma 4 E2B等更大规模的前沿模型相抗衡。模型现已发布于Hugging Face Hub:https://huggingface.co/danish-foundation-models/DFM-Mimir

查看arXiv页面(https://arxiv.org/abs/2608.13517)查看PDF(https://arxiv.org/pdf/2608.13517)项目主页(https://www.foundationmodels.dk/)GitHub0(https://github.com/schneiderkamplab/HRM-Text)添加到收藏夹(https://huggingface.co/login?next=%2Fpapers%2F2608.13517)

在您的智能助手中获取本文: hf papers read 2608.13517 尚未安装最新CLI?curl -LsSf https://hf.co/cli/install.sh | bash

引用本文的模型1

danish-foundation-models/DFM-Mimir 文本生成• 2B• 2天前更新 • 1.38k • 9(https://huggingface.co/danish-foundation-models/DFM-Mimir)

引用本文的数据集0

无关联本文的数据集 在数据集README.md中引用arxiv.org/abs/2608.13517即可从本页面关联。

引用本文的Space0

无关联本文的Space 在Space README.md中引用arxiv.org/abs/2608.13517即可从本页面关联。

包含本文的收藏夹0

无包含本文的收藏夹 将本文添加到收藏夹(https://huggingface.co/new-collection)即可从本页面关联。

相似文章

sapientinc/HRM-Text-1B

Hugging Face Models Trending

Sapient Intelligence 发布了 HRM-Text-1B,这是一个拥有10亿参数的语言模型,采用新颖的双时间尺度循环架构(分层推理模型),以有限的参数数量提供无限的计算深度。预对齐检查点已在 Hugging Face 上开放获取。