MiniMax-M2系列:迷你激活释放最大现实智能

Hugging Face Daily Papers 论文

摘要

MiniMax-M2系列引入了混合专家语言模型,在极少的激活参数下(总参数量2299亿,每token仅激活98亿)在代理任务上实现了高性能。该系列利用代理驱动的数据管道、名为Forge的可扩展强化学习系统,以及一个向自我进化迈出初步步骤的检查点。

我们推出了MiniMax-M2系列,这是一族混合专家语言模型,其核心理念是迷你激活可以释放最大的现实智能。旗舰版M2总参数量2299亿,每token仅激活98亿。M2系列专为代理部署端到端设计,基于三个组件:(i) 代理驱动的数据管道,在大规模代理编程和代理协作中生成可验证的轨迹,每个轨迹都基于可执行的工作空间和与工件对齐的奖励;(ii) Forge,一个可扩展的代理原生强化学习系统,适应长周期代理轨迹,结合了窗口式先进先出调度、前缀树合并、推理优化,以及清晰的训练-推理-代理解耦,支持白盒和黑盒代理;(iii) 最新的M2.7检查点向自我进化迈出了早期一步——自动调试训练运行并修改自身的支架。从M2到M2.7,这种组合将迷你激活足迹转化为代理编程、深度搜索、办公任务和推理基准测试上的前沿性能。
查看原文
查看缓存全文

缓存时间: 2026/05/27 02:47

论文页面 - MiniMax-M2系列:最小激活释放最大真实智能

来源:https://huggingface.co/papers/2605.26494 作者:

,

,

,

,

,

,

,

,

,

,

,

,

,

,

,

,

,

,

,

,

摘要

MiniMax-M2系列引入了混合专家语言模型,通过最少的激活参数,结合专门的训练和部署系统,在智能体任务中实现了高性能。

我们推出MiniMax-M2系列,这是一系列混合专家(Mixture-of-Experts (https://huggingface.co/papers?q=Mixture-of-Experts))语言模型,其核心原则是:小型激活能释放最大真实世界智能。旗舰版M2包含2299亿总参数,但每token仅激活98亿参数。M2系列专为智能体部署而端到端设计,基于三大组件:(i) 智能体驱动数据管道 (https://huggingface.co/papers?q=agent-driven%20data%20pipelines),生成大规模、可验证的轨迹,涵盖智能体编码 (https://huggingface.co/papers?q=agentic%20coding)和智能体协作 (https://huggingface.co/papers?q=agentic%20cowork),每个轨迹都基于可执行工作区 (https://huggingface.co/papers?q=executable%20workspace)和与产物对齐的奖励 (https://huggingface.co/papers?q=artifact-aligned%20reward);(ii) Forge,一个可扩展的智能体原生强化学习系统 (https://huggingface.co/papers?q=agent-native%20RL%20system),能够适应长周期智能体轨迹,并结合窗口化FIFO调度 (https://huggingface.co/papers?q=windowed-FIFO%20scheduling)、前缀树合并 (https://huggingface.co/papers?q=prefix-tree%20merging)、推理优化 (https://huggingface.co/papers?q=inference%20optimization)以及训练-推理-智能体解耦 (https://huggingface.co/papers?q=training-inference-agent%20decoupling),支持白盒和黑盒智能体;(iii) 最新的M2.7检查点朝着自我进化 (https://huggingface.co/papers?q=self-evolution)迈出了早期一步——自主调试训练运行并修改自身脚手架。从M2到M2.7,这种组合将小型激活足迹转化为前沿性能,在智能体编码 (https://huggingface.co/papers?q=agentic%20coding)、深度搜索、办公任务和推理基准测试中均表现出色。

查看arXiv页面 (https://arxiv.org/abs/2605.26494)
查看PDF (https://arxiv.org/pdf/2605.26494)
添加到收藏 (https://huggingface.co/login?next=%2Fpapers%2F2605.26494)

在您的智能体中获取这篇论文:

hf papers read 2605\.26494

没有最新的CLI?curl \-LsSf https://hf\.co/cli/install\.sh \| bash

引用该论文的模型0

没有模型链接此论文

在模型README.md中引用 arxiv.org/abs/2605.26494 即可从此页面链接。

引用该论文的数据集0

没有数据集链接此论文

在数据集README.md中引用 arxiv.org/abs/2605.26494 即可从此页面链接。

引用该论文的Space0

没有Space链接此论文

在Space README.md中引用 arxiv.org/abs/2605.26494 即可从此页面链接。

包含该论文的收藏集0

没有收藏集包含此论文

将本论文添加到一个收藏集 (https://huggingface.co/new-collection) 即可从此页面链接。

相似文章

MiniMaxAI/MiniMax-M2.7

Hugging Face Models Trending

MiniMaxAI发布了MiniMax-M2.7,这是一个开放权重模型,具备自我进化能力、先进的智能体团队支持,并在软件工程基准测试中表现出色(SWE-Pro上56.22%,MLE Bench Lite上66.6%奖牌率),在生产事故恢复和专业工作任务中有显著应用。

MiniMaxAI/MiniMax-M3

Hugging Face Models Trending

MiniMax 发布 M3,一款原生多模态模型,拥有100万上下文和约4280亿参数,采用 MiniMax Sparse Attention (MSA) 实现高效长上下文处理,达到前沿级别的编码和智能体性能。

MiniMax M3(2分钟阅读)

TLDR AI

MiniMax 推出了 M3,这是首个结合编程、智能体与多模态能力的开源权重模型,通过稀疏注意力机制支持高达 100 万 token 的上下文。