标签
发布了 MiniMax-M3 的 Config-I 量化版本,在 MLX 上使用 2-bit 专家和 4-bit 注意力,将 427B MoE 模型从 869GB 减少到约 167GB,但该量化版本未经测试且需要为 mlx_lm 打补丁。
Modular 的内核团队正在优化对 MiniMax M3 的百万token上下文和原生多模态的服务,开放权重即将发布,可立即在 Modular 上部署。
MiniMax发布了MiniMax M3,这是首个开源权重AI模型,集成了编码和智能体任务的前沿能力,通过稀疏注意力扩展到100万上下文,取得了强劲的基准分数。