@svpino:首次,我觉得开源权重模型已无法忽视。我们正处于这些模型具有竞争…
摘要
Santiago (@svpino) 强调 MiniMax-M2.7,一个 230B 参数的开源权重模型,能与 Opus 4.6 和 GPT-5.4 等顶级专有模型相抗衡,在 SambaNova 上以低成本实现 440+ tokens/s 的推理速度。
首次,我觉得开源权重模型已无法忽视。我们正处于这些模型与顶尖模型竞争的局面。MiniMax-M2.7 是最新出品的猛兽,我以 440+ tokens/s 的速度运行它。230B 参数,真是一头猛兽。作为对比,我发现 Gemma4 31b 对很多我做的事情已经足够好了,所以想象一下额外增加 200B 参数会带来什么。当然,我无法在本地运行 MiniMax-M2.7,所以我使用 SambaNova。 • 极快的推理速度(可能是市场上最快的之一) • 极其便宜(大约是你为专有模型支付的 5%) • MiniMax 2.7 在 SWE-Pro 上得分为 56.22%,在 Terminal Bench 2 上为 57.0%,在 SWE Multilingual 上为 76.5% 这使其与 Opus 4.6/GPT-5.4 处于同一水平,区别在于 MiniMax 是开源权重。我录制了一段 MiniMax-M2.7 在 SambaNova 上运行的实时视频,这样你就能感受一下它的速度。这里我没有使用流式传输。该模型持续以约 440 tokens/秒的速度运行。使用这个在线测试工具测试 MiniMax M2.7:https://fandf.co/41uJXzw 感谢团队与我合作撰写此篇文章。
相似文章
@PrajwalTomar_: 大家又在忽视MiniMax了。他们刚刚发布了M3。首个结合前沿编码、1…
MiniMax发布了M3,一个开放权重模型,结合了前沿编码、1M上下文和原生多模态能力,性能与Opus相当,但成本仅为其一小部分。
@stevibe:MiniMax M2.7 有 230B 参数,家里真能跑?我用 Unsloth 的 UD-IQ3_XXS(80 GB)在 4 套配置上实测:…
MiniMax M2.7 有 230B 参数,家里真能跑?我用 Unsloth 的 UD-IQ3_XXS(80 GB)在 4 套配置上实测:4×RTX 4090(96 GB):71.52 tok/s,首 token 延迟 1045 ms;4×RTX 5090(128 GB):120.54 tok/s,首 token 延迟 725 ms;1×RTX PRO 6000(96 GB):118.74 tok/s,首 token 延迟 765 ms;DGX
@sdrzn: MiniMax的新m3模型在terminal-bench 2.1上得分与opus 4.7相同,计算/成本仅为前一代模…
MiniMax新推出的m3模型在terminal-bench 2.1上取得了与Opus 4.7相同的分数,但计算量和成本仅为原来的二十分之一,这归功于其全新的MiniMax Sparse Attention架构。
@ChiragAsarpota: 兄弟,这对开放模型来说太巨大了 连Qwen终于也屈服了,正在开放Max模型的权重。他们从未开放过任何M…
Qwen宣布,拥有2.4万亿参数的Qwen3.8-Max将于下周以开放权重的方式发布,同时发布的还有Qwen3.8-27B,这标志着开源AI的一次重大推进,并可能使其与顶级专有模型一较高下。
@ModelScope2022: MiniCPM5-1B 现已完全开源,包含权重、训练数据和部署代码。1B参数,在Artificial Analysis上排名第一…
MiniCPM5-1B 已完全开源,包含权重、训练数据和部署代码;它在2B以下模型中取得最高评分,并可在边缘设备上运行。