@rohanpaul_ai: Meta的Muse Spark 1.2升至第4位,同时将Text Arena的成本-质量帕累托前沿向上推进。你只损失9分……
摘要
Meta的Muse Spark 1.2在Text Arena中升至第4位,通过降价约91%将成本-质量帕累托前沿向上推进,同时相比顶级模型仅损失9分。
查看缓存全文
缓存时间: 2026/08/08 07:06
Meta 的 Muse Spark 1.2 升至第4位,同时将 Text Arena 的成本-质量帕累托前沿向上推进。
在约1500分的相对评分标尺上,它与顶级模型 Fable 5 相比仅让出9分,同时将 Arena 的标准化价格降低了约91%。
按混合费率计算
- Claude Fable 5:1507分 / $40M
- Muse Spark 1.2 (xHigh):1498分 / $3.50M
Arena.ai (@arena): 激动人心的消息:来自 @AIatMeta 的 Muse Spark 1.2 (xHigh) 在 Text Arena 中位列第4(1498分),并重塑了帕累托前沿!
其定价为每 MToken 1.25/4.25。
再次恭喜 @AIatMeta 团队发布此版本!
相似文章
Muse Spark 1.1 在 Text Arena 排名中已逼近 Fable 5
Muse Spark 1.1 提升了其在 Text Arena 的排名,现已接近 Fable 5。
@DeRonin_: 突发:Meta刚刚发布了Muse Spark 1.1 大家都读错了Meta的Muse Spark 1.1,它不是GPT-5.5的竞争对手……
Meta发布了Muse Spark 1.1,这是一款低成本模型,在工具使用和金融代理等智能体任务上超越了竞争对手,但在编程基准测试中落后。定价为每百万输入token 1.25美元、每百万输出token 4.25美元,它定位为代理工作流的预算模型。
Meta 携 Muse Spark 1.1 加入激烈的 AI 编程大战
Meta 发布了 Muse Spark 1.1,一款面向智能编码的多模态 AI 模型,以有竞争力的价格与 OpenAI 和 Anthropic 展开竞争。
@cline: Muse Spark 1.1 刚刚发布,是他们迄今为止最强大的编码代理模型。在 Terminal-Bench 2.1 上得分 80.0%,……
Meta 发布了 Muse Spark 1.1,这是一款升级的编码代理模型,在 Terminal-Bench 2.1 上得分 80.0%,同时还公开预览了 Meta Model API。
@_jasonwei: 除了代理和编码能力外,Muse Spark 1.1 在回答健康问题方面也非常强大,这是一个持续增长的…
Muse Spark 1.1 是 Meta 新推出的代理与编码模型,在 HealthBench-Pro 上提升了 5% 的性能,超越了除 Fable 和 Mythos 外的所有竞争对手。