@cline:5个月前,Artificial Analysis Intelligence Index上的最高分是51(GPT-5.4 xhigh)。本周DeepSeek V4-…
摘要
一条推文指出,DeepSeek V4-Flash在Artificial Analysis Intelligence Index上获得了50分,接近五个月前GPT-5.4的51分,并预测本地模型将在两年内成为主流选择。
查看缓存全文
缓存时间: 2026/08/03 23:54
5个月前,人工分析智能指数(Artificial Analysis Intelligence Index)的最高分是51分(GPT-5.4 xhigh)。本周,DeepSeek V4-Flash在同一指数上拿到了50分。
r/LocalLLaMA 已经在Mac M2 Ultra上运行V4-Flash了。我们预测本地模型将在2年内成为主流选择。https://t.co/xvLYu6kFrn
相似文章
新版DeepSeek V4-Flash在ArtificalAnalysis Index上取得50分,比GLM-5.2和GPT-5.6 Luna低1分
DeepSeek的新V4-Flash模型在ArtificalAnalysis Index上得分为50,仅比GLM-5.2和GPT-5.6 Luna低1分。
DeepSeek刚刚戳破了美国AI泡沫。
DeepSeek的V4 Pro模型在定价上比GPT-5.5和Claude Opus等竞争对手低10-35倍,这表明随着'足够好'的模型以显著更低的成本压缩利润率,AI泡沫面临通缩压力。
我预测 DeepSeek V4 Flash 0731 的 Artificial Analysis 评分为 57 ± 1 分(Kimi K3 水平)
有用户基于线性回归预测,DeepSeek V4 Flash 0731 在 Artificial Analysis 上的评分将达到 57±1,与 Kimi K3 水平相当。该帖对其价格下的模型性能表示兴奋。
@xeophon: 51与GPT-5.4 xhigh得分相同,顺便说一下。该模型于3个月前发布,当时处于前沿
Z AI的GLM-5.2开放权重模型在Artificial Analysis Intelligence Index上获得51分,与GPT-5.4 xhigh持平,并且处于智能与每任务成本的帕累托前沿。
DeepSeek v4 Flash 能力显著提升
DeepSeek V4 Flash 在预览更新中展现出显著的基准测试提升,在智能体编码任务上与 GPT-5.6 Terra 互有胜负。