现在 Opus 5.5 在 Artificial Analysis 上得分为 58,开源模型需要多久才能达到 58?

Reddit r/LocalLLaMA 新闻

摘要

这篇帖子比较了AI模型的分数,指出Opus 5.5在Artificial Analysis上的得分为58,并推测开源模型可能在4-6个月内通过扩展和改进达到类似水平。

它比最好的开源模型 mimo 2.6 pro 高出12分,并且从 fable 5.1 有了很大飞跃。太疯狂了,glm 5.5 和 qwen 4 将与 gpt 6 sol 持平或更好,因为它的得分是48。如果最好的开源模型从44分提高到46分花了2个月,那么以这个速度,6个月后它们会达到58分吗?很可能它们会在4-5个月内达到,因为随着部署更多GPU、扩展参数、数据和计算并改进架构,它们在智能上会有更多飞跃。哇,sol 6 在 deepswe 上比 5.6 更差?
查看原文

相似文章