agi-benchmark

标签

Cards List
#agi-benchmark

OpenAI的AGI高分源于测试框架而非模型本身(6分钟阅读)

TLDR AI · 6天前 缓存

OpenAI声称GPT-6 Astra在AGI基准测试中取得99.9%的高分,实则依赖特定测试框架(Provider Adapter)达成;若使用标准框架测试,得分仅为62.7%。此举暴露出AI模型评估与基准测试透明度存在重大问题。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈