Fable 是天花板。
摘要
一篇评论文章推测,Anthropic 的 Fable 模型可能代表了美国 AI 进步的天花板,并且中国 AI 开发者将因更快的迭代和蒸馏技术而很快超过美国的前沿模型。
在测试 Fable 之后,我猛然意识到几个月前听到的一句话。Anthropic 团队曾表示,他们一直在使用类似这样的模型来编写他们的模型。如果这是真的,或者值得相信的话,我认为这个模型非常接近 Anthropic 将产出的 AI 的天花板。我认为我们很快会迎来我称之为 AI 领域的“中国因素”,即中国在未来几年内肯定会超过美国的前沿模型。中国 AI 开发者除了蒸馏美国模型外,并不使用 AI 来改进自己的模型。像 GLM 或 Kimi 这样的模型,考虑到我们已经看到的速度,很容易超过美国的前沿模型。我认为这非常可能。中国开发者还被迫在更差的条件下创建 AI,因为他们缺乏美国那样的顶级算力,但他们仍然基本保持了速度,这本身已经令人难以置信。我认为我们已经到了一个美国 AI 将停滞不前的时刻,每次发布只有微小改进,没有大或小的飞跃。
相似文章
Fable 通过“当 AI 通过这项测试,务必警惕”测试
Claude Fable 在“人类最后的考试”(Humanity's Last Exam)基准测试中取得 53% 的成绩,比预期的 2025 年底里程碑更早达到,表明 AI 进展迅速。
@AndrewCurran_: https://x.com/AndrewCurran_/status/2066332670817456584
安德鲁·柯伦反思了Fable模型的消失和Mythos的出现,认为各国实现前沿AI能力的窗口已经关闭,而Anthropic关于AI竞赛加速的预测正在成为现实。
为什么 Fable 5 只包含到6月22日?Anthropic 真的认为这个模型太疯狂了吗?
Anthropic 的新模型,可能代号为 Fable 5,在主要 AI 基准测试中取得了尖端性能,在软件工程、长上下文任务中表现出色,并且仅提供到6月22日,引发了对其能力和局限性的疑问。
假设:如果中国发布了一个媲美或超越Fable 5的模型,会发生什么?
一个假设性讨论,探讨如果中国发布一个媲美或超越'Fable 5'的AI模型可能带来的经济与地缘政治影响,并将其视为对美国一个被低估的威胁。
测试 Mythos 和 Fable,超越 SWE-bench,Nvidia 的开放竞争者
Anthropic 发布带有严格防护措施的 Claude Fable 5,以及美国政府随后对该模型实施的出口管制,引发了人们对 AI 主权和专有 AI 平台稳定性的担忧。