@shawn_pana:Opus 4.7 击败了 Stockfish……Claude Code 刚学会了下棋 > 从 DOM 中解析棋盘状态 > 跟踪变化……
摘要
Anthropic 的 Opus 4.7 展示了下棋能力,击败了 Stockfish。Claude Code 能够自主解析网页中的棋盘状态,并通过浏览器交互实时走子。
Opus 4.7 击败了 Stockfish……Claude Code 刚学会了下棋 > 从 DOM 中解析棋盘状态 > 跟踪每一步之间的变化 > 通过浏览器自动化实时走子就是 AGI……
查看缓存全文
缓存时间: 2026/04/21 07:07
Opus 4.7 击败了 Stockfish……Claude Code 刚刚学会了下棋:> 从 DOM 解析棋盘状态 > 追踪走子间的变化 > 通过浏览器 harness 实时走子。这就是 AGI……
相似文章
我让 Claude 和 OpenAI Codex 各自根据一个提示编写了一个国际象棋引擎,然后让它们对弈了10局。结果10-0,全部是将死,而且 Codex 五次都以一模一样的24步对局落败。
一个实验让Claude和OpenAI Codex分别根据相同的提示编写了一个国际象棋引擎,然后进行了10局对弈。Claude的引擎Fable5以10-0获胜,全部通过将死取胜,而Codex的引擎在执白的5局中全部走出了完全相同的24步棋。
@mattshumer_: Claude Opus 5 一次生成了这个游戏。您在这个演示中看到的所有内容都是自定义代码……没有使用任何外部资产……
Claude Opus 5 展示了仅使用自定义代码从头生成整个游戏的能力,且没有使用任何外部资产,这标志着AI驱动游戏开发的一次重大飞跃。
“@mfpiccolo: Opus 4.8 已发布。以下是 @iiidevs 首席工程师的结论:进行了压力测试,它只是另一个无法真正理解……的语言模型”
Anthropic 发布了 Claude Opus 4.8,这是对 Opus 4.7 的增量更新,具有更精准的判断力和更长的自主工作能力,不过一些工程师对其在缺乏广泛指导下的代码生成能力仍持怀疑态度。
我让Codex和Claude Opus处理同一个Java AI单体代理项目
一位开发者比较了Codex 5.3和Claude Opus 4.6在自主Java AI代理开发中的表现,发现架构更优雅的模型(Claude)经常产生从未执行过的代码,而更直接、更单调的Codex则通过超时和历史恢复等实用修复改进了实际产品。
Claude Opus 4.8 在 ARC-AGI 3 上得分超过 1% !!
Claude Opus 4.8 在 ARC-AGI 3 基准测试中取得了超过 1% 的分数,表明在一项困难的人工智能推理测试上取得了轻微进展。