Shepherd's Dog:最危险AI模型制作的游戏
摘要
Anthropic的所谓危险AI模型在一次45分钟的会话中生成了完整的游戏'Shepherd's Dog',展现了前所未有的编程能力。
暂无内容
查看缓存全文
缓存时间: 2026/06/13 14:49
# 牧羊犬:世界最危险AI制作的游戏
来源:https://koenvangilst.nl/lab/claude-fable-shepherds-dog
几天前,Anthropic 发布了一款据称对世界过于危险的模型。我想用我的个人基准测试来试试它:能否一次性构建一个我已构思多年的游戏创意?
该模型以一段超长的推理过程开场,经过45分钟和超过20欧元的Token消耗,它愉快地报告说:“‘牧羊犬’已完工——一个独立的 2319 行 index.html,零依赖。”
你可以观看下方视频,或者直接体验游戏(https://vnglst.github.io/when-ai-fails/shepards-dog/claude-fable-5/index.html)。游戏真的很有趣,而且完全符合我的想象。对我来说,这是AI模型第一次能够一次性为我完成这个任务:
- 在此试玩游戏:vnglst.github.io/when-ai-fails/shepards-dog/claude-fable-5/index.html(https://vnglst.github.io/when-ai-fails/shepards-dog/claude-fable-5/index.html)
- 早期模型的其它尝试:github.com/vnglst/when-ai-fails/blob/main/shepards-dog/README.md(https://github.com/vnglst/when-ai-fails/blob/main/shepards-dog/README.md)
相似文章
AI模型变得越来越难以交流了
作者对近期AI模型,特别是Claude,表达了不满,因为它们由于过度解释和微妙的词汇调整以适应道德护栏,变得难以忍受对话,从而破坏了建设性的讨论。
Ornith 1.5:9B密集模型与35B/397B MoE模型
Ornith-1.5是一系列开源大语言模型,拥有9B、35B和397B参数,通过自我改进策略在推理、智能体和编程任务上达到最先进性能。
@no_stp_on_snek: 这不是开始,那早在今年初就已经开始了。
该帖子突显了对Anthropic的Claude日益增长的反对声音,包括订阅取消和水印问题,引发了对该AI模型未来的质疑。
@svpino:从Claude Code迁移到Codex已经几周了,我一点都没想念它。不,我并不在……
作者描述了自己从Claude Code迁移到Codex的体验,并声称Anthropic的产品毫无用户粘性,可以轻易被替代。
AI每日快报,8月19日:昨日五大信号。
OpenAI 因安全加固暂停前沿训练两周,监控开销增加20%;Anthropic 则提升错位风险评级并报告收入翻倍。数据中心面临电力削减威胁,Unitree Robotics 在上海 IPO 首日暴涨629%。