@NathanWilbanks_: 这就是真正的AGI循环的样子:6+小时智能体运行时间 2.4亿+ tokens 86%+缓存命中率 500+工具调用 花费125美元 …
摘要
一个名为Annie的AI智能体自主将一份宝可梦红宝石GBA ROM重新编译成一个完整的混合WASM重编译器和GBA运行时,完成了一项通常需要专家团队数月、花费数万美元的任务。
查看缓存全文
缓存时间: 2026/06/09 01:35
这就是真正的AGI循环的样子:
- 6小时以上的智能体运行时间
- 2.4亿+ tokens
- 86%+ 缓存命中率
- 500+ 工具调用
- 花费125美元
= 一个输出,如果由专家团队完成需要数月时间,花费数万美元 https://t.co/iU2lWAx9xd
Nathan Wilbanks (@NathanWilbanks_): Annie刚刚完成了我认为不可能的事情。
原始的宝可梦 红宝石 .gba ROM 字节 → 完整的混合WASM重新编译器 + 完整的GBA运行时(ARM7TDMI + THUMB,扫描线精确PPU,4通道DMA,Flash 128K + RTC,BIOS HLE)全部在一个自主冲刺中完成 🤯
32位控制台的壁垒刚刚…
相似文章
@IntuitMachine:你的AI编程代理仅修复一个bug就烧掉2美元。你以为这是“廉价自动化”。以下是16,000次生产运行揭示的真相…
对AI编程代理成本的分析显示,代理工作流消耗的token数可达简单ChatGPT调用的3500倍,大部分浪费来自冗余的上下文加载。文章建议追踪重复的文件操作并使用高效模型降低成本。
@no_stp_on_snek: 在Poolside自有的agent(pool)中对Laguna S 2.1进行了此操作,指向DGX Spark上的本地实例,使用提示词…
两个AI编码智能体构建马里奥游戏的对比:Poolside agent中的Laguna S 2.1耗时62分钟,具备自我纠正能力并通过测试,而之前的Qwen模型耗时数小时且需要人类帮助;突出展示了oracle纪律和原生测试框架的优势。
我用Go构建了一个AI代理运行时,在交付前编译并测试生成的代码,35个文件,156个测试,零依赖
ARK是一个开源的Go运行时,它管理AI代理的决策,在交付前编译和测试生成的代码,具有6阶段验证管道和成本高效的模型路由。
@nikunj: 老兄,/goal 就是 AGI,如果有合适的工具的话…… 你说什么?你遍历了整个包含两千多个条目的数据库……
一位用户描述了一个AI代理,它自主修复了数据库中的产品图片、前端错误和描述,使用了浏览器自动化和网络搜索,并在用户与创始人会面的两小时内运行,突显了令人印象深刻的类似AGI的能力。
@DanKornas: 大多数智能体系统能在单次会话中完成令人印象深刻的工作。难点在于让它们长期记住、反思并持续改进……
GENesis-AGI 是一个开源认知架构,它扩展了 Claude Code,通过分层记忆、自我学习及真实世界通道,用于构建长期运行的个人AI智能体系统。