@FinanceYF5: “AI迄今取得的所有成就不过是沧海一粟。” 超过30位研究人员,在一篇75页的论文中,划分…
摘要
一篇由超过30位研究人员撰写的75页论文,将AI自我改进分为五个等级,并综述了491篇论文,发现当前大多数进展仍停留在较低等级。
“AI迄今取得的所有成就不过是沧海一粟。” 超过30位研究人员,在一篇75页的论文中,将AI自我改进分为5个等级:等级1:由人类决定改变什么。等级5:AI重写并创建下一代AI的过程。他们综述了491篇论文,其中75%仍停留在等级1-2,不到6%达到等级5。
相似文章
@rohanpaul_ai: 自我改进的AI的真实性仅取决于其测试信号的有效性。梳理1250篇论文揭示了……
对1250篇关于AI递归自我改进的论文的分析表明,评估者信号是关键瓶颈。模型只有在强大且可信的信号(如证明检查器)下才能可靠改进,而弱信号则会导致循环崩溃或强化错误。
@FinanceYF5: 来源:
AI正在创造一类高效能个体贡献者,从10倍效率跃升至50倍效率,使得任何利用AI的人都能解锁职业优势。
当AI自我构建:我们在递归自我改进方面的进展
Anthropic研究院发布了一项关于递归自我改进进展的分析报告,显示AI已在加速AI开发——工程师每季度的代码产出提升了8倍——并预测具备完全自主自我改进能力的AI系统或将比大多数机构所预期的更早到来。
@Mnilax:谷歌和斯坦福的工程师刚刚发布了一份39页的PDF,内容是关于什么真正让AI agent自我改进的。输入→输出…
谷歌和斯坦福的工程师发布的一份39页论文分析了使AI agent通过反馈循环自我改进的关键因素,并指出只有9%的agent实际运行了真正的循环。
PaperBench:评估AI复现AI研究的能力
OpenAI推出PaperBench,一个评估AI代理复现最先进AI研究能力的基准。该基准通过复现20篇ICML 2024论文,包含8,316个可评分任务。表现最好的模型(Claude 3.5 Sonnet)仅达到21%的复现分数,低于人类博士级别的表现,凸显了当前自主研究能力的局限性。