@tunguz:这是一个重要原因。非LLM推理任务的时间只会增加。然而,工具…

X AI KOLs Following 新闻

摘要

一篇文章指出,现代自主编码中42%的时间用于基于CPU的工具使用,效率低下,这为重新设计面向AI代理的工具提供了巨大机遇。

这是一个重要原因。非LLM推理任务的时间只会增加。然而,这些AI系统使用的工具*非常*低效,并且是从头开始为CPU和人类使用而构建的。那里有一个巨大的未开发机会,可以以AI代理为出发点,从底层显著改进这些流程。
查看原文
查看缓存全文

缓存时间: 2026/05/24 00:13

以下是一个重要原因。非LLM推理任务所耗费的时间只会不断增加。然而,这些AI系统所使用的工具非常低效,且是从头为CPU和人类使用场景构建的。这其中存在一个巨大的、未被开发的机遇:从一开始就以AI智能体为核心,大幅改进这些流程。

SemiAnalysis (@SemiAnalysis_): 事实警报🚨:在现代智能体编程中,42%的时间花费在CPU上,用于工具使用,例如编辑文件、运行Bash脚本、运行代码检查等。传统云计算经济的计费方式是按每CPU核心收费。而在智能体经济中,商业模式是按……

相似文章

LLMs 与表演式生产力

Lobsters Hottest

一位开发者反思使用 AI 代理的经历,并质疑表面上的生产力提升是真实的还是仅仅是表演性的,指出虽然任务完成得更快,但深层理解和真正价值可能会丢失。

LLM代理已经知道何时调用工具——甚至无需推理

Hugging Face Daily Papers

本文介绍了When2Tool,一个研究LLM代理实际何时需要调用工具的基准,并揭示模型已从隐藏状态知道工具的必要性但未能采取行动。提出的Probe&Prefill方法将不必要的工具调用减少了48%,且精度损失极小。

低延迟系统中工具制作与自进化LLM代理

arXiv cs.CL

本文提出了一种方法,将重复的标准操作流程步骤编译为经过验证、有版本管理的工具,在部署前完成,替代推理时的代码生成。在一个配送中心的报警分类系统中,该方法将p50延迟降低了42%,端到端错误率降低了最多53%。