@tunguz:这是一个重要原因。非LLM推理任务的时间只会增加。然而,工具…
摘要
一篇文章指出,现代自主编码中42%的时间用于基于CPU的工具使用,效率低下,这为重新设计面向AI代理的工具提供了巨大机遇。
查看缓存全文
缓存时间: 2026/05/24 00:13
以下是一个重要原因。非LLM推理任务所耗费的时间只会不断增加。然而,这些AI系统所使用的工具非常低效,且是从头为CPU和人类使用场景构建的。这其中存在一个巨大的、未被开发的机遇:从一开始就以AI智能体为核心,大幅改进这些流程。
SemiAnalysis (@SemiAnalysis_): 事实警报🚨:在现代智能体编程中,42%的时间花费在CPU上,用于工具使用,例如编辑文件、运行Bash脚本、运行代码检查等。传统云计算经济的计费方式是按每CPU核心收费。而在智能体经济中,商业模式是按……
相似文章
LLMs 与表演式生产力
一位开发者反思使用 AI 代理的经历,并质疑表面上的生产力提升是真实的还是仅仅是表演性的,指出虽然任务完成得更快,但深层理解和真正价值可能会丢失。
LLM代理已经知道何时调用工具——甚至无需推理
本文介绍了When2Tool,一个研究LLM代理实际何时需要调用工具的基准,并揭示模型已从隐藏状态知道工具的必要性但未能采取行动。提出的Probe&Prefill方法将不必要的工具调用减少了48%,且精度损失极小。
@bibryam: 我作为高级工程师在2026年如何使用LLMs https://seangoedecke.com/how-i-use-llms-in-2026… 最大的AI工作流变化…
一位高级工程师描述了到2026年LLM代理如何演变成编码、调试和代码库研究的可靠协作者,而人类仍负责判断和审查。
超越LLM:为何可扩展的企业AI落地依赖于Agent逻辑
IBM Research探索了Agent逻辑——诸如知识图谱和程序分析等软件原语——如何引导基于LLM的Agent高效处理复杂的企业工作流,减少幻觉和成本,同时改善结果。
低延迟系统中工具制作与自进化LLM代理
本文提出了一种方法,将重复的标准操作流程步骤编译为经过验证、有版本管理的工具,在部署前完成,替代推理时的代码生成。在一个配送中心的报警分类系统中,该方法将p50延迟降低了42%,端到端错误率降低了最多53%。