@diblacksmith: 我的RLM agent可以轻松一次性处理来自CloudWatch的大约8万行服务日志,这大约相当于800万…
摘要
一位开发者的RLM agent高效处理了大约8万行CloudWatch日志,推断出服务架构并发现了一些问题,并计划很快将其开源。
查看缓存全文
缓存时间: 2026/06/15 10:58
我的RLM Agent可以轻松一次性处理大约8万行CloudWatch服务日志,相当于约800万个token。
更酷的是,在经历53步之后,它只消耗了3.2万个“活跃“token*(此时还没用完全部800万,大约只用了一半)。
这对Claude Fable 5(安息吧)来说不算什么,而且完全在有效上下文窗口内,所以它非常“上下文高效“。
它可以走得很远,我甚至不需要手把手指导它,也不用担心上下文耗尽或压缩的问题。
我的意思是,我启动了这个东西,几乎没有任何上下文,它就能仅凭日志推断出服务架构,并发现了我的团队没注意到的问题。
在这个具体案例中,它能够缩小到特定区域,并发现了几个团队没有察觉的问题(AgentCore的限流、Slack的user_not_found)。
非常实用。
我很快会将其开源发布(这是我的第一个LLM工具相关的发布!)
相似文章
@diblacksmith: [开源发布] 这是我工作中使用RLM的经历。自其发布(1月26日)以来,我就开始用它处理日常任务(编码、处理数百万token的日志,甚至自动化浏览器操作)。
作者分享了他使用RLM处理日常任务(如编码、处理数百万token的日志和浏览器自动化)的经验,并将其作为一个可通过pip安装的开源Python包发布。
因为失控的 agent 浪费几百美元 API 额度,基本上已经成为一种入门仪式了。这是我的经历。
我现在开始觉得这是一种共同经历了。我认识的所有构建 agentic AI 的人,git 历史深处都藏着同样的悄悄话:那个让 agent 无人看管跑了一整个周末的经历、周一收到的账单、试图弄清楚它到底做了什么的取证工作。我的经历是两天内花了 400 多美元。我的 agent 对着同一个研究任务换着法子自言自语了 48 小时,结果什么都没产出。感觉就像被一个非常有礼貌的 Phi
@AdamRLucek: 我对代理集群(即工作流)持乐观态度。代理正越来越多地被用于分析整理海量数据……
作者讨论了在规模化处理非结构化数据时,代理集群/工作流的使用日益增长,并指出当并行部署超过30个子代理时,可靠执行会显著下降,同时预告了一种将智能决策与可靠任务执行相结合的解决方案。
@techNmak: 你的LLM推理正在消耗50%的计算资源在已经完成的工作上。如果你正在运行RAG或多轮对话,……
LMCache是一个开源库,它使KV缓存持久化并可在请求之间共享,消除了RAG和多轮对话工作负载中的重复计算,实现了高达15倍的吞吐量提升和3-10倍的首令牌时间减少。
@bibryam: 我作为高级工程师在2026年如何使用LLMs https://seangoedecke.com/how-i-use-llms-in-2026… 最大的AI工作流变化…
一位高级工程师描述了到2026年LLM代理如何演变成编码、调试和代码库研究的可靠协作者,而人类仍负责判断和审查。