token-budget-contracts v0.3.0 — LangGraph/CrewAI 适配器 + OpenTelemetry 实现多智能体令牌治理
摘要
token-budget-contracts 是一个用于管理多智能体系统令牌消耗的库。0.3.0 版本新增了对 LangGraph 和 CrewAI 的原生适配器,并集成了 OpenTelemetry 以监控预算活动。
之前在这里发过关于 token-budget-contracts 的帖子,这是我用来管理多智能体系统令牌消耗的库。核心理念:每个智能体都有一个优先级和预算,当某个智能体在任务中途耗尽令牌时,空闲或优先级较低的智能体会重新分配多余的令牌,而不是整个任务失败。此外,还有置信度门控机制,一旦智能体对答案有足够信心,就会停止消耗令牌。上次最常见的问题是“这真的能接入我的框架吗?”所以 v0.3.0 主要就是解决这个:原生 LangGraph 适配器——节点只是接收状态并返回更新的可调用对象,因此可以直接包装:python: from tbcontracts.adapters import TBCGraphGovernor gov = TBCGraphGovernor() gov.register("researcher", priority=3, max_tokens=4000) gov.register("critic", priority=1, max_tokens=2000) graph.add_node("researcher", gov.wrap("researcher", researcher_node, usage_key="tokens_used")) graph.add_node("critic", gov.wrap("critic", critic_node, usage_key="tokens_used")) 原生 CrewAI 适配器——在稳定的边界(运行智能体任务的可调用对象)进行治理,通过你传入的 usage_fn 读取精确使用量。OpenTelemetry 集成——每次治理决策都会生成一个 tbc.* span(重新分配、门控阻塞、使用量记录),包含涉及智能体和令牌移动的属性。在 Grafana/Datadog/Honeycomb 中与现有智能体追踪一起监控预算活动。可选加入,无硬依赖。精确核算——使用来自提供商 API 响应的实际令牌数量,而非估算。pip install token-budget-contracts 仍处于早期阶段,正在积极开发中。适配器已经针对框架调用契约进行了单元测试,但我特别希望从那些在真实 LangGraph 或 CrewAI 图中运行的人那里获得反馈——想知道 usage_key/usage_fn 方法是否符合你们实际追踪令牌的方式,或者是否感觉别扭。欢迎提交问题和 PR。
相似文章
令牌预算:63起LLM智能体预算超支事件的实证目录,以及基于仿射类型Rust缓解方案的案例研究
本文呈现了来自21个编排框架的63起经确认的LLM智能体预算超支事件的实证目录,按故障分类法组织,并介绍了一个使用仿射类型所有权的Rust crate,在编译时而非运行时防止令牌/成本预算违规。
你在生产环境中如何对多个AI智能体处理Token预算?
关于在生产环境中部署多个AI智能体时管理Token预算策略的讨论,涵盖成本与效率考虑。
TokenArch Lanterns - 探索自主代理标准
TokenArch Lanterns 是一个用于探索和开发自主代理标准的框架。
@levie: 大型企业中出现的一个普遍趋势是,token 预算成为一个重要议题。随着代理能够执行越来越多耗时较长的任务……
本文探讨了企业中 token 预算这一新兴趋势,强调随着 AI 代理消耗大量计算资源,需要新的管理工具。文章指出,这将创造出一个初创企业机会,即提供软件解决方案以对代理式支出进行可视化和控制。
子代理在长代理运行中占据大部分Token成本:实际可将使用量降低70%至90%的修复方法
本文分析了 Bai 等人 2026 年的论文,该论文表明,子代理和上下文膨胀导致长代理运行中的Token成本比普通聊天高出约1000倍,并提出了三种实用的修复方法(PLAN.md、读取预算、带外备注),可将Token使用量减少70-90%。