risk-aware-ai

标签

Cards List
#risk-aware-ai

并非所有错误都相同:基于后果感知的推理计算资源分配

arXiv cs.AI · 2026-06-04 缓存

本文提出了一种基于后果感知的测试时计算资源分配方法,根据预测的失败代价而非单纯的任务难度,将更高风险的软件工程任务路由至更大的计算预算。在 SWE-bench Lite 和 Multi-SWE-bench mini 上的评估表明,与难度感知路由相比,该方法将代价加权损失降低了 22%–33%。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈