shared-budgets

标签

Cards List
#shared-budgets

R^3-Bench:大型语言模型在共享预算下的资源理性推理面临挑战

Hugging Face Daily Papers · 2天前 缓存

R^3-Bench 引入了一个基准测试,表明大型语言模型在跨数学、编程和抽象推理等多个推理任务分配共享计算预算时,难以维持性能表现。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈