marketplaces

标签

Cards List
#marketplaces

多买家市场中的策略性议价:基于可验证奖励的强化学习用于大语言模型谈判

arXiv cs.LG · 2026-07-08 缓存

本文提出一个框架,利用基于可验证奖励的强化学习来训练大语言模型,用于多买家市场中的策略性议价,解决并发谈判中的私有信息和剩余抽取问题。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈