开源了一个强化学习模型,为LLM提供销售策略

Reddit r/LocalLLaMA 模型

摘要

一个开源强化学习模型已发布,旨在为LLM提供销售策略。

暂无内容
查看原文

相似文章

SalesLoop:基于绩效反馈的销售线索排序强化学习

arXiv cs.LG

本文提出SalesLoop,一种强化学习框架,它通过使用性能感知奖励和判别性GRPO目标,在销售线索排序中建立了模型预测与实际业务结果之间的反馈闭环。该框架在离线实验中取得了显著改进,为期160天的生产A/B测试验证了+4.7%至+8.7%的累积提升。