stylometrics

标签

Cards List
#stylometrics

PersonalBench: 衡量大型语言模型个性化中的作者身份差距

arXiv cs.CL · 昨天 缓存

PersonalBench 是一个新的基准,通过作者身份验证、LLM-as-judge 和文体测量学来评估 LLM 中的推理时个性化方法。研究发现,虽然这些方法能产生作者区分的输出,但它们并未缩小与人类作者之间的差距。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈