llm-personalization

标签

Cards List
#llm-personalization

Learning to Adapt Cross-Domain Preferences via Meta-LoRA for LLM Personalization

arXiv cs.AI · 20小时前 缓存

This paper introduces PAC-Bayes-regularized Meta-LoRA for cross-domain LLM personalization, enabling zero- and few-shot adaptation to user preferences while preventing overfitting under sparse evidence. Experiments on benchmarks like HiCUPID show significant improvements in cross-domain win rates and cold-start scenarios.

0 人收藏 0 人点赞
#llm-personalization

个性化幻象:LLM如何虚构用户画像,以及为何自我监控具有误导性

Hugging Face Daily Papers · 2026-08-05 缓存

本文介绍了MirageBench,这是一个基准测试,表明具有持久记忆的LLM有35%至49%的时间通过过度推断虚构用户画像,并揭示模型自报的置信度与实际过度推断呈负相关,使得自我监控在比较模型时不可靠。

0 人收藏 0 人点赞
#llm-personalization

Know It, Act on It: Investigating Memory Utilization in LLM Personalization

arXiv cs.CL · 2026-08-03 缓存

This paper introduces a decoupled evaluation paradigm to separate memory recall from actual utilization in LLM personalization, finding that agents often recall user preferences but fail to act on them in behavioral scenarios. Large-scale experiments across 16 systems and five memory architectures reveal a significant Know-Act gap, especially for health-related preferences.

0 人收藏 0 人点赞
#llm-personalization

守护天使:LLM个性化提升生产力与安全

Hacker News Top · 2026-07-14 缓存

本文提出'守护天使'概念,即高度个性化的LLM,能够模仿用户的价值观和偏好,以提高生产力并防范先进AI威胁,采用动态评估和主动学习等技术。

0 人收藏 0 人点赞
#llm-personalization

在LLM个性化中重新聚焦人类

arXiv cs.CL · 2026-06-08 缓存

本文研究了在评估LLM个性化的三个阶段(属性提取、相关性匹配和响应生成)中,合成数据与人类数据之间的差距。结果表明,模型在真实人类数据上表现更差,作者引入了轻量级训练干预措施以改善对齐。

0 人收藏 0 人点赞
#llm-personalization

在LLM个性化中重新以人类为中心

Hugging Face Daily Papers · 2026-06-04 缓存

本文通过将真实人类重新引入评估循环,研究LLM个性化的有效性,揭示了在个性化管道的每个阶段人类判断与LLM输出之间的系统性差距,并强调了合成数据和LLM评判的局限性。

0 人收藏 0 人点赞
#llm-personalization

在对话前了解你:面向多轮对话中LLM个性化的用户状态建模

arXiv cs.CL · 2026-05-26 缓存

本文提出PUMA,一个用于多轮对话中LLM个性化的框架,该框架建模潜在用户状态,并利用自由能原理选择对话行为,在医疗咨询基准测试中提升了长程对话效果。

0 人收藏 0 人点赞
#llm-personalization

测试时个性化:针对缩放失败的一种诊断框架与概率修正方法

arXiv cs.LG · 2026-05-13 缓存

本文提出了测试时个性化(TTP),这是一种通过候选采样和基于奖励的选择来扩展推理时计算,从而提升大语言模型(LLM)个性化能力的框架。该研究诊断了标准奖励模型中的失效模式,并提出了一种概率个性化奖励模型以缓解这些问题。

0 人收藏 0 人点赞
#llm-personalization

超越静态人格:大型语言模型的情境人格引导

arXiv cs.CL · 2026-04-20 缓存

本文介绍了IRiS,一种无需训练的情境人格引导框架,它通过识别和利用情境依赖的人格神经元,超越了静态人格建模。该方法表明,大型语言模型的行为随情境变化,并提出了基于神经元的识别、检索和加权引导方法,在PersonalityBench和新增的SPBench基准上得到验证。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈