标签
本文提出了VA-DPO,一种使用连续效价-唤醒维度在语言模型中进行可控情感生成的方法,它在不降低模型性能的前提下改进了提示技术。
本文复现了开源权重大语言模型Apertus-8B和Gemma-4-E4B中'情感向量'的发现,表明价态几何结构在不同模型间可恢复,但层间出现时机存在差异。研究还发现唤醒编码对用于提取的故事语料库敏感。