标签
本文介绍了一种使用Qwen3-8B的激活引导神经元干预框架,用于诱导阿尔茨海默病相关的计算语言表型,证明放大与AD相关的神经元会在多个认知领域产生分级损伤。
本文提出了一种神经元级干预方法,识别语言模型中的性别特定神经元(女性、男性、性别中立),并在保留语义的同时引导句子生成朝向目标性别形式,实验表明该方法可实现精确控制并缓解偏见。