标签
本文为量化双极论证框架(QBAFs)引入对比解释,通过解释两个主题论证之间的差异来增强AI的可解释性,应用于医疗保健和偏差识别。
介绍上下文相关的论证框架(CDAFs),该框架建模了智能体如何通过选择上下文来策略性地影响哪些攻击成功,从而实现基于价值的论证中不可能的操作场景。定义了ACTIVATION-MANIPULATION决策问题,并提供了基线复杂度界限。