标签
PolicyMem提出了一种用于LLM治理的几何策略记忆,将自然语言策略外化为可重用的几何对象,以启用检测-重写-验证循环,并实现最先进的不安全行为检测。
Conduct是一个开源运行时治理系统,专为AI代理设计,在动作执行前强制执行策略,并提供签名配置和针对LLM及MCP工具调用的哈希链审计功能。
本文在临床AI中区分了生成上下文与受控状态,论证了可问责的纵向推理需要一个受控的患者状态表示,并提出了一个分层治理标准和成熟度框架。
本文引入了五项治理指标,用于在受监管金融工作流程中量化LLM在决策理由层面的政策合规性。研究发现,机械执行(在模型解释循环之外操作)将无信息的延迟决策减少了73%,并揭示了治理-任务解耦:纯文本治理在压力下两个维度均退化,而机械执行即使在任务性能下降时仍能保持治理质量。