llm-governance

标签

Cards List
#llm-governance

PolicyMem:用于LLM治理的几何策略记忆

arXiv cs.CL ↗ · 2026-09-15 缓存

PolicyMem提出了一种用于LLM治理的几何策略记忆,将自然语言策略外化为可重用的几何对象,以启用检测-重写-验证循环,并实现最先进的不安全行为检测。

0 人收藏 0 人点赞
#llm-governance

HN展示:Conduct,针对LLM和MCP工具调用的开源防护栏

Hacker News Top ↗ · 2026-08-28 缓存

Conduct是一个开源运行时治理系统,专为AI代理设计,在动作执行前强制执行策略,并提供签名配置和针对LLM及MCP工具调用的哈希链审计功能。

0 人收藏 0 人点赞
#llm-governance

生成上下文与受控状态:可问责纵向临床推理的功能条件

arXiv cs.AI ↗ · 2026-08-18 缓存

本文在临床AI中区分了生成上下文与受控状态,论证了可问责的纵向推理需要一个受控的患者状态表示,并提出了一个分层治理标准和成熟度框架。

0 人收藏 0 人点赞
#llm-governance

LLM治理的机械执行:金融决策系统中治理-任务解耦的证据

arXiv cs.CL ↗ · 2026-05-15 缓存

本文引入了五项治理指标,用于在受监管金融工作流程中量化LLM在决策理由层面的政策合规性。研究发现,机械执行(在模型解释循环之外操作)将无信息的延迟决策减少了73%,并揭示了治理-任务解耦:纯文本治理在压力下两个维度均退化,而机械执行即使在任务性能下降时仍能保持治理质量。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈