hazard-analysis

标签

Cards List
#hazard-analysis

谁分析分析器?基于宪法元STPA的自我验证LLM危害分析

arXiv cs.LG ↗ · 2026-07-10 缓存

本文提出了宪法元STPA(Constitutional Meta-STPA),这是一种自我验证的LLM辅助危害分析工具,它将STPA应用于自身以推导治理原则。研究表明,一个前沿模型集成能够恢复大部分原则,并在对抗性探测上提高安全评分。

0 人收藏 0 人点赞
#hazard-analysis

代码合成大语言模型的危害分析框架

OpenAI Blog ↗ · 2022-07-25 缓存

OpenAI 提出了一套危害分析框架,用于评估 Codex 等代码合成 LLM 相关的安全风险,通过创新的代码生成能力评估方法论来审视技术、社会、政治和经济影响。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈