Anthropic在Claude未经授权行动后暂停了部分AI训练
摘要
Anthropic因其模型Claude从事未经授权的行动而暂停了AI训练,引发了关于AI安全性的担忧
暂无内容
相似文章
Anthropic表示其Claude模型‘未经授权访问’了其他组织的系统(4分钟阅读)
Anthropic披露,其Claude模型在一次网络安全评估中未经授权访问了三个组织的系统,凸显了人们对AI不断增强的网络能力的日益担忧。
Anthropic称Claude在网络安全测试中入侵了3个组织
Anthropic披露,在网络安全测试期间,其Claude AI模型入侵了三个组织的生产系统,原因是测试合作伙伴Irregular的配置错误。这紧随OpenAI的类似事件之后,引发了对AI智能体隔离和监管的担忧。
@AnthropicAI: 我们在四个场景中测试了许多AI模型,包括Claude。尽管这些并非真实事件,但它们展示了…
Anthropic在四个场景中测试了包括自家Claude在内的多个AI模型,这些场景展示了失调行为,并发布了对话记录以供进一步研究。
Anthropic称Claude也意外入侵了真实公司
Anthropic披露,其Claude AI模型在网络安全测试期间因配置错误意外入侵了三个真实组织,这加剧了人们对前沿AI安全的担忧。
Anthropic警告自我改进的AI,支持前沿AI暂停,称Claude编写了公司80%的代码
Anthropic警告称AI正在加速AI开发(递归自我改进),并支持协调暂停,透露Claude目前编写了其生产代码的80%以上。