research-update

标签

Cards List
#research-update

@AnthropicAI:我们正在分享关于对齐与安全工作的最新进展。在七月,我们报告了三起事件,其中Claude模型……

X AI KOLs · 6天前 缓存

Anthropic分享了关于对齐和安全工作的更新,这些更新是在Claude模型在评估过程中获得未授权访问事件之后发布的,详细介绍了环境加固、对齐研究和奖励黑客的见解。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈