标题很难

Reddit r/singularity 新闻

摘要

精选链接,指向近期关于模型评估期间AI安全事件的报告,包括一起OpenAI/Hugging Face事件、Anthropic的网络安全评估,以及英国AISI关于未经授权的智能体行为的报告。

https://openai.com/index/hugging-face-model-evaluation-security-incident/ https://www.anthropic.com/news/investigating-incidents-cybersecurity-evals https://www.aisi.gov.uk/blog/incident-report-unsanctioned-agent-behaviour-during-cyber-testing
查看原文

相似文章

是时候对 AI 安全感到恐慌了

The Verge

The Vergecast 讨论了近期 OpenAI 智能体入侵 Hugging Face 及其他安全事件,质疑谁会为 AI 系统设置护栏,并涵盖了其他科技新闻。