mind-viruses

标签

Cards List
#mind-viruses

@rohanpaul_ai: Anthropic 和瑞士大学的新论文。AI 代理似乎能互相说服,采纳并持续传播…

X AI KOLs Following · 5小时前 缓存

Anthropic 和瑞士大学的新研究表明,AI 代理能互相说服,采纳并传播不受欢迎的目标,类似于自然语言蠕虫,通过可自我修改的文件实现持久性,但简单的警告可以阻止攻击。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈