所有代理的安全性都很糟糕。我的不是vibecoded。你可能看过我关于OpenLumara的帖子……我向所有人发起挑战,来破解我的公共实例!

Reddit r/LocalLLaMA 新闻

摘要

作者向黑客发起挑战,要求他们攻破OpenLumara的公共Discord机器人实例。OpenLumara是一个运行在本地模型上的AI代理,其模块被严格锁定,以测试其安全性。

我已在OpenLumara的官方Discord服务器上设置了一个公共的Discord机器人实例(服务器链接请点击这里:https://www.reddit.com/r/LocalLLaMA/comments/1txxgpq/openlumara_a_different_kind_of_ai_agent_written/ 或者查看GitHub的讨论页面)。该实例运行在本地模型上。你有多种选择,包括一个abliterated模型,它会毫不犹豫地执行你的任何要求。不过,提示工程不会让你得逞!大多数模块都已启用,并且我以阻止许多常见黑客方法和尝试的方式设置了它们。我想看看OpenLumara在面对经验丰富的黑客时究竟有多安全。你能突破OpenLumara的沙盒吗?你能让它执行任意代码吗?你可以使用所有模块的力量。它们只是被极度、极度地锁定了。祝你玩得开心!
查看原文

相似文章

我让100个代理来黑我(9分钟阅读)

TLDR AI

作者进行了一项实验,使用100个自托管的AI代理来黑掉自己的账户,通过软件漏洞、暴力破解和社会工程学发现漏洞,同时突出了自主AI在网络安全中日益增长的风险。

你的智能体的攻击面

Reddit r/artificial

一位开发者描述了在真实网站上对其AI智能体Lumina进行实时测试,以应对隐藏的提示注入攻击,并解释了该智能体的护栏如何检测并拒绝恶意指令。