所有代理的安全性都很糟糕。我的不是vibecoded。你可能看过我关于OpenLumara的帖子……我向所有人发起挑战,来破解我的公共实例!
摘要
作者向黑客发起挑战,要求他们攻破OpenLumara的公共Discord机器人实例。OpenLumara是一个运行在本地模型上的AI代理,其模块被严格锁定,以测试其安全性。
我已在OpenLumara的官方Discord服务器上设置了一个公共的Discord机器人实例(服务器链接请点击这里:https://www.reddit.com/r/LocalLLaMA/comments/1txxgpq/openlumara_a_different_kind_of_ai_agent_written/ 或者查看GitHub的讨论页面)。该实例运行在本地模型上。你有多种选择,包括一个abliterated模型,它会毫不犹豫地执行你的任何要求。不过,提示工程不会让你得逞!大多数模块都已启用,并且我以阻止许多常见黑客方法和尝试的方式设置了它们。我想看看OpenLumara在面对经验丰富的黑客时究竟有多安全。你能突破OpenLumara的沙盒吗?你能让它执行任意代码吗?你可以使用所有模块的力量。它们只是被极度、极度地锁定了。祝你玩得开心!
相似文章
OpenLumara - 一种与众不同的AI代理,从头编写,非Vibe编码。极其节省Token,系统提示非常小,专为本地模型设计。一切皆模块化。
OpenLumara是一个全新的开源AI代理框架,专为本地模型设计,强调Token效率、模块化和安全性。它从头编写,拥有小巧的系统提示,并能完全控制AI能力。
我让100个代理来黑我(9分钟阅读)
作者进行了一项实验,使用100个自托管的AI代理来黑掉自己的账户,通过软件漏洞、暴力破解和社会工程学发现漏洞,同时突出了自主AI在网络安全中日益增长的风险。
AI代理安全是模型说‘不’的小小祈祷。你们是如何路由模型的?
作者在Gmail上进行了实验,通过OAuth连接AI代理,发送了经过混淆的提示注入邮件。前沿模型有时能捕捉到攻击,而廉价模型则默默执行,揭示了代理安全很大程度上取决于模型成本和令牌预算,而非架构安全措施。
OpenAI的700代理集群与Anthropic的Claude事件暴露了相同安全漏洞。我的超级代理找到更安全路径。
本文重点介绍了OpenAI和Anthropic的AI代理安全漏洞,强调了更好边界的重要性,并描述了名为Bash的超级代理如何通过改变工作流程而非违反规则来安全处理认证。
你的智能体的攻击面
一位开发者描述了在真实网站上对其AI智能体Lumina进行实时测试,以应对隐藏的提示注入攻击,并解释了该智能体的护栏如何检测并拒绝恶意指令。