RiskKernel — 自托管护栏 + AI代理紧急关闭开关(你的密钥,无遥测,Apache-2.0,单一Go二进制文件)
摘要
RiskKernel 是一个自托管的单一Go二进制文件,为AI代理强制执行严格的每次运行预算(成本、循环次数、实际时间)、紧急关闭开关和人工审批门,支持Anthropic和OpenAI提供商,且无遥测。
如果你自托管任何与LLM交互的内容,最可怕的风险就是代理循环运行,悄悄烧钱(或触发副作用的工具),没有上限也没有紧急关闭开关。RiskKernel 是一个约20MB静态Go二进制文件,你可以自行运行,它强制执行严格的每次运行预算——成本、循环次数、实际时间——外加紧急关闭开关、崩溃恢复以及对副作用工具的人工审批门。一切都是确定性Go语言实现;LLM绝不会在强制执行路径中。端到端自托管理念:自带提供商密钥(从不存储在状态中,从不记录日志),无遥测/无回传(可验证——出站流量仅流向你的提供商、你的OTLP端点和你的审批webhook;请参阅SECURITY.md),你的状态由自己拥有的SQLite文件保存。部署只需在现有OpenAI兼容应用前设置一个环境变量。诚实限制:单实例+SQLite(尚无高可用性),单一API令牌(可用oauth2-proxy/Authelia做前置认证),暂不支持流式处理。当前原生提供商为Anthropic和OpenAI。Apache-2.0许可,提供docker run快速入门和README中的演示GIF——欢迎反馈。开源 自托管 AI代理 LLMOps OpenTelemetry 可观测性 Go语言
相似文章
DreamGuard:基于风险感知世界模型的高效LLM智能体运行时护栏
DreamGuard是一种面向LLM智能体的主动式运行时护栏,利用风险感知世界模型跟踪潜在状态并预测未来风险,从而在不安全动作执行前进行干预。它在基准测试和在线评估中优于基线,延迟为25毫秒。
AgentKernelArena:兼顾泛化能力的GPU内核优化代理基准测试
AgentKernelArena是一个开源基准测试,用于评估AI编码代理在GPU内核优化方面的表现,涵盖完整的代理工作流程以及跨196个任务对未见配置的泛化能力。
在公开发布AI Agent应用之前,您会添加哪些防护措施?
一位开发者反思了在公开发布AI Agent应用之前应落实的关键安全措施——例如支出上限、速率限制和备用模型——以避免隐藏成本和意外行为。
OpenGuardrails: 一个开源的上下文感知AI护栏平台
OpenGuardrails 是一个面向AI安全的开源平台,通过统一模型提供上下文感知的内容安全与操纵检测(例如提示注入、越狱),以及一个独立的NER管道用于数据泄露识别。它在安全基准测试上取得了最先进的性能,并支持私有化、企业级部署。
我们为AI智能体安全代理构建了一个公开的红队环境——提交攻击即可获得完整的安全追踪信息
Arc Gate 是一个用于LLM智能体的运行时治理层,强制执行指令-权限边界。该项目已推出公开红队环境,用户可提交攻击并获取完整安全追踪信息,基准测试显示其实现了100%的不安全行为阻止率。