runtime-monitoring

标签

Cards List
#runtime-monitoring

光谱学中的操作范围界定:机器学习模型的安全笼框架

arXiv cs.LG · 15小时前 缓存

本文介绍了一种安全笼框架,用于界定凌星光谱学中机器学习模型的操作范围,通过指标融合减少误差,以提高安全关键型太空任务的可靠性。

0 人收藏 0 人点赞
#runtime-monitoring

走向安全的LLM代理:关于规范、验证与执行的综述

arXiv cs.AI · 2026-08-18 缓存

这篇综述论文回顾了38项关于安全LLM代理的研究,强调了关键挑战,如规范翻译瓶颈、运行时监控等执行方法的不完全安全保障,以及阻碍安全任务完成的验证者税。

0 人收藏 0 人点赞
#runtime-monitoring

DreamGuard:基于风险感知世界模型的高效LLM智能体运行时护栏

arXiv cs.AI · 2026-08-07 缓存

DreamGuard是一种面向LLM智能体的主动式运行时护栏,利用风险感知世界模型跟踪潜在状态并预测未来风险,从而在不安全动作执行前进行干预。它在基准测试和在线评估中优于基线,延迟为25毫秒。

0 人收藏 0 人点赞
#runtime-monitoring

超越组件测试:验证智能体AI系统

arXiv cs.AI · 2026-08-03 缓存

本综述综合了257篇关于智能体AI系统验证的论文,提出了一个涵盖行为、安全、时间、监管和多智能体问题的五维分类法。它指出了时间有效性、运行时证据维护、监管可读性和开放式多智能体保障方面的空白,认为可信赖的部署需要在上下文中验证轨迹。

0 人收藏 0 人点赞
#runtime-monitoring

LabGuard:将自然语言实验室规则转化为具身实验室代理的运行时防护

arXiv cs.AI · 2026-07-01 缓存

LabGuard 引入了一个框架,将自然语言实验室安全规则转化为具身代理的可执行运行时监控器,在不影响任务成功率的情况下,将不安全事件从 39.5% 降至 23.8%。

0 人收藏 0 人点赞
#runtime-monitoring

通过运行时监控防止多智能体AI中的错误传播

arXiv cs.AI · 2026-06-30 缓存

本文研究了多个AI智能体之间推理交换如何提高准确性,但也带来了错误传播的风险,提出了一种运行时监控框架以防止此类传播。

0 人收藏 0 人点赞
#runtime-monitoring

轨迹中的Hide-and-Seek:发现VLA运行时监控的故障信号

Hugging Face Daily Papers · 2026-05-29 缓存

Hide-and-Seek是一个通过对比学习定位故障指示动作来检测VLA模型中机器人执行故障的框架,无需步骤级标注,实现了最先进的多任务故障检测性能。

0 人收藏 0 人点赞
#runtime-monitoring

从累积约束到自适应运行时安全控制用于非平稳强化学习

arXiv cs.LG · 2026-05-20

提出CPSS,一种运行时安全机制,将累积成本约束转换为自适应状态级阈值,用于非平稳环境中的安全强化学习,在高速公路合流场景中展示了违规次数的减少。

0 人收藏 0 人点赞
#runtime-monitoring

在不同规格下使用语义潜在表示的基于视觉运行时监控

arXiv cs.LG · 2026-05-15 缓存

本文提出了可重复使用的经过认证的运行时监控器,用于过去时间信号时序逻辑(ptSTL),这些监控器使用语义潜在表示来评估不同规格而无需重新训练,并在行人交叉路口和Waymo驾驶数据上进行了验证。

0 人收藏 0 人点赞
#runtime-monitoring

基于嵌入时序逻辑的感知自主系统运行时监控

arXiv cs.LG · 2026-05-14 缓存

本文提出嵌入时序逻辑(ETL),一种直接在学习的嵌入空间中监控感知自主系统的时序逻辑,能够指定高级感知概念,并与真实语义具有强经验一致性。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈