ai-robustness

标签

Cards List
#ai-robustness

如果有人伪造你的物联网传感器数据,你的人工智能系统有办法知道被欺骗了吗?

Reddit r/AI_Agents · 2026-05-27

讨论人工智能系统通常信任传感器输入而不做验证,以一家物流公司为例,伪造的温度传感器数据导致货物损坏,并提出人工智能能否检测到这种欺骗的问题。

0 人收藏 0 人点赞
#ai-robustness

FragileFlow:通过频谱控制正确但脆弱的预测以增强基础模型的鲁棒性

arXiv cs.CL · 2026-05-12 缓存

本文介绍了 FragileFlow,这是一种插件式正则化器,通过频谱分析和 PAC-Bayes 界来控制“正确但脆弱”的预测,从而提高 LLM 和 VLM 的鲁棒性。

0 人收藏 0 人点赞
#ai-robustness

PASA:针对语义不变攻击下的大语言模型生成文本的有原则嵌入空间水印方法

Hugging Face Daily Papers · 2026-05-09 缓存

本文介绍了 PASA,这是一种针对大语言模型(LLM)生成文本的鲁棒性水印算法,它在语义层面利用潜在嵌入空间运作,以抵抗诸如改写(paraphrasing)之类的语义不变攻击。

0 人收藏 0 人点赞
#ai-robustness

最大熵如何使强化学习更加稳健

ML at Berkeley · 2021-07-26 缓存

本文解释了将香农熵纳入强化学习目标函数,如何创造出更稳健的智能体,使其能够应对奖励和动态环境中出现的意外甚至对抗性变化。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈