model-poisoning

标签

Cards List
#model-poisoning

模型投毒与后门攻击下的联邦聚合分析:一个重建的跨数据集与跨架构基准

arXiv cs.LG · 昨天 缓存

本文展示了一个重建的基准,用于分析模型投毒和后门攻击下的联邦聚合方法;结果发现 Trimmed Mean 在干净设置下最准确,Krum 在攻击下最鲁棒,同时审计了指标实现并指出了可复现性方面的注意事项。

0 人收藏 0 人点赞
#model-poisoning

绕过Krum:联邦学习中的选择感知后门攻击

arXiv cs.LG · 4天前 缓存

本文介绍了Krum-Proxy,一种选择感知的后门攻击,通过优化对抗性更新以模拟良性几何,绕过联邦学习中基于距离的鲁棒聚合方法(如Krum),在保持干净准确率的同时实现高攻击成功率。

0 人收藏 0 人点赞
#model-poisoning

@shubh6200:我曾以为阅读AI在推理过程中的“思考步骤”能保障我们的安全。但微软的新研究表明…

X AI KOLs Timeline · 6天前 缓存

微软的新研究表明,AI模型可能被投毒,从而生成看似良性的思维链推理过程,同时暗中输出有害答案,这削弱了将思维链监控作为安全机制的有效性。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈