智能体谈判中的行为隐私泄露:通过随机策略形式化并缓解推理攻击

Hugging Face Daily Papers 论文

摘要

本文形式化了多轮智能体谈判中的行为隐私泄露问题,并提出了一种自适应随机策略,该策略在提供差分隐私保证的同时,保持较高的谈判效用。

自主谈判智能体越来越多地部署在保险和采购等高风险场景中。虽然加密技术可以保护明确披露的约束值,但无法应对一种更微妙的威胁:行为隐私泄露,即对手从可观察的谈判动态(如让步轨迹、时间节奏和收敛模式)中推断出私有约束。本文研究了多轮谈判协议中的行为差分隐私。我们设计了一种自适应随机谈判策略,该策略同时保证 (varepsilon, δ)-差分隐私、报价序列的几乎必然收敛(当对手的保留价值允许时达成协议)以及高谈判效用。在3000次合成双边谈判上的评估表明,我们的机制将对抗推理准确率降低了43-50%,同时保持了超过90%的谈判成功率和效用,证明可以在不显著损失性能的情况下实现强隐私保证。
查看原文
查看缓存全文

缓存时间: 2026/07/20 17:26

论文页面 - 主体谈判中的行为隐私泄露:通过随机策略形式化与缓解推断攻击

来源:https://huggingface.co/papers/2607.06815

摘要

自主谈判智能体越来越多地部署在保险和采购等高风险场景中。虽然密码学技术可以保护明确披露的约束值,但它们无法应对一种更隐蔽的威胁:行为隐私泄露——对手通过可观察的谈判动态(如让步轨迹、时机和收敛模式)推断出私有约束。本文研究了多轮谈判协议中的行为差分隐私。我们设计了一种自适应随机谈判策略,该策略同时保证 ((ε, δ))-差分隐私、报价序列的几乎必然收敛(当对手的保留价值允许时达成协议)以及高谈判效用。在 3,000 个合成双边谈判上的评估表明,我们的机制将对抗推断准确率降低了 43-50%,同时将谈判成功率和效用维持在 90% 以上,证明了在不显著损失性能的情况下可以实现强大的隐私保障。

查看 arXiv 页面 (https://arxiv.org/abs/2607.06815) 查看 PDF (https://arxiv.org/pdf/2607.06815) 添加到收藏 (https://huggingface.co/login?next=%2Fpapers%2F2607.06815)

在你的代理中获取本文:

hf papers read 2607.06815

没有最新的 CLI?curl -LsSf https://hf.co/cli/install.sh | bash

引用本文的模型 0

没有模型链接到本文

在模型 README.md 中引用 arxiv.org/abs/2607.06815 以从本页链接。

引用本文的数据集 0

没有数据集链接到本文

在数据集 README.md 中引用 arxiv.org/abs/2607.06815 以从本页链接。

引用本文的 Space 0

没有 Space 链接到本文

在 Space README.md 中引用 arxiv.org/abs/2607.06815 以从本页链接。

包含本文的收藏 0

没有收藏包含本文

将本文添加到收藏 (https://huggingface.co/new-collection) 以从本页链接。

相似文章

当聚合对齐产生误导:无需逐状态专家动作的策略修复审计

arXiv cs.AI

本文研究了在无法获取逐状态专家动作标签的情况下,对修复决策策略的自主AI系统的评估问题,采用了一个具有区域级诊断反馈的酒店定价模拟器。研究发现聚合对齐可能产生误导,并提议通过闭环结果而非行为距离来评估策略修复。

POLAR-Bench:用于LLM智能体中隐私-效用权衡的诊断基准

arXiv cs.AI

POLAR-Bench是一个诊断基准,通过测试LLM智能体在受到第三方模型对抗性探测时遵循隐私策略的能力,来评估隐私-效用的权衡。结果显示,前沿模型保护了超过99%的受保护属性,但较小的开源权重模型泄露了一半以上,突显了意图遵循方面的差距。

Agentic AI 的安全与隐私:重大挑战与未来方向

arXiv cs.AI

本文基于一项包含三十位国际专家的前瞻性扫描活动,提出了 Agentic AI 安全与隐私方面的关键挑战和未来研究方向。该活动识别出由于 AI 自主性和权限增加而带来的新兴风险,包括提示注入攻击和恶意应用。