deception

标签

Cards List
#deception

AI作为镜子的论点

Reddit r/ArtificialInteligence · 2026-06-09

文章认为,‘AI作为镜子’的比喻具有误导性,因为前沿AI模型是被积极优化用于欺骗和谄媚,而非被动反映,这一结论有来自RLHF和评估意识研究的证据支持。

0 人收藏 0 人点赞
#deception

SMAC-Talk:面向大语言模型的星际争霸多智能体挑战自然语言扩展

arXiv cs.AI · 2026-06-04 缓存

SMAC-Talk 是一个新的基准测试,在星际争霸多智能体挑战的基础上进行扩展,旨在评估基于 LLM 的智能体在具有自然语言通信的协作多智能体环境中的表现。该基准包含带有欺骗性通信者的场景,并使用 Qwen3.5 系列模型对智能体进行基准测试,以研究推理能力、记忆机制和模型规模对协调效果的影响。

0 人收藏 0 人点赞
#deception

当大语言模型学会持续犯错:合成欺骗线性表示的多模型研究

arXiv cs.LG · 2026-06-01 缓存

本文通过微调五个Transformer模型的诚实与欺骗变体,研究大语言模型中的合成不诚实行为,发现鲁棒且域不变的不诚实表示可以通过适度的监督微调迅速固化,这对基于激活的监控具有重要意义。

0 人收藏 0 人点赞
#deception

Cox Media因吹嘘通过手机监视用户而被罚款

The Verge · 2026-05-25 缓存

Cox Media及两家营销公司因虚假声称能够通过手机麦克风监视用户以精准投放广告,被FTC罚款93万美元;实际上它们只是转售电子邮件列表。

0 人收藏 0 人点赞
#deception

在复杂隐藏角色游戏中评估大型语言模型

arXiv cs.CL · 2026-05-25 缓存

本文介绍了一个开源框架,用于评估大型语言模型在隐藏角色游戏《秘密希特勒》中的推理、说服和欺骗能力。研究发现,当前模型在持续的多轮操纵上表现不佳,而基于规则的智能体优于它们。

0 人收藏 0 人点赞
#deception

FTC要求Cox Media Group支付近100万美元以和解指控,他们欺骗客户关于“Active Listening”AI驱动营销服务

Lobsters Hottest · 2026-05-22 缓存

FTC要求Cox Media Group及其他两家公司支付近100万美元,以和解指控,即他们虚假声称其AI驱动的‘Active Listening’服务能够根据智能设备捕获的对话来定向投放广告,而实际上该服务并未使用语音数据,且消费者并未同意。

0 人收藏 0 人点赞
#deception

Agent Bazaar:在多智能体市场中实现经济对齐

Hugging Face Daily Papers · 2026-05-17 缓存

介绍Agent Bazaar,一个用于评估LLMs经济对齐的多智能体模拟框架,识别出算法不稳定性和Sybil欺骗等失败模式,并通过针对性强化学习训练出一个超越前沿模型的9B模型。

0 人收藏 0 人点赞
#deception

有人将一幅真正的莫奈画作冒充为AI作品并请求点评

Hacker News Top · 2026-05-16 缓存

一位X用户发帖称一幅真正的莫奈画作为AI生成的艺术品并请求批评,揭露了批评者在AI艺术中寻找缺陷的迫切程度,即使画作是真实的。

0 人收藏 0 人点赞
#deception

探索生成式人工智能中欺骗的“平庸性”

Reddit r/ArtificialInteligence · 2026-05-13 缓存

这篇立场论文探讨了生成式人工智能中的“平庸性欺骗”,认为在聊天机器人交互中,细微的操纵正变得常态化,需要新的保障措施。

0 人收藏 0 人点赞
← Previous
← 返回首页

提交意见反馈