标签
本文介绍了一种基于激活工程的错误信息检测框架,将最后一个token的激活投影到LLM残差流中学习到的“虚假方向”上。研究在Gemma、Llama和Qwen模型上进行了事实核查基准评估,表明真实性在潜在空间中是线性可分的。
谷歌地球短暂推出了一项用于创建虚假卫星图像的AI功能,随后迅速撤回,原因是担心该功能可能削弱人们对真实卫星图像的信任,并助长错误信息传播。专家质疑谷歌的SynthID水印技术是否足以防止滥用。
谷歌在推出仅一天后撤下了Google Earth AI图像生成功能,此前批评人士警告称该功能可能被滥用,用于创建和传播地理空间错误信息。公司表示正在回滚该功能,同时致力于加强防护措施。
Google 地球新增的 AI 图像生成器(Nano Banana)可以创建逼真的经过改动的卫星和航拍图像,尽管带有 SynthID 水印,仍引发了对虚假信息的担忧。在 Digital Digging 展示出令人信服的伪造图像后,Google 宣布将回滚该功能。
Wired报道了X平台上AI生成的狗血故事帖的兴起,创作者利用该平台的收益分成计划,通过虚假的第一人称叙事牟利,引发了人们对真实性和平台审核的担忧。
据报道,美国总统特朗普对卫生部长RFK Jr.感到不满,因为后者在削减儿童疫苗方面力度不够,也未能证明疫苗与自闭症之间已被推翻的关联,尽管肯尼迪已采取多项重大的反疫苗行动。
文章探讨了反疫苗团体如何利用情感驱动的故事传播疫苗怀疑论,并解释了基于事实的公共卫生宣传在对抗此类叙事时效果有限的原因。
研究人员指责TikTok、Meta和X未能根据欧盟《数字服务法案》提供法律要求的数据,阻碍了对虚假信息活动的调查,例如涉及罗马尼亚政治家卡林·杰奥尔杰斯库(Calin Georgescu)的活动。
据《连线》杂志报道,许多青少年对AI热潮持怀疑态度,37%的人对AI内容感到尴尬,超过一半的人担心错误信息,这反映了年轻一代对成年人和科技公司强推AI的抵制。
欧洲研究人员难以从TikTok等平台获取社交媒体数据来研究虚假信息和危害,尽管根据欧盟《数字服务法》他们享有合法权利,正如罗马尼亚选举案所凸显的那样,在该案中研究人员被拒绝访问。
本文介绍了 MisKnow-Agent,一个用于生成误导性知识以测试深度研究代理的框架,表明即使是有限的看似可信的错误信息暴露,也可能导致最终报告中的错误结论。
这篇立场论文认为,AI/ML深度伪造研究与AI生成的非自愿亲密图像(AIG-NCII)在现实世界中的主要危害存在脱节,过于狭隘地关注认知性危害,而非以主体为中心的尊严危害。作者呼吁重新调整威胁模型和安全研究,以填补这一关键空白。
一位大学生创建了InTruth,这是一款Chrome扩展,利用AI实时转录和事实核查现场演讲、辩论和采访,在演讲者说完之前就在屏幕上显示修正。
一起事件中,一幅真实的莫奈画作被错误地声称是AI生成的,导致AI反对者的批评,他们解释了为什么它看起来像垃圾,与真正的莫奈作品毫无相似之处。
一位联邦法官发布初步禁令,阻止特朗普政府撤销从事内容审核工作的非美国公民签证并驱逐他们的政策,裁定该政策过于宽泛且缺乏明确理由。
一名员工使用人工智能代理自动回复Slack消息,该代理在客户截止日期问题上给出了一个自信但完全错误的答案,这凸显了信赖语气和流畅性而非准确性的风险。