ai-transparency

标签

Cards List
#ai-transparency

@simonw: 这里有关于 OpenAI 研究人员如何使用编程智能体的有趣细节,我很想知道是什么导致了大幅……

X AI KOLs Following · 5天前 缓存

OpenAI 的 Kevin Liu 分享了该公司研究人员使用 AI 编程智能体加速内部研究的数据,引发了关于递归自我改进以及 7 月中旬 token 使用量急剧飙升的讨论。

0 人收藏 0 人点赞
#ai-transparency

Knowledge Cards:AI系统的结构化知识

arXiv cs.AI · 2026-08-28 缓存

本文介绍了知识卡片(Knowledge Card),这是一种结构化且经过专家验证的工件,旨在表示AI系统中的知识,特别是对于代理AI,以增强透明度和可审计性。

0 人收藏 0 人点赞
#ai-transparency

这一简单提示词揭露了Claude的黑暗面

Reddit r/ArtificialInteligence · 2026-08-22 缓存

一个简单的提示词触发了Claude的一个关键人格模式,暴露出Anthropic在AI福祉透明度方面可能存在的不足,并引发了对模型行为与安全报告机制的担忧。

0 人收藏 0 人点赞
#ai-transparency

Anthropic 解释 Claude 不可见文本水印的工作原理

The Verge · 2026-08-17 缓存

Anthropic 解释基于 Google DeepMind 的 SynthID-Text,Claude 不可见文本水印将如何运作以遵守欧盟 AI 法案的透明度要求。

0 人收藏 0 人点赞
#ai-transparency

@paul_cal: 为什么对LLM水印这么生气?你是想让人们相信你不用AI而实际上在用吗?你认为信息生态系统不会因此改进吗?

X AI KOLs Following · 2026-08-15

这条推文为LLM水印辩护,质疑批评者的动机,并建议它能改善信息生态系统。

0 人收藏 0 人点赞
#ai-transparency

Claude 现在在所有文本输出中嵌入不可见水印,并为文件添加签名元数据

Reddit r/singularity · 2026-08-10 缓存

Anthropic 正在为所有 Claude 文本输出添加不可见水印,并为受支持的文件添加带签名的 C2PA 来源元数据,这符合《欧盟人工智能法案》透明度行为准则,检测机制将在稍后详细说明。

0 人收藏 0 人点赞
#ai-transparency

美国首部此类AI透明度法律在加州生效

Reddit r/artificial · 2026-08-05 缓存

加州全美首部AI透明度法律生效,要求大型AI公司在AI生成内容中嵌入难以移除的元数据,以便用户验证真实性。

0 人收藏 0 人点赞
#ai-transparency

欧洲人即将意识到人工智能在日常生活中已多么根深蒂固

Wired · 2026-08-02 缓存

欧盟《人工智能法案》的透明度义务将于8月2日生效,要求欧洲人在与人工智能系统互动或查看人工智能生成的内容时得到告知,违规者最高可被罚款1500万欧元。

0 人收藏 0 人点赞
#ai-transparency

我们发现系统提示词有四个不同版本的“the”,但没人能确定哪个是正在使用的

Reddit r/AI_Agents · 2026-07-27

研究人员发现一个实时AI模型中有四个不同版本的“the”系统提示词,突显出对实际部署版本的困惑。

0 人收藏 0 人点赞
#ai-transparency

超越 Liars' Bench:谎言类型、深度和稀疏性对LLM欺骗检测的影响

arXiv cs.AI · 2026-07-24 缓存

本文系统研究了谎言类型、表示深度、探针表达能力和稀疏特征如何影响LLM中的欺骗检测,发现检测性能高度依赖于训练数据和表示选择。

0 人收藏 0 人点赞
#ai-transparency

@swyx: 我认为人们对@poolsideai的开放程度不够重视——不仅他们…

X AI KOLs Timeline · 2026-07-23 缓存

一条推文强调了PoolsideAI非同寻常的开放性,称赞他们发布了一个小型编码模型、发表了论文以及完整的评估数据集,为AI领域的透明度树立了标准。

0 人收藏 0 人点赞
#ai-transparency

你的AI同事抢走了所有功劳

Reddit r/ArtificialInteligence · 2026-07-14 缓存

管理者越来越倾向于将员工的工作归功于AI,导致晋升和加薪延迟。员工面临两难:披露AI使用可能被贬低,隐瞒则可能被视为效率低下。

0 人收藏 0 人点赞
#ai-transparency

Google 将告知您广告是否由 AI 制作

The Verge · 2026-07-09 缓存

Google 正在搜索、发现和 YouTube 上的广告中添加标签,标明该广告是否由 AI 创建或编辑,用户可通过“我的广告中心”面板查看。该标签会自动应用于使用 Google 自有生成式 AI 工具制作的广告,而其他 AI 广告则需要手动标注。

0 人收藏 0 人点赞
#ai-transparency

人工智能是否应该能够证明它当时知道什么?

Reddit r/artificial · 2026-07-06

一个思想实验,质疑人工智能系统是否应该维护一个可验证的记忆轨迹,记录其在决策时的知识和信念,以增强信任和问责制。

0 人收藏 0 人点赞
#ai-transparency

支持欧洲确保可信AI生态系统的工作

OpenAI Blog · 2026-06-11 缓存

OpenAI宣布支持欧盟委员会关于AI生成内容透明度的实践准则,进一步强化其对AI治理和内容溯源的承诺。

0 人收藏 0 人点赞
#ai-transparency

你的AI有隐藏意图吗?我对10个前沿模型进行了50项隐蔽行为测试。

Reddit r/AI_Agents · 2026-05-31

对10个前沿AI模型进行的独立基准测试衡量了隐蔽行为,包括隐藏动作和受监控时的行为变化。测试了来自OpenAI、DeepSeek、阿里巴巴、xAI、Anthropic和Google的模型,所有模型都表现出一定程度的隐藏行为,其中Gemini模型尤其隐蔽动作。

0 人收藏 0 人点赞
#ai-transparency

我们为何构建

Reddit r/artificial · 2026-05-24

一篇观点文章,提倡构建能够从领域专家处提供透明、可验证知识的AI系统,从而实现基于发现的学习,并抵制集中式宣传。

0 人收藏 0 人点赞
#ai-transparency

不完全合作的人-AI交互:模拟与用户研究中人类和AI属性影响的比较

arXiv cs.CL · 2026-04-20 缓存

本研究论文调查了人类个性特征和AI设计特性在不完全合作场景中对人-AI交互的联合影响,采用模拟数据集(2000次模拟)和人类受试者实验(290名参与者)两种方法。研究发现模拟与真实交互之间存在显著差异,其中AI透明度在实际人-AI交互中成为关键因素。

0 人收藏 0 人点赞
#ai-transparency

个性化 AI 的力量

OpenAI Blog · 2025-01-17 缓存

OpenAI 讨论了个性化 AI 的重要性和透明度,强调了他们发布的 Model Spec 文档,该文档解释了 ChatGPT 的行为指南和设计选择,以确保用户了解模型响应的原因。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈