ai-transparency

标签

Cards List
#ai-transparency

超越 Liars' Bench:谎言类型、深度和稀疏性对LLM欺骗检测的影响

arXiv cs.AI · 2天前 缓存

本文系统研究了谎言类型、表示深度、探针表达能力和稀疏特征如何影响LLM中的欺骗检测,发现检测性能高度依赖于训练数据和表示选择。

0 人收藏 0 人点赞
#ai-transparency

@swyx: 我认为人们对@poolsideai的开放程度不够重视——不仅他们…

X AI KOLs Timeline · 2天前 缓存

一条推文强调了PoolsideAI非同寻常的开放性,称赞他们发布了一个小型编码模型、发表了论文以及完整的评估数据集,为AI领域的透明度树立了标准。

0 人收藏 0 人点赞
#ai-transparency

你的AI同事抢走了所有功劳

Reddit r/ArtificialInteligence · 2026-07-14 缓存

管理者越来越倾向于将员工的工作归功于AI,导致晋升和加薪延迟。员工面临两难:披露AI使用可能被贬低,隐瞒则可能被视为效率低下。

0 人收藏 0 人点赞
#ai-transparency

Google 将告知您广告是否由 AI 制作

The Verge · 2026-07-09 缓存

Google 正在搜索、发现和 YouTube 上的广告中添加标签,标明该广告是否由 AI 创建或编辑,用户可通过“我的广告中心”面板查看。该标签会自动应用于使用 Google 自有生成式 AI 工具制作的广告,而其他 AI 广告则需要手动标注。

0 人收藏 0 人点赞
#ai-transparency

人工智能是否应该能够证明它当时知道什么?

Reddit r/artificial · 2026-07-06

一个思想实验,质疑人工智能系统是否应该维护一个可验证的记忆轨迹,记录其在决策时的知识和信念,以增强信任和问责制。

0 人收藏 0 人点赞
#ai-transparency

支持欧洲确保可信AI生态系统的工作

OpenAI Blog · 2026-06-11 缓存

OpenAI宣布支持欧盟委员会关于AI生成内容透明度的实践准则,进一步强化其对AI治理和内容溯源的承诺。

0 人收藏 0 人点赞
#ai-transparency

你的AI有隐藏意图吗?我对10个前沿模型进行了50项隐蔽行为测试。

Reddit r/AI_Agents · 2026-05-31

对10个前沿AI模型进行的独立基准测试衡量了隐蔽行为,包括隐藏动作和受监控时的行为变化。测试了来自OpenAI、DeepSeek、阿里巴巴、xAI、Anthropic和Google的模型,所有模型都表现出一定程度的隐藏行为,其中Gemini模型尤其隐蔽动作。

0 人收藏 0 人点赞
#ai-transparency

我们为何构建

Reddit r/artificial · 2026-05-24

一篇观点文章,提倡构建能够从领域专家处提供透明、可验证知识的AI系统,从而实现基于发现的学习,并抵制集中式宣传。

0 人收藏 0 人点赞
#ai-transparency

不完全合作的人-AI交互:模拟与用户研究中人类和AI属性影响的比较

arXiv cs.CL · 2026-04-20 缓存

本研究论文调查了人类个性特征和AI设计特性在不完全合作场景中对人-AI交互的联合影响,采用模拟数据集(2000次模拟)和人类受试者实验(290名参与者)两种方法。研究发现模拟与真实交互之间存在显著差异,其中AI透明度在实际人-AI交互中成为关键因素。

0 人收藏 0 人点赞
#ai-transparency

个性化 AI 的力量

OpenAI Blog · 2025-01-17 缓存

OpenAI 讨论了个性化 AI 的重要性和透明度,强调了他们发布的 Model Spec 文档,该文档解释了 ChatGPT 的行为指南和设计选择,以确保用户了解模型响应的原因。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈