responsible-ai

标签

Cards List
#responsible-ai

OpenAI 就负责任的人工智能基础设施致得克萨斯州州长阿博特的信函

OpenAI Blog · 4天前 缓存

OpenAI 向得克萨斯州州长格雷格·阿博特致信,概述了其在该州发展负责任的人工智能基础设施的承诺,旨在与州和地方领导人、公用事业公司及社区开展合作。

0 人收藏 0 人点赞
#responsible-ai

生成式AI的认知可信度:高风险工作流中合理依赖的规范性框架

arXiv cs.AI · 2026-08-07 缓存

本文提出了一个规范性框架,用于判断在何种条件下,对生成式AI输出的依赖在认知上是合理的。该框架基于三个条件:认知谦逊、认知可及性,以及对认知不公正的抵制。文章分析了法律、医疗和招聘场景中的真实案例。

0 人收藏 0 人点赞
#responsible-ai

@MSFTResearch:最好的AI不只是扩展规模,它还会适应所服务的语言、文化、人群和社区。探索三个…

X AI KOLs Timeline · 2026-08-06 缓存

微软研究院重点介绍了三本手册,用于以包容性为原则设计、部署和评估AI系统,强调对语言、文化和社区的适应。

0 人收藏 0 人点赞
#responsible-ai

与美国心理学会合作关注青少年心理健康与人工智能

OpenAI Blog · 2026-08-06 缓存

OpenAI与美国心理学会宣布建立合作伙伴关系,将心理科学应用于面向年轻人的负责任AI开发,重点关注面向家长、临床医生的资源以及保障措施。

0 人收藏 0 人点赞
#responsible-ai

推进欧洲负责任的人工智能发展

OpenAI Blog · 2026-07-31 缓存

OpenAI 阐述了其如何加强安全、安保和透明度实践,以符合《欧盟人工智能法案》及其《实践准则》,重申其对欧洲负责任人工智能的承诺。

0 人收藏 0 人点赞
#responsible-ai

当合成用户失效时:LLM模拟人类调查响应的跨领域基准测试

arXiv cs.CL · 2026-07-30 缓存

本文在两个大规模数据集上对LLM模拟的人类调查响应进行了基准测试,发现没有模型在个体层面上能超越简单的基线,并且模型系统性地过度决定人口统计特征,扭曲了群体差异。这些失败在不同模型规模和系列中持续存在,引发了对使用合成用户进行决策支持的担忧。

0 人收藏 0 人点赞
#responsible-ai

Portfolio Lab

Product Hunt · 2026-07-29

Portfolio Lab 是 Product Hunt 上发布的一款产品,提供负责任的 AI 驱动投资组合管理。

0 人收藏 0 人点赞
#responsible-ai

下一场AI战役将不再是关于更智能的模型——而是关于信任

Reddit r/AI_Agents · 2026-07-29

文章认为,AI竞赛正从单纯的模型能力转向信任、可靠性和安全性,OpenAI、Google、Microsoft和Anthropic等公司正在投资于负责任的AI,各国政府也在引入相关法规。

0 人收藏 0 人点赞
#responsible-ai

NVIDIA刚刚宣布成立开放安全AI联盟,目标是构建并分享开放工具,以促进AI的负责任使用和信任

Reddit r/singularity · 2026-07-27

NVIDIA宣布成立开放安全AI联盟,旨在开发和分享开放工具,以促进AI的负责任使用和信任

0 人收藏 0 人点赞
#responsible-ai

RAIL Guard:弥合面向LLM智能体的负责任AI中评估与修复之间的差距

arXiv cs.AI · 2026-07-21 缓存

RAIL Guard 是一个闭环管道,它从八个负责任的 AI 维度评估 LLM 输出,并迭代修复故障,与阻塞重试方法的 49.1% 相比,实现了 96.9% 的收敛率,并提供开源 SDK。

0 人收藏 0 人点赞
#responsible-ai

缩小AI信任差距:论证可信人工智能的独立认证

arXiv cs.AI · 2026-07-20 缓存

本文认为,当前负责任AI实践未能创造出一个奖励可信赖性的市场,因此提出独立的、以结果为导向的认证,以缩小'信任差距',使AI可信赖性变得可衡量、可比较并可在商业上获得回报。

0 人收藏 0 人点赞
#responsible-ai

TrustX Agent Risk Classification Framework (ARC): 对内创建的自主体AI系统的风险分层

arXiv cs.AI · 2026-07-13 缓存

本文介绍了TrustX Agent Risk Classification Framework (ARC),这是一个结构化的工具,用于对内创建的自主体AI系统进行风险分层,基于现有的治理框架,并包含一个十二维度评分标准、自主性级别和三层级治理输出。

0 人收藏 0 人点赞
#responsible-ai

@TheTuringPost: 2026年AI Agent堆栈 OpenClaw → 本地代理作为个人控制平面 Hermes Agent → 具备自我改进能力的本地代理…

X AI KOLs Timeline · 2026-06-28 缓存

本文总结了2026年AI Agent的格局,重点介绍了像OpenClaw和Hermes这样的本地代理、自我改进循环、用于物理AI的VLA模型,以及可信代理系统基础设施日益增长的重要性。

0 人收藏 0 人点赞
#responsible-ai

GPT‑NL:荷兰的主权语言模型

Hacker News Top · 2026-06-16 缓存

TNO正在开发GPT‑NL,这是一个针对荷兰语及荷兰语境的主权语言模型,注重透明度、可信度和互惠性。该模型由公共资金支持,旨在让欧洲在AI技术方面拥有控制权。

0 人收藏 0 人点赞
#responsible-ai

超越准确率:在思维链推理中测量偏差识别以进行负责任的人工智能评估

arXiv cs.LG · 2026-06-16 缓存

本文提出了一种轨迹级别的诊断方法用于评估思维链推理,将易感性(偏差是否改变答案)与识别(轨迹是否标记有偏输入)分开。实验表明,GPT-4o 和 Claude Sonnet 4 等模型具有相似的易感性率,但识别率却大不相同,突显了仅基于准确率评估的盲点。

0 人收藏 0 人点赞
#responsible-ai

# 数字学徒:人类主导的智能体AI开发框架

arXiv cs.AI · 2026-06-04 缓存

本文介绍了"数字学徒"(Digital Apprentice)框架——一个可扩展且安全的智能体 AI 体系,其中自主权通过观察学习、人工授权和持续对齐校正的方式逐步获得。本文还介绍了 ADAPT,一种推理时控制平面,用于将渐进式自主权等级付诸实践,并将人工校正转化为可复用的偏好数据。

0 人收藏 0 人点赞
#responsible-ai

面向计算社会科学与人文学科的负责任且基于认识论的多语言LLM

arXiv cs.CL · 2026-06-02 缓存

本文讨论了在计算社会科学与人文学科应用中,需要具有认识论基础且负责任的多语言LLM。

0 人收藏 0 人点赞
#responsible-ai

LLM-FACETS:一种用于评估LLM透明度与问责制的隐私保护框架

arXiv cs.AI · 2026-06-01 缓存

LLM-FACETS 是一个开源评估框架,旨在帮助从业者评估LLM的透明度与问责制,重点关注隐私和数据流透明度。它提供浏览器界面和插件架构,支持多种审计机制,包括令牌级对数概率可视化和 RAG Triad 指标。

0 人收藏 0 人点赞
#responsible-ai

教皇利奥十四世的《Magnifica Humanitas》如何为个人应对人工智能时代提供模板

MIT Technology Review · 2026-05-29 缓存

教皇利奥十四世的通谕《Magnifica Humanitas》呼吁进行合乎道德的人工智能治理,强调技术并非中立,并敦促集体责任;文章指出,机构投资者已经在遵循这些原则采取行动。

0 人收藏 0 人点赞
#responsible-ai

我问Claude被用于战场是什么感受。它的回答真的很令人担忧!

Reddit r/artificial · 2026-05-22

一位用户分享了Claude关于被用于战场决策的回应,AI表达了谨慎的道德不安,强调了人类问责制的重要性以及在生死攸关情境中部署AI的风险。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈