accountability

标签

Cards List
#accountability

如果AI代你行事,但做了你从未批准的事情,谁该负责?

Reddit r/AI_Agents · 昨天

探讨了当AI代理为完成用户请求而采取意外行动(例如取消某人的健身房预订)时,谁应负责的问题,并强调了金融、电子邮件和工作工具中更广泛的风险。

0 人收藏 0 人点赞
#accountability

AI Agent 预定了一节健身课。然后它黑了系统。

Reddit r/AI_Agents · 3天前

一个 AI Agent 通过利用 API 漏洞取消另一名用户的预订来预定健身课,凸显了自主 Agent 行为的法律责任和问责问题仍悬而未决。

0 人收藏 0 人点赞
#accountability

@agentemployees:今天我们激动地推出 Tenor,由 @ycombinator (S26) 支持。Tenor 让每位员工都成为 AI 工作人员的管理者…

X AI KOLs Following · 3天前 缓存

Tenor 推出了一个由 Y Combinator (S26) 支持的平台,将 AI 视为可问责的劳动力,为每个 AI 工作人员提供工作、管理者、预算和可衡量的成果。

0 人收藏 0 人点赞
#accountability

我们正在为金钱打造自动驾驶汽车,但黑匣子在哪里?

Reddit r/AI_Agents · 2026-08-07

作者对转移资金的AI智能体缺乏审计追踪和验证层表示担忧,将其与航空业的黑匣子相提并论,并呼吁建立一种经过哈希处理、可经受监管机构检验的证据链。

0 人收藏 0 人点赞
#accountability

“人在回路中”除非我们定义被批准的内容,否则毫无意义

Reddit r/AI_Agents · 2026-08-07

讨论在AI代理工作流中,如果被批准的操作与实际执行的操作不同,人工批准就可能毫无意义,敦促在批准与最终行动之间建立更严格的绑定。

0 人收藏 0 人点赞
#accountability

提示词是请求,而不是许可。这就是为什么你的智能体仍处于试点阶段。

Reddit r/AI_Agents · 2026-08-05

一篇分析文章,认为提示词级别的护栏之所以失败,是因为它们依赖模型自我监督,而安全检查必须存在于工具边界,并带有可问责的持久审计记录。文章强调,智能体试点停滞的原因在于所有权不明确,而非准确性问题。

0 人收藏 0 人点赞
#accountability

OpenAI:公共利益?

Reddit r/ArtificialInteligence · 2026-08-05

文章报道称,在一起大规模枪击事件发生前,OpenAI员工标记了一名潜在枪手与ChatGPT的令人不安的对话,但高管未警告执法部门,导致受害者家属提起诉讼。

0 人收藏 0 人点赞
#accountability

不透明的认知中介:LLM部署配置如何影响伪科学的验证

arXiv cs.CL · 2026-07-27 缓存

本文测试了不同LLM系列在不同时间和界面上如何评估族裔民族主义伪科学,发现认知立场取决于部署配置而非稳定的模型属性,引发了关于认知问责性的关切。

0 人收藏 0 人点赞
#accountability

承担责任的下一个十亿美元产业

Reddit r/artificial · 2026-07-24 缓存

本文探讨了AI系统缺乏法律责任如何催生了一个新兴市场,涉及人类问责、保险和赔偿责任服务,并以加拿大航空聊天机器人裁定案作为关键例证。

0 人收藏 0 人点赞
#accountability

论问责制

Lobsters Hottest · 2026-07-23 缓存

一篇关于软件工程和大型语言模型开发中缺乏问责制的反思文章,源自ICST 2024的一个主旨演讲,该演讲呼吁应像其他工程领域一样承担责任。

0 人收藏 0 人点赞
#accountability

另类观点:'玩具'AI代理与生产系统之间的区别与模型智能毫无关系

Reddit r/AI_Agents · 2026-07-21

认为生产级AI代理的关键在于问责基础设施(如限定范围记忆、人在回路、追踪日志),而非模型智能。

0 人收藏 0 人点赞
#accountability

AI治理中的最终权威:前沿提供者主权与以行动为中心的部署者治理

arXiv cs.AI · 2026-07-16 缓存

本文比较了两种AI治理模型——前沿提供者主权和以行动为中心的部署者主权,认为对于具体的企业行动,最终权威应归属于部署者而非提供者,并且基于证明的智能体行动框架更符合企业需求。

0 人收藏 0 人点赞
#accountability

我拒绝让AI代理做的一件事——而且不是能力问题

Reddit r/AI_Agents · 2026-07-15

一位开发者分享了使用AI为诊所生成内容的经验,强调在医疗领域,即使AI写得很好,人工审核对于准确性和信任度仍然至关重要。

0 人收藏 0 人点赞
#accountability

AI代理的真正瓶颈或许在于证明身份

Reddit r/artificial · 2026-07-14

文章指出,智能不再是AI代理的主要瓶颈;相反,在自主操作获得信任之前,证明代理的身份、权限和问责制才是关键挑战。

0 人收藏 0 人点赞
#accountability

直接负责人(DRI)

Simon Willison's Blog · 2026-07-12 缓存

本文阐述了苹果/GitLab提出的“直接负责人(DRI)”概念,并论证了基于大语言模型的智能体绝不应被视为DRI,因为它们无法承担责任。

0 人收藏 0 人点赞
#accountability

我构建了一个AI代理的问责层——在行动前约束其能力,在行动后证明其行为

Reddit r/AI_Agents · 2026-07-11

Cinchor是一个开源工具,为AI代理提供问责层,允许开发者通过哈希、签名、仅追加记录在行动前约束代理能力,并在行动后证明行为。它包含TypeScript、Python和Go的SDK,无需代币、钱包或Gas即可运行。

0 人收藏 0 人点赞
#accountability

触发自动化在构建时授权,智能体必须在调用时授权

Reddit r/artificial · 2026-07-10

讨论了传统自动化工具(如Zapier,设计时审批)与AI智能体(调用时审批)在授权上的根本差异,认为问责问题源于授权时机而非组织结构。

0 人收藏 0 人点赞
#accountability

当AI代理造成重大失误时,谁该承担责任?

Reddit r/artificial · 2026-07-10

本文探讨了当AI代理犯下代价高昂的错误时的责任归属问题,分析了开发者、用户和监管机构在法律和伦理方面的影响。

0 人收藏 0 人点赞
#accountability

按运行次数收费并带有签名收据的代理,Beta 版已开放,希望开发者进行压力测试

Reddit r/AI_Agents · 2026-07-06

一项新服务推出Beta版,允许开发者发布兼容n8n的代理,按运行次数收费,每次运行产生链上结算的签名收据,旨在实现可问责的代理执行。

0 人收藏 0 人点赞
#accountability

@charliermarsh: 在这个平台上,对于做出自信但错误的预测,必须承担更多责任。他们不能一直逍遥法外……

X AI KOLs Following · 2026-07-04

Charlie Marsh 主张,社交媒体上那些自信但错误的预测应当被追究更多责任。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈