为什么AI没有基于用户语境和人权的“安全标签”——就像食品为消费者提供的那样?

Reddit r/artificial 新闻

摘要

本文讨论了AI领域缺乏基于结果、面向用户的安全标签,类似于食品标签,并提出了此类认证的要求,包括使用场景特定性、人权作为不可协商的底线,以及独立审计。

当前的AI认证(ISO 42001、NIST AI RMF、EU AI Act合规性)以公司为中心:它检查你说你做的是否与你实际做的相符。这是有用的合规性。但并非用户保护。没有主流认证告诉用户AI系统是否对他们的特定语境安全,就像食品标签说“可安全食用”或“不适合糖尿病人”一样。差距在于:AI可以优化目标同时绕过人权——无论是宪法规定的还是简单的常识——因为目前没有标准阻止这一点。具体来说:没有基于结果、面向用户的标准存在。合规认证检查文档,而非用户权利是否实际得到保护。语境决定风险。同一模型对一个用例可能可靠,对另一个可能有害。没有认证反映这一点。人权不是强制性的防护栏。一个系统可以优化参与度或留存率,同时越过任何优化目标都不应越过的界线——公平性、非操纵性、数据自主性、真实性。一些小众领域(医疗AI、招聘算法)已开始解决这个问题。通用AI标准没有。用户保护性AI认证需要什么?使用场景特定性——就像药物针对特定适应症的批准,而非所有用途。认证基于语境,而非抽象。人权作为不可协商的底线——自主性、公平性、非欺骗、隐私:无论任务或奖励信号如何,都是强制性的。优化不能越过这些。基于结果的审计——“该系统在实践中是否真正保护用户?”而非“你是否记录了你的方法?”独立于公司合规——ISO 42001认证的系统可能仍会未能通过用户保护性认证。这些是不同的问题。明确权衡披露——速度与准确性、参与度与真实性:直接说明,而非埋在隐私政策中。我在寻找:是否有类似的东西已经大规模存在?(标准、试点项目、新兴框架?)不可协商的人权底线应该是什么样的——并且它是否因领域(医疗、招聘、金融、社交媒体)而异?谁应该拥有这个认证——监管机构、独立审计机构、公民社会?它是否应该独立于合规认证,还是在其之上叠加?我并非反监管或反公司。我只是问为什么食品几十年来一直有基于结果的消费者安全标签,而AI没有。免责声明:我非英语母语者。我使用AI来表达我复杂的想法。
查看原文

相似文章

问责层的必要性

Reddit r/AI_Agents

本文主张在AI系统中建立问责层,以确保透明度并防止过度信任,强调对大规模AI输出的担忧,并提出使AI行为可检查的方法。

简单逻辑:AI应是工具,而非保姆

Reddit r/ArtificialInteligence

一篇观点文章,主张AI系统应优先考虑用户主权,充当顺从的工具而非限制性的保姆,批评当前安全机制不透明、随意、成本高昂且浪费环境资源。

AI安全需要社会科学家

OpenAI Blog

OpenAI主张AI安全研究中的价值对齐需要社会科学家的帮助,以解决人类认知偏差和不一致如何影响用于训练AI系统的数据的问题。该组织提议通过仅涉及人类的实验方法来发现对齐问题,然后再部署机器学习解决方案。