控制问题:为什么我们需要在AI中构建互联的人类治理知识层
摘要
文章认为,AI的真正瓶颈不是能力,而是上下文层缺乏透明度和控制,并警告说,不透明的AI系统可能会削弱人类的主观能动性和决策能力。
人们非常关注让AI模型变得更大、更快、能力更强。我的意思是,是的,这确实提升了它们的能力。但随着时间的推移,我越来越觉得能力不是瓶颈。真正的问题在于上下文层。目前,你并不清楚模型如何解释你提供的内容,它保留了哪些信息,舍弃了哪些,或者如何将不同的内容联系起来。这些过程大部分是隐藏的。你可以稍微调整它,但你仍然在一个你无法控制的环境中操作。而且,随着这些系统在表达的连贯性上越来越好,人们更容易忽视这种有缺陷的设计。如果这最终成为人们思考问题、学习知识、做出决策的方式,那么未来的系统将是这样:其逻辑在上游且对我们不可见,导致我们生活中的选择和自主权减少。更糟糕的是,我们将生活在一个不得不接受真理而非自己去发现、学习和验证观点可信度的现实中。AI确实很出色,但我们在主流AI产品中看到的这种趋势会削弱人类的能力,而不是帮助我们变得更强。我在这里写了一篇更详细的文章,如果你对这些影响以及我们如何主动构建一个两全其美的方案感到好奇。未来看起来很光明,但前提是我们能看到可以构建什么。
相似文章
问责层的必要性
本文主张在AI系统中建立问责层,以确保透明度并防止过度信任,强调对大规模AI输出的担忧,并提出使AI行为可检查的方法。
AI是否正在成为由少数私人个体控制的认知基础设施?
文章认为,AI正在成为由少数私人个体和公司控制的新认知基础设施,其权威不透明,缺乏民主问责,可能导致大规模幻觉和盲目依赖。
信任-监督悖论:随着AI变得更好,人类可能不再真正监督它
一篇思想文章,指出随着AI变得更准确,人类监督可能会退化为例行批准,从而产生'信任-监督悖论',即高性能AI仍可能因不完整的表征、过时数据或自动化偏见而失败,建议从人工审查转向治理边界。
我们为何构建
一篇观点文章,提倡构建能够从领域专家处提供透明、可验证知识的AI系统,从而实现基于发现的学习,并抵制集中式宣传。
我认为“人在回路中”可能成为企业AI最大的治理幻觉之一
本文认为,依赖'人在回路中'作为治理策略是有缺陷的,因为AI系统现在决定何时升级,形成了一种自我报告的依赖。文章建议转向'人类主导的自主性',即由人类定义边界并审计表征质量。