@NatPurser: 过去一周,我收到了很多关于独立AI评估在实践中应该如何进行的询问。

X AI KOLs Timeline 新闻

摘要

这条推文讨论了为确保独立AI评估的可信度而需要最低条件,强调了超过100位专家认可的原则,以在整个行业标准化安全措施。

过去一周,我收到了很多关于独立AI评估在实践中应该如何进行的询问。 实验室和评估者之间的利益冲突怎么办?评估者真的能获得有意义的访问权限吗?如果公司只是阻止发布不利的发现怎么办? 这些都是很好且重要的问题。我们不应该假设仅靠自愿安排就能满足可信独立评估所需的条件。 所以,我非常高兴看到100多位研究人员、评估者和专家——包括我们在@AVERIorg——制定了嵌入式评估的最低条件,包括: 有意义的独立性、强大的访问权限、透明度/编辑控制权、防止报复的保护措施,以及视角和能力的多样性。 我们不应该试图将这些原则纳入临时的、一次性的协议中,政策对于在整个行业标准化这些安全措施至关重要。 很高兴看到@aievalforum在将这些原则付诸纸面方面领先。
查看原文
查看缓存全文

缓存时间: 2026/09/19 06:50

过去一周,许多人向我询问:独立的AI评估在实践中究竟应如何开展? 实验室与评估者之间存在利益冲突怎么办?评估者能否获得真正有意义的访问权限?如果企业封锁不利研究结果的发布该如何应对? 这些问题既关键又重要。我们不应认为仅凭自愿协议就能满足可信独立评估所需的条件。 因此,当看到包括我们@AVERIorg在内的100多位研究人员、评估专家和学者共同提出驻场评估的基本条件时,我倍感振奋。这些核心条件包括:实质性的独立性、充分的访问权限、透明度与编辑自主权、反报复保护机制,以及多元化的视角与专业能力。 我们不应试图通过临时性的个别协议来贯彻这些原则——行业规范化需要政策层面的系统性保障。 很高兴看到@aievalforum正致力于将这些原则落实为书面规范。

AI评估论坛 (@aievalforum): 今日,100余位顶尖AI专家共同签署了一套基本准则,以切实回应AI企业近期提出的引入外部评估者的倡议。

这些评估者必须保持真正的独立性、过程透明且涵盖多元专业领域。他们还需要获得

相似文章

缩小AI信任差距:论证可信人工智能的独立认证

arXiv cs.AI

本文认为,当前负责任AI实践未能创造出一个奖励可信赖性的市场,因此提出独立的、以结果为导向的认证,以缩小'信任差距',使AI可信赖性变得可衡量、可比较并可在商业上获得回报。