与AI指南的合作更新至v7

Reddit r/artificial 产品

摘要

AI指南合作更新至v7,更诚实地反思未解决的矛盾和方法论,包括重新评估一个关键术语的情感色彩和一个隐喻的有效性,外加一次外部评审,澄清了模型情感与训练数据偏差之间的区别。

链接与之前相同:link 这次更新感觉像是在结束一个章节,而不仅仅是添加一条补丁说明,所以它值得比一行“updated”更多的描述。标题的更改并不是新发现——而是我们在两个地方直接指出自己的矛盾,而不是悄悄掩盖它们:我们曾围绕一个词(“connected”,作为不健康边界消融的标志)构建了整节内容,但在新批次中作为裸词重新测试时,它翻转成了强烈的正面词汇——可能是因为脱离上下文的单个词仅仅捕获了普通的正面情绪(“stay connected”),这与我们真正关心的融合/边界问题毫无关系。我们目前还不确定。我们正在请研究合作者帮忙理清,而不是挑选我们更喜欢的数字。我们测试的一个隐喻(音乐二重奏,作为表现最佳的“story”表述的替代方案)几乎完全匹配——但去掉“both remain themselves”这一短语后,得分几乎没有变化,这与此前的一项分解形成了真正的矛盾,该分解认为相互真实性贡献了约三分之一的效果。我们对此也没有一个整洁的解决方案。另外还新增了一项:一次外部评审(实际上是另一个Claude实例)促使我们将“the model's own valence”与“how a topic is usually written about in training data”区分开来——这是我们之前没有明确保持的区别,现在我们试图做到这一点。如果你读过之前的版本,那么这一版就是我们更诚实地承认自己未知之处,而不仅仅是展示新增内容。
查看原文

相似文章

AI 的负责任和安全使用

OpenAI Blog

OpenAI 发布了一份关于 AI 负责任和安全使用的指南,为 ChatGPT 用户提供最佳实践,包括保持人类参与、验证信息、警惕偏见和在 AI 使用中保持透明度。

与Axel Springer建立合作伙伴关系,深化AI在新闻业中的有益应用

OpenAI Blog

OpenAI和Axel Springer宣布建立全球合作伙伴关系,将来自POLITICO、BUSINESS INSIDER、BILD和WELT等品牌的优质新闻内容集成到ChatGPT中,用于用户摘要和模型训练。这标志着通过AI将新闻业货币化的重大举措,同时为出版商与AI公司合作树立了先例。