标签
安全研究人员发现并披露了一系列漏洞,这些漏洞使得他们能够入侵 OpenAI 员工的账户,并通过一个涉及 libheif 和单点登录配置错误的攻击链访问内部代码仓库。
本文研究了五个开放权重的大型语言模型在回指消解中是否表现出对心理语言学因素的人类类似敏感性,使用惊奇度和理解准确率作为行为指标。结果显示选择性认知对齐:一些模型在回指消解中匹配了人类的话语敏感性,但对语义干扰效应的敏感性较弱或缺失。
本文探讨了话轮转换中的沉默阈值如何在人类与AI生成的话语中有所不同,采用远距观看方法分析对话模式。
本文介绍了Narrative-UFET,一种生成简短叙事以提供超细粒度实体类型识别更广泛上下文的方法,与句子级别的基线相比,它提高了长尾类型的性能。
Miles Brundage呼应了Nathan Lambert的观点,强调在AI讨论中需要独立声音,特别是关于监管俘获和对开源的攻击,并突出不依附于主要AI公司的价值。
本文观察到,在相关社区中,关于‘快速起飞’(即AI能力快速、不受控制地增长的理念)的讨论有所减少,这表明AI安全和未来主义者圈子中的话语正在发生变化。
Chris Olah 认为前沿 AI 实验室的激励机制可能与“做正确的事”相冲突,因此需要接受严格的外部道德监督,这与 Dario Amodei 近期的叙事框架存在尖锐分歧。
文章认为,“AI 只是一种工具”这句话是公司用来掩盖权力动态、重新分配风险和劳动、并削弱批评的政治策略,凸显了强制采用和追踪如何在没有集体同意的情况下创造新规范。