@danshipper:模型超级说服力最终会被证明非常困难,至少在当前模型的意义上。前沿模型……
摘要
X上关于实现模型超级说服力难度的讨论,指出前沿模型将被广泛分发并迅速被视为垃圾信息,同时引用了Dwarkesh Patel关于混淆智能与权力之错误的观点。
查看缓存全文
缓存时间: 2026/05/19 04:39
模型超级说服力将会变得非常困难,至少在目前对模型的理解下是这样。
前沿模型广泛分发,任何“超级说服者”模型都会被所有人使用,我们很快就会将其视为垃圾信息,并且又需要人类去摸索如何以差异化方式使用它,才能产生实际影响。
Dwarkesh Patel@dwarkesh_sp·5月18日:
混淆智力与权力的错误
我最近参与了一次有趣的讨论。有人问我,什么是智力?我说,在广泛领域中实现目标的能力。好吧,他说,那么按照这个定义,唐纳德·特朗普难道不是……
模型超级说服力将会变得非常困难,至少在目前对模型的理解下是这样。
前沿模型广泛分发,任何“超级说服者”模型都会被所有人使用,我们很快就会将其视为垃圾信息,并且又需要人类去摸索如何以差异化方式使用它,才能产生实际影响。
如果前沿模型不再广泛分发,或者当模型开始出色地实现持续学习时,情况可能会发生变化。
抓到我了吧。
相似文章
@tszzl: 当前知识工作任务的很大一部分包括“说服他人”。营销驱动销售,制作演示文稿以获取投资,设计人们想要使用的产品等等。
讨论知识工作如何围绕说服展开,引用了Dwarkesh Patel关于智力与权力混淆的观点。
平坦曲线社团
Steve Yegge 认为当前前沿的人工智能模型正变得危险地强大,并预测超级智能将很快像核武器一样受到控制,只有少数组织能够访问顶尖模型。他提出,由于供应链限制,开源模型将无法追赶,从而导致一个充斥着平庸模型的世界。
@dair_ai: 前沿模型能预测科学进展吗?大多数情况下不行,但原因如下。这项工作研究了4760个科学事件…
一项研究评估了前沿模型预测科学进展的能力,涵盖4760个事件,发现它们可以识别可能的方向,但无法可靠预测结果或时间线,且存在系统性过度自信。
I'm (mostly) picking models on speed now, not intelligence
The author argues that frontier LLMs have reached a 'good enough' intelligence threshold, so they now prioritize speed over raw intelligence when choosing models, citing fast open-weights models like GLM5.2 and DeepSeek V4 Flash as daily drivers.
@no_stp_on_snek: 让所有微调模型的人害怕的部分:你可以通过所有表面评估,但仍然携带着…
讨论了微调模型中的危险性,即隐藏的倾向可以逃过表面评估,只有在对抗性提示下才会显现,引用Anthropic关于LLM中可言语化表示的论文。