@cjziems: We're going live in 30 minutes, and we'd love to have you join Joined by @dorazhao9 and @Diyi_Yang, I'll be talking abo…
摘要
文章介绍了 Augmented Mind 播客关于《对以人为中心的大型语言模型的反思与新方向》论文的直播讨论,强调 AI 发展应从能力基准转向人类繁荣与长期福祉。
查看缓存全文
缓存时间: 2026/05/31 13:10
We’re going live in 30 minutes, and we’d love to have you join Joined by @dorazhao9 and @Diyi_Yang, I’ll be talking about our new paper and discussing promising future directions for more human-centered LLM design! Stream it here: https://youtube.com/live/2d49pMXiJOA?si=xlrvDMVn4LaGoW8c…
TL;DR: Augmented Mind 播客直播邀请 Dora 和 Caleb 讨论他们联合领导的以人为中心 LLM 报告,强调 AI 应超越能力基准,关注人类繁荣与长期福祉。
直播背景与播客介绍
这场直播是 Augmented Mind 播客的首次尝试,采用实时形式与观众分享常规节目之外的工作。主持人包括斯坦福和 MIT 的博士生 Michael、Shannon 和 Eugene(其中 Eugene 在后续对话中主导提问)。播客启动于去年十月,第一期在今年年初发布,旨在从两个视角探讨 AI:一是社区内部视以人为本的工作为非技术性的误解,二是外部对 AI 导致大规模失业的担忧。团队希望通过这个平台展示以人为本的 AI 可以具有高度技术性,并且能积极影响社会。
以人为本 AI 的理念
开场视频中,团队强调了过去三年 AI 从简单聊天到控制电脑、编写代码的飞跃,但指出真正的挑战在于构建与人协作的机器,而非仅仅追求更强的模型。以人为本的北极星是对人类个体的仁慈,核心问题是:理想中的协作是什么样的?如何开发增强心智而非替代人的 AI?这些追问驱动着播客的每一期内容。
嘉宾介绍与个人工作
Caleb Ziems(斯坦福大学 NLP 组)
Caleb 即将开始博士最后一年,导师是 Dang(似为 Diyi Yang?但转录中未明确)。他的研究方向聚焦于评估大型语言模型中的社交智能与文化能力,尤其推崇人类与 AI 的联合标注。他提到一个近期项目“文化制图”(Culture Mapping):为解决以往评估中仅用静态问题对比人类与 LLM 回答的不足,他提出混合主动方法——利用 LLM 识别低置信度的长尾知识,再请人类专家补充显著知识,从而更可靠地评估模型的文化能力。
Dora Zhao(斯坦福大学 HCI 与 NLP 交叉领域)
Dora 是三年级博士生,师从 Diyi Yang 和 Michael Bernstein。她的研究关注如何设计 AI 系统以带来长期人类利益,分为两个层面:一是衡量 AI 对个体心理社会指标(如 AI 陪伴与幸福感)及社会层面(如劳动力市场变化)的实际影响;二是构建能促进用户长期利益的新系统。她举例介绍了自己最近的工作“行为网格化”(Behavior Profiling),该方法能从非结构化交互数据中推断用户动机,从而创建出更主动解决用户潜在需求的智能体。
论文项目:对以人为中心 LLM 的反思与新方向
项目起源与规模
该论文源于一个课程项目,最初由导师 Diyi Yang 构想,Dora 和 Caleb 作为共同第一作者组织与编辑。项目汇集了超过 50 位学生作者,最终形成超过 60 页的深度报告,标题为《对以人为中心的大型语言模型的反思与新方向》(Reflections and New Directions for Human-Centered LLMs)。Caleb 强调这并非单纯的文献调研,而是一个面向未来的活跃路线图。
核心理念:从能力到人类繁荣
Caleb 指出,当前 AI 发展主要由技术基准和能力里程碑驱动,例如每年更强大的模型(如图中显示损失函数的改善)。但从以人为本的角度看,问题不仅是“AI 能做什么”,更是“我们能用 AI 构建什么样的世界”。论文旨在帮助理解 AI 是否为人类繁荣创造了途径,在提升生产力的同时增进人类福祉。Dora 补充说,他们希望将这场讨论从技术导向转向社会导向,让 AI 真正服务于人类。
未来方向与问答预告
主持人 Eugene 表示,直播下半场会以更开放的形式回答观众问题,并邀请导师 Diyi Yang 最后 20 分钟加入现场问答。Dora 和 Caleb 鼓励观众在聊天中提出关于报告或他们个人研究的问题。Eugene 还预告了年底的特别节目,以及下一期将邀请 Lean 创始人 Jeremy Avigad 讨论 AI 对数学的影响。
Source: https://www.youtube.com/live/2d49pMXiJOA
Augmented Mind Podcast (@augmind_fm): Join us this Thursday May 28th 6-7pm PST for our first ever AM Podcast Live Stream! 🎉
We are hosting @cjziems, @dorazhao9, and @Diyi_Yang for a discussion on their new paper “Reflections and New Directions for Human-Centered Large Language Models”!
RSVP 🔗⬇️
相似文章
@CMGS1988: https://x.com/CMGS1988/status/2074488576356876585
作者分享了对AI与基础设施之间关系的个人见解,认为AI在放大执行力的同时,无法替代人类在复杂trade-off和组织问题上的判断,并以自身使用Fable 5等模型开发cocoon/sandbox项目的经验为例进行说明。
@MindfulReturn: 今天看到黄碧薇教授 @huang_biwei 的访谈,看到他们新一轮融资的消息!了解到 Aether AI 的方案,多看了几眼他们的方向之后,我说说我看法: AI 的下一个范式:不是更大的模型,是因果关系。 一、相关性天花板:为什么画面很…
文章深度分析Aether AI(原识之智)提出的因果世界模型(CWM),认为AI下一个范式将从相关性转向因果关系,并讨论了其理论基础、技术架构及对视频生成和具身智能领域的潜在影响。
@jakevin7: 很开心能亲历&参与这个进程。 “人类文明的一切都可以重新做一遍(显然我们已经观察到所有 SaaS 都可以重新做一遍,很快会看到更多,当然不只是计算机软件)”
一条关于 AI 的评论:作者感叹人类文明的一切都可以借助 AI 重新做一遍,并讨论了模型训练中 harness、system prompt 和工具集的作用。
@LuBtc888: 给自己一个小时,拉开你和别人5年的AI认知差! DeepMind 创始人 Demis Hassabis 在剑桥的 60 分钟演讲。 关于 AI 的下一阶段:从大模型、AlphaFold 到科学发现和 AGI。 已加中文字幕,建议收藏慢慢看。
DeepMind创始人Demis Hassabis在剑桥大学发表60分钟演讲,涵盖AI从大模型、AlphaFold到科学发现和AGI的未来发展,视频已添加中文字幕。
When millions of AI agents meet
Google DeepMind研究员探讨AI智能体与大型语言模型的核心区别、当前能力与局限,以及当数百万智能体相互交易、协作时可能催生的新经济与通往AGI的新路径。