@jinchenma_ai: 看了张小珺那期访谈姚顺宇,4 个小时,干货密度很高。 他有个判断特别反主流。 很多人说预训练撞墙了、Scaling Law 到头了。他说没有,接下来几个月也看不到到头的迹象。 那为什么这么多人觉得撞墙?他直说:绝大多数喊撞墙的人,是自己代…
摘要
姚顺宇在访谈中提出反主流观点,认为预训练并未撞墙、Scaling Law也未到头,声称多数喊撞墙的人是因为代码中有bug。
看了张小珺那期访谈姚顺宇,4 个小时,干货密度很高。
他有个判断特别反主流。
很多人说预训练撞墙了、Scaling Law 到头了。他说没有,接下来几个月也看不到到头的迹象。
那为什么这么多人觉得撞墙?他直说:绝大多数喊撞墙的人,是自己代码里有 bug,没意识到而已。
修掉一个 bug 带来的进步,往往比那些花哨技巧多得多。
查看缓存全文
缓存时间: 2026/05/22 13:55
看了张小珺那期访谈姚顺宇,4 个小时,干货密度很高。
他有个判断特别反主流。
很多人说预训练撞墙了、Scaling Law 到头了。他说没有,接下来几个月也看不到到头的迹象。
那为什么这么多人觉得撞墙?他直说:绝大多数喊撞墙的人,是自己代码里有 bug,没意识到而已。
修掉一个 bug 带来的进步,往往比那些花哨技巧多得多。
相似文章
@AlchainHust: 花了大半天把张小珺访谈姚顺宇的4小时长访听了一遍。这位去年刚从Anthropic跳到Google DeepMind的哥们,参与过Claude 3.7/4.5和Gemini 3。他给了很多实诚的头部大模型一线研究员的视角。访谈信息密度相当高…
本文总结了张小珺对姚顺宇的访谈,姚是参与Claude和Gemini开发的研究员,分享了关于AI代码生成、公司文化、Scaling Law等10个有见地的观点。
@sheriyuo: 我觉得 @latepostnews 的报道无可争议是中文区第一,不管是之前 DeepSeek 专访、Top Seed 还是这次的大包叙事。 他们真的太敢写了,新智元 / 量子位之流完全无法碰瓷,而现在的机器之心也只是在推上蒸馏几个推文 (…
用户@sheriyuo称赞晚点LatePost为中文区最佳AI媒体,批评其他同行如新智元、量子位和机器之心,并提到对DeepSeek等报道的深度。
@Bill_Do_A_Bit: https://x.com/Bill_Do_A_Bit/status/2056581340842066212
文章基于姚顺宇的判断,认为AI会优先改变反馈清晰、可快速验收的任务,而非按职业声望排序;程序员因代码世界完善的测试和反馈机制率先被影响,产品经理的核心判断虽难训练但其外围执行层同样面临重构。
@huoru_tarnish: 张一鸣才是真正的宫斗高手 很多人还在吹他“热爱技术、理工男工程师人设”,但现实完全不是那么回事。 1. 本科毕业一年小组长、两年技术部老大,直接管50多人(里面一堆清北博士)。小组长就已经基本不写代码了,他真正 coding 的时间离开学…
该推文认为张一鸣并非单纯热爱技术的工程师,而是深谙公司政治的高手,通过一系列权力操作巩固地位,并以抖音与火山的发展历程为例。
@huangyihe: 以顾问身份加入腾讯时,姚顺雨任务只有一个:排查混元大模型长期落后的原因。排查结果是:“简单来说,几乎每个环节都在漏水。” 混元过度追求榜单成绩,把打榜语料放进训练集污染了数据,模型变得很会考试,但在真实场景表现很差。当时数据标注准确率的验…
腾讯顾问姚顺雨排查混元大模型落后面原因,发现为追求榜单成绩导致数据污染、标注质量差等系统性问题。