scaling-law

标签

Cards List
#scaling-law

机器人缩放定律的诞生

Reddit r/singularity · 3小时前

本文介绍了机器人技术中的缩放定律概念,这可能为推进机器人系统和人工智能研究提供见解。

0 人收藏 0 人点赞
#scaling-law

迈向十亿级容量用户表示学习的稠密化定律

Hugging Face Daily Papers · 2026-08-24 缓存

本文提出了一种用户表示学习的稠密化定律,量化了数据规模与分词容量之间的关系,并引入了一种自适应分词方法ALGN,以提高十亿级场景的效率。

0 人收藏 0 人点赞
#scaling-law

@swyx:我认为很容易说“模拟是新的扩展规律”,并将其视为营销炒作,但在采访中途……

X AI KOLs Timeline · 2026-08-21 缓存

该推文讨论了模拟作为AI中潜在的新扩展规律,强调了来自Simile AI首席执行官的采访洞见,关于模拟人类行为以进行高级AI研究。

0 人收藏 0 人点赞
#scaling-law

@seclink:视频里是加速了的,实际上动作慢很多...

X AI KOLs Timeline · 2026-08-21 缓存

Lightwheel AI 和 Hugging Face 已开源 EgoSuite-Open100K,这是目前最大的全标注第一人称视角人类行为数据集,包含 100,000 小时的数据,重点强调物理AI的规模定律。

0 人收藏 0 人点赞
#scaling-law

每美元智能是新的扩展定律:一个小型推理模型在Arc-AGI 1上突破现有成本-精度帕累托前沿

Reddit r/artificial · 2026-08-17

Chart Pathway的BDH-CQ,一个150M参数的推理模型,在ARC-AGI-1上达到了29.5%的准确率,每任务成本远低于像GPT-5.6 Luna这样的大型模型,展示了成本-精度权衡的改进。

0 人收藏 0 人点赞
#scaling-law

@0xcryptowizard: Stanford 最新的课程,值得一看。 关于自进化 AI,涉及 scaling law,思维链,rlhf,推理模型等。 youtube 链接: https://youtu.be/6YnLB0XbTnI?si=Dg-aSXbDxymA4U…

X AI KOLs Timeline · 2026-08-04 缓存

推荐斯坦福大学CS329A课程,关于自我改进的AI智能体,涵盖scaling law、思维链、RLHF、推理模型等内容。

0 人收藏 0 人点赞
#scaling-law

@arvin17x: 今天在 Berkeley AI Summit 2026 最大的收获,来自 Jianfeng Gao 教授的演讲。 目前 AI Modeling 的新一代范式已经出现: - 新的训练数据:从 harness 到 agentic modeli…

X AI KOLs Timeline · 2026-08-02 缓存

作者在Berkeley AI Summit 2026总结了Jianfeng Gao教授的演讲,指出AI建模的新范式是基于Agentic Modeling和新数据飞轮,强调Harness将成为应用护城河的关键。

0 人收藏 0 人点赞
#scaling-law

人类语言中上下文持久性的标度律

arXiv cs.CL · 2026-07-29 缓存

本文提出一个标度律,表明人类语言中词序的上下文影响随距离近似以1/d的速率衰减,该衰减通过大型语言模型测得的困惑度降低来衡量,且在不同语言和语料库中均成立。

0 人收藏 0 人点赞
#scaling-law

DomainPilot:基于领域级损失引导的两阶段数据混合优化,用于高效语言模型微调

arXiv cs.LG · 2026-07-28 缓存

DomainPilot 提出了一种基于领域级损失引导的两阶段框架,用于大语言模型微调中的数据混合优化,在无需增加数据量或训练成本的情况下,在 MMLU-Redux、AIME24、LiveCodeBench v5 和 BFCL v3 上实现了性能提升。

0 人收藏 0 人点赞
#scaling-law

@DeFiMinty: 强化学习能否弥补弱预训练的不足?研究人员通过国际象棋谜题进行了测试,其中每个提议…

X AI KOLs Timeline · 2026-07-21 缓存

研究人员研究了强化学习(RL)与预训练质量之间的相互作用,表明预训练更强的模型从RL中获益更多,且RL无法完全弥补弱预训练的不足。还确定了预训练和后训练计算分配的联合缩放定律。

0 人收藏 0 人点赞
#scaling-law

Bielik 知道它不知道什么吗?激活分散性在模型规模上区分实体熟悉度与事实可靠性

arXiv cs.CL · 2026-07-09 缓存

本文研究了波兰 Bielik 大语言模型中的激活模式是否能在生成前检测到实体熟悉度,使用了无监督的分散度量,在模型规模上实现了已知实体与虚构实体的近乎完美分离,同时表明事实可靠性随规模急剧提升,但更难从激活中预测。

0 人收藏 0 人点赞
#scaling-law

@xiaogaifun: https://x.com/xiaogaifun/status/2073771786202939572

X AI KOLs Timeline · 2026-07-05 缓存

字节Seed团队发布了EdgeBench基准测试,允许AI模型连续工作12-72小时来评估长程任务中的学习能力,发现模型从环境学习的时间和性能之间遵循log-sigmoid曲线,存在新的Scaling Law。

0 人收藏 0 人点赞
#scaling-law

EdgeBench揭示新缩放定律:即时AI学习速度每三个月翻一番

Reddit r/singularity · 2026-07-02

EdgeBench揭示了一条新缩放定律,表明即时AI学习速度每三个月翻一番。

0 人收藏 0 人点赞
#scaling-law

数据驱动的机器学习无法达到符号级别的逻辑推理——缩放定律的极限

arXiv cs.AI · 2026-06-26 缓存

本文认为,包括GPT-5在内的数据驱动机器学习系统无法仅通过缩放达到符号级别的逻辑推理,原因在于它们在区分逻辑结构与统计规律方面存在固有局限性。

0 人收藏 0 人点赞
#scaling-law

@AYi_AInotes: 全网都在吹日本Fugu跑分超GPT,但我敢说99%的人没看懂它真正炸场的地方。 首先这玩意儿根本不是什么超大单体大模型, 它全身上下只有0.6B参数,本职工作就其实就是个AI项目经理, 简单任务自己处理,复杂任务自动拆分,从全球顶级模型池…

X AI KOLs Timeline · 2026-06-23 缓存

Sakana AI 发布 Fugu,一个仅 0.6B 参数的多智能体编排系统,通过智能任务拆分和模型协作达到前沿性能,绕开了传统的参数量扩增路径,标志着多智能体编排正式成为可用的生产力工具。

0 人收藏 0 人点赞
#scaling-law

@paulwalker99318: 晚点LateTask这篇访谈的信息量非常大,关于百度美研、Scaling Law、OpenAI、Anthropic、Cerebras的往事。 > "Dario 能进百度,其实是他职业生涯里很重要的一步。他是 Greg Diamos 招进来…

X AI KOLs Timeline · 2026-06-22 缓存

这是一条对晚点LateTask访谈的总结,回顾了百度美研在AI领域的早期布局,包括投资Cerebras、差点投资OpenAI和Anthropic,以及多位人才从百度流向这些公司等历史细节。

0 人收藏 0 人点赞
#scaling-law

@SaitoWu: 十年前百度美研一群人就预判:不能把 AI 算力全押在英伟达身上。结果他们真的投了一家「晶圆级」芯片公司 —Cerebras。 2016 年,周楠从投行跳去百度美国人工智能研究院。那时候吴恩达带队,预算充足,GPU 随便买。Dario(An…

X AI KOLs Timeline · 2026-06-17 缓存

文章回顾了百度美研十年前投资Cerebras晶圆级芯片公司的故事,分析了AI芯片市场从训练到推理的转变,以及非共识投资的重要性。

0 人收藏 0 人点赞
#scaling-law

权重范数确定Grokking时间尺度:一个因果延迟定律

arXiv cs.LG · 2026-06-15 缓存

本文证明权重范数因果性地控制神经网络中grokking的时间尺度,调和了相互矛盾的论述。通过干预实验,它表明grokking遵循指数延迟定律,且范数大小在不同架构中比学习率更主导grokking时间。

0 人收藏 0 人点赞
#scaling-law

@gntalktalk: 这是最近ai开发领域最好的方法论:软件工程的scaling law --- Channel AI 创始人Luke Orthwine 提出了一种全新的思维范式:丢掉单线程线性思考的“象棋思维”,转向高并发、宏观调度、饱和攻击的“实时战略游戏…

X AI KOLs Timeline · 2026-06-14 缓存

Channel AI创始人Luke Orthwine提出一种新的软件开发方法论:将编程思维从传统的象棋式单线程线性思考,转向实时战略游戏(RTS)式的高并发、宏观调度和饱和攻击,以实现AI Agent时代的高效率开发。

0 人收藏 0 人点赞
#scaling-law

@snowboat84: https://x.com/snowboat84/status/2062686432335184321

X AI KOLs Timeline · 2026-06-05 缓存

这篇文章探讨了物理学与深度学习之间的深层联系,分析了Scaling Law、涌现等现象与物理学中临界标度律、相变等概念的同构性,并梳理了物理方法论在AI中的应用现状与前景。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈