power-law

标签

Cards List
#power-law

Power law graph attention: exact generalization of scaled dot-product attention, empirical collapse at inference

arXiv cs.LG · 5天前 缓存

This paper introduces Power Law Graph Attention (PLGA) and the PLDR-LLM architecture, an exact generalization of scaled dot-product attention using input-generated bilinear operators. It presents theoretical results including an inference-collapse theorem, empirical stability measurements, and machine-checked proofs in Lean 4.

0 人收藏 0 人点赞
#power-law

一个有趣的傅里叶变换 – 1/f 噪声

Hacker News Top · 2026-08-07 缓存

本文解释了幂律函数的傅里叶变换,重点关注1/f噪声这一有趣情况,以及时域和频域之间的对称性。

0 人收藏 0 人点赞
#power-law

人类语言中上下文持久性的标度律

arXiv cs.CL · 2026-07-29 缓存

本文提出一个标度律,表明人类语言中词序的上下文影响随距离近似以1/d的速率衰减,该衰减通过大型语言模型测得的困惑度降低来衡量,且在不同语言和语料库中均成立。

0 人收藏 0 人点赞
#power-law

表格数据上经典机器学习的缩放定律:一项基准研究

arXiv cs.LG · 2026-07-27 缓存

本文对表格数据上经典机器学习模型的缩放定律进行了一项分布式基准研究,结果表明幂律拟合适用于大多数模型家族,并量化了127名学生运行中复制者实现的差异。

0 人收藏 0 人点赞
#power-law

@rosinality: https://arxiv.org/abs/2606.29858 为什么会出现幂律缩放?单个token的损失遵循S形曲线,……

X AI KOLs Timeline · 2026-06-30 缓存

本文提出了一个token级别的框架,表明语言模型损失中的幂律缩放来源于单个token的S形学习曲线的聚合,并证明根据token学习时间重塑训练分布可以将验证损失降低11%。

0 人收藏 0 人点赞
#power-law

扩展定律,谨慎解读(25分钟阅读)

TLDR AI · 2026-06-26 缓存

全面概述深度学习中的扩展定律,追溯其理论基础和实证发现,并解释损失如何随模型大小、数据和计算量可预测地降低。

0 人收藏 0 人点赞
#power-law

LoRA如何记忆?面向LLM微调的参数化记忆定律

Hugging Face Daily Papers · 2026-05-28 缓存

本文使用LoRA作为探针,研究了大语言模型中参数化记忆的定量极限,建立了幂律关系,并引入了一种名为MemFT的阈值引导优化方法,以提升记忆性能。

0 人收藏 0 人点赞
#power-law

等式发现中的饱和标度律:三个玩具基底与两个现实世界复现中的增长动力学现象学

arXiv cs.AI · 2026-05-26 缓存

本文研究了确定性等式发现中的增长动力学,涉及三个玩具基底和两个现实世界复现,发现了基底条件性的饱和幂律标度。

0 人收藏 0 人点赞
#power-law

神经语言模型的缩放规律

OpenAI Blog · 2020-01-23 缓存

基础性实证研究,展示了语言模型性能与模型规模、数据集大小和计算预算之间的幂律缩放关系,对最优训练资源分配和样本效率有重要启示。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈