entropy

标签

Cards List
#entropy

熵到底是什么?

Wired · 2天前 缓存

一篇关于熵真正含义的深刻解释,将常见的“无序”比喻与使用掷骰子类比的概率解释进行对比。

0 人收藏 0 人点赞
#entropy

@_yusufknl: In 1948, Claude Shannon invented the math behind every LLM you use today. He tested it by making his wife guess the nex…

X AI KOLs Timeline · 4天前 缓存

A detailed walkthrough explains how Claude Shannon's 1948 information theory underlies LLMs and shows that the 'next-token prediction' story is misleading, linking compression and prediction mathematically.

0 人收藏 0 人点赞
#entropy

形式语义结构解释人类标注变异的程度有多大?:NLI中的群体级效应与项目级上限

arXiv cs.CL · 6天前 缓存

本文利用ChaosNLI数据,衡量形式语义结构在多大程度上解释了自然语言推理(NLI)中的人类标注变异,发现了对熵的群体级效应,但存在项目级上限和空组合效应。

0 人收藏 0 人点赞
#entropy

使用自然语言处理比较人类与大语言模型中的语义导航

arXiv cs.CL · 2026-07-15 缓存

本文使用言语流畅性数据比较人类与大语言模型之间的语义搜索动态,发现人类表现出更加多变和探索性的搜索模式,而当前模型无法重现这些模式。

0 人收藏 0 人点赞
#entropy

盲人与明眼人语义记忆导航中的熵:视觉经验的影响

arXiv cs.CL · 2026-07-15 缓存

本研究使用语义熵(一种基于NLP嵌入的度量),比较盲人与明眼人的语义记忆导航。结果表明,视觉经验影响熵的模式:明眼人对抽象概念的熵更高,而盲人对视觉显著性具体概念的熵更高。

0 人收藏 0 人点赞
#entropy

在线自蒸馏中Thinking Collapse的诊断与缓解

arXiv cs.CL · 2026-07-14 缓存

本文识别了大型语言模型在On-Policy Self-Distillation中的'Thinking Collapse'现象,其特点是中间推理步骤的减少,并提出了AD-OPSD控制框架,通过将高风险抑制令牌锚定到参考先验来缓解这种崩溃。该方法在数学基准测试上实现了高达+4.1%的绝对平均准确率提升。

0 人收藏 0 人点赞
#entropy

基于自监督早期退出机制加速大语言模型推理

arXiv cs.CL · 2026-07-13 缓存

本文介绍了一种针对大语言模型的自监督早期退出方法,允许在置信度较高时在中间层提前停止计算,从而降低推理成本。此外,还提出了动态自推测解码(DSSD),相比现有基线实现了更高的令牌接受率。

0 人收藏 0 人点赞
#entropy

我在Qwen3-4B上跨越7个数据集映射了Anthropic的J-Space幻觉信号,以找出其有效和失效的地方

Reddit r/LocalLLaMA · 2026-07-12

本文在Qwen3-4B上跨越7个数据集评估了Anthropic的J-Space幻觉检测方法,发现该方法在捕捉事实检索中的高置信度错误方面有效,但对内化的虚构内容视而不见,并且在阈值无法迁移的数学任务上失效。

0 人收藏 0 人点赞
#entropy

@omarsar0: 信息论的可视化介绍(收藏)信息论是如此美丽而强大的主题……

X AI KOLs Following · 2026-07-09 缓存

一篇直观、可视化的信息论入门介绍,涵盖熵、互信息和信道容量,仅需基础概率知识。该论文阐述了压缩和传输的基本极限。

0 人收藏 0 人点赞
#entropy

时间在加速、减慢,甚至停止

Reddit r/singularity · 2026-07-08

研究人员利用玻色-爱因斯坦凝聚体作为迷你宇宙,通过实验证明时间可以从熵交换中涌现,支持了量子物理中关系性时间或涌现时间理论。

0 人收藏 0 人点赞
#entropy

数学中的联系:两种随机

Hacker News Top · 2026-07-05 缓存

探讨为什么两个统计上相同的序列——纯噪声和π的数字——在可压缩性上有所不同,区分了统计冗余和基于过程的压缩。

0 人收藏 0 人点赞
#entropy

利用熵提升大语言模型的创意写作能力

Reddit r/LocalLLaMA · 2026-07-02 缓存

本文介绍了一种通过修改采样过程利用熵来改进大语言模型创意写作的技术,旨在减少生成文本中常见的“大语言模型风格”。

0 人收藏 0 人点赞
#entropy

@snowboat84: 几年来我一直在思考这个问题。统计力学和AI之间的关系。统计力学用分子动力学的统计方式,复现了热力学优美的基本定理,尤其是复现了一些热力学里极为漂亮的宏观量之间的关系,比如熵、自由能,当然还有温度、压强等。 问题是,AI是否有这些热力学的宏…

X AI KOLs Timeline · 2026-06-25 缓存

这篇推文探讨了统计力学与人工智能之间的关系,并引用了一篇论文,该论文提出了机器学习系统的热力学理论,引入了温度、熵和能量等概念,将训练过程视为相变。

0 人收藏 0 人点赞
#entropy

超越熵:从令牌级分布偏差中学习以提升LLM推理

arXiv cs.AI · 2026-06-20 缓存

提出独立组合令牌(ICT)框架,利用令牌logit分布之间的Jensen-Shannon散度识别关键分支点,防止RLVR在LLM推理中的熵坍缩和熵爆炸。在Qwen模型上实现了高达14.9%的pass@4改进。

0 人收藏 0 人点赞
#entropy

@johnschulman2: PPO在LLM时代迎来了第二波,原因超出了原始论文的预期——重要性比率目标会修正由数值误差、异步训练和前向传播噪声引起的偏差——而裁剪目标通过一种我们当初发表时未知的机制影响熵(DAPO, https://arxiv.org/abs/2509.26114)

X AI KOLs Following · 2026-06-18 缓存

本文揭示了PPO和GRPO中的裁剪机制在LLM的RLVR中引入了熵偏差:低裁剪增加熵,高裁剪减少熵。作者证明,即使在随机奖励的情况下,标准裁剪也会降低熵,并表明调整低裁剪可以防止熵塌陷并促进探索。

0 人收藏 0 人点赞
#entropy

@snowboat84: 若干年前,耗散系统和非线性复杂系统在学术界和文化界曾经非常火热。要全面回顾耗散系统,不得不从非耗散的热力学说起。热力学第二定律(熵定律)说,一切都该走向混乱、走向死寂。可生命在生长,森林在演替,连数据中心里的大模型,也在不断"学"出秩序。…

X AI KOLs Timeline · 2026-06-18 缓存

这是一篇长达两万五千余字的科普文章,从熵的起源讲起,回顾了耗散系统理论的发展历程,并探讨了AI是否属于耗散系统的三层分析(硬件层、训练层、静态模型)。

0 人收藏 0 人点赞
#entropy

整合局部与全局熵的LLM不确定性量化

arXiv cs.LG · 2026-06-10 缓存

本文提出全局-局部不确定性(GLU),一种无监督单次评分方法,融合词元级局部熵与隐藏状态几何全局熵,用于LLM不确定性量化,证明两者近乎正交,共同捕捉自信但错误的失效模式。

0 人收藏 0 人点赞
#entropy

突破熵界:通过带拒绝采样的多 token 预测加速 RL 训练

Hugging Face Daily Papers · 2026-06-10 缓存

Bebop 提出了熵感知的多 token 预测,结合拒绝采样和一种新的 TV 损失,以加速 LLM 的 RL 训练,实现最高 1.8 倍的加速。该方法通过优化训练目标,解决了 RL 训练中接受率下降的问题。

0 人收藏 0 人点赞
#entropy

多智能体协作何时有效?熵的视角

arXiv cs.AI · 2026-06-08 缓存

本文从熵的视角审视多智能体系统(MAS),分析智能体内部与之间的动态。研究发现,单个智能体通常优于MAS,并引入了熵判断算法以提高MAS性能。

0 人收藏 0 人点赞
#entropy

Lobsters Hottest · 2026-06-07 缓存

一篇技术博文,探讨随机性、Linux熵以及构建一个名为morerandom的工具,该工具使用WASM插件来为系统熵池提供熵。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈