representation-learning

标签

Cards List
#representation-learning

无监督学习何时成功或失败?从PoS视角看基于重建的异常检测

arXiv cs.LG ↗ · 2天前 缓存

本文通过几何条件分析基于重建的无监督学习的失败,并提出新方法如Dynamic Push and Pull来增强异常检测性能。

0 人收藏 0 人点赞
#representation-learning

CARE:面向扩散模型的条件感知表示正则化

arXiv cs.LG ↗ · 2天前 缓存

该论文介绍了CARE,这是一个针对扩散模型的条件感知表示正则化框架,通过基于条件相似性动态调节特征分布来提高样本质量和训练效率。在经验上,它在类别到图像和文本到图像任务中显著降低了FID并加快了收敛速度。

0 人收藏 0 人点赞
#representation-learning

在Platonic Representation Hypothesis中,什么收敛?结构而非几何

arXiv cs.LG ↗ · 3天前 缓存

本文挑战了对Platonic Representation Hypothesis的解释,通过区分关系结构和度量几何,表明关系收敛是稳健的,而度量几何收敛在各种模型校准后较弱。

0 人收藏 0 人点赞
#representation-learning

图域适应不止于表示学习

arXiv cs.LG ↗ · 4天前 缓存

论文提出了EviGDA,一个通过结合图感知和无图专家来增强图域适应的框架,旨在改进结构变化下的预测。

0 人收藏 0 人点赞
#representation-learning

高维潜变量的扩散性

Hugging Face Daily Papers ↗ · 4天前 缓存

本文表明,为重建而微调自编码器会降低有效维度,使得标准速度预测在扩散模型中效率低下,并提出使用x0预测来聚焦于信号流形,从而持续提升文本到图像生成性能。

0 人收藏 0 人点赞
#representation-learning

LE4Mob:用于人类移动性建模的归纳式、距离感知通用位置嵌入

arXiv cs.LG ↗ · 5天前 缓存

LE4Mob 是一个归纳式、距离感知的通用位置嵌入框架,用于增强人类移动性建模中的任务,如下一位置预测和通勤流量生成。

0 人收藏 0 人点赞
#representation-learning

MIRCID: 推断的核心miRNAs驱动药物机制建模的跨任务改进

arXiv cs.LG ↗ · 6天前 缓存

MIRCID是一个框架,通过比较基因表达与推断的转录因子活性及miRNA表达,推断核心miRNAs,以增强药物作用机制建模,从而在通路分类和基于相似性的检索方面取得改进。

0 人收藏 0 人点赞
#representation-learning

MCR²在分布外泛化中的局限性

arXiv cs.LG ↗ · 6天前 缓存

本文指出了MCR²在分布外泛化方面的两个局限性,表明其在分布漂移下可能会失效,并且纳入不变性原则并不能消除这种失效。

0 人收藏 0 人点赞
#representation-learning

像世界模型一样思考,像VLA一样行动:将世界模型表示蒸馏到紧凑的机器人策略中

Hugging Face Daily Papers ↗ · 6天前 缓存

本文介绍了THAW-VLA,一种将世界模型表示蒸馏到视觉-语言-动作模型中的方法,用于机器人学,增强了在模拟和真实硬件上的鲁棒性和性能,而不会增加推理开销。

0 人收藏 0 人点赞
#representation-learning

[2607.11666] 驯服“Grokking”现象:以表征几何作为控制信号

Reddit r/LocalLLaMA ↗ · 2026-09-18 缓存

本文探讨了神经网络中的“Grokking”(延迟泛化)现象,并引入了几何维度正则化(GeomDR)方法来控制表征几何结构,从而将“Grokking”现象的出现速度最高提升52倍。

0 人收藏 0 人点赞
#representation-learning

Lens:将正确的语义视角聚焦于无训练多模态表示学习

arXiv cs.CL ↗ · 2026-09-18 缓存

本文介绍了Lens,这是一个用于多模态表示学习的无训练框架,它解决了语义视角不对齐的问题,在MMEB数据集上取得了显著的性能提升,无需参数更新。

0 人收藏 0 人点赞
#representation-learning

用于药物重定位候选物实用筛选的预训练医学表示

arXiv cs.LG ↗ · 2026-09-18 缓存

本文提出了一种新的统一预训练框架,用于医学代码序列,能够捕获层次结构和复杂交互,并在临床事件预测和阿尔茨海默病的药物重定位案例研究中展示了优越的性能。

0 人收藏 0 人点赞
#representation-learning

Meta FLAT用于多模态理解与生成(7分钟阅读)

TLDR AI ↗ · 2026-09-17 缓存

FLAT引入了一种共享的连续令牌序列,用于图像和文本,从而为生成和检索等多模态任务提供灵活长度的表示,并在基准测试中表现出色。

0 人收藏 0 人点赞
#representation-learning

注意力平均场预测平均表征动态并揭示上下文特定计算

arXiv cs.LG ↗ · 2026-09-16 缓存

本文介绍了一种注意力的平均场分析,该分析能够预测平均表征动态并揭示语言模型中的上下文特定计算,并在GPT-2、Pythia和Qwen-3-14B等模型上进行了验证。

0 人收藏 0 人点赞
#representation-learning

Representation-based Masked Diffusion Model

arXiv cs.CL ↗ · 2026-09-14 缓存

本文提出了基于表示的遮蔽扩散模型(RMDM),该模型利用文本表示来改进遮蔽扩散模型中的并行令牌更新,特别是在少步采样中提升生成质量。

0 人收藏 0 人点赞
#representation-learning

通过方向分解解析Transformer中的表示演化

Hugging Face Daily Papers ↗ · 2026-09-14 缓存

本文将Transformer表示更新分解为平行和垂直分量,以研究演化几何,并将其与编辑鲁棒性、压缩诊断和训练改进联系起来。

0 人收藏 0 人点赞
#representation-learning

基于参考的大型语言模型偏差检测:通过隐藏状态的相对表示

arXiv cs.AI ↗ · 2026-09-11 缓存

本文提出了一种基于参考的方法,通过分析模型变体间隐藏状态的相对表示来检测大型语言模型中的偏差,引入了表示偏差偏移(ΔB),该偏移与输出层面的偏差变化高效相关。

0 人收藏 0 人点赞
#representation-learning

Capsule Lens: 在模型表征中定位与追踪概念几何

arXiv cs.LG ↗ · 2026-09-10 缓存

Capsule Lens 是一个用于机制可解释性的框架,它使用几何胶囊来定位和追踪概念如何在神经网络表征中编码,从而支持对模型静态和动态内部状态的分析。

0 人收藏 0 人点赞
#representation-learning

基于粒球的多粒度自适应超图表示学习

arXiv cs.LG ↗ · 2026-09-10 缓存

本文提出了一种多粒度超图表示学习(MGHRL)框架,该框架利用粒球分割自适应地生成多粒度超边,以捕捉图中的高阶关系,在基准数据集上优于基线模型。

0 人收藏 0 人点赞
#representation-learning

NOAH: 学习完整的患者旅程。一个用于表征和预测的纵向多模态时间感知模型

Hugging Face Daily Papers ↗ · 2026-09-08 缓存

NOAH引入了一个生成式Transformer模型,用于纵向多模态患者数据的全面表征和预测,实现临床环境中的零样本分类和反事实模拟等任务。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈