diffusion-models

标签

Cards List
#diffusion-models

Mean Velocity Matching: 重新思考扩散模型中的生成动力学

arXiv cs.LG ↗ · 昨天 缓存

本文介绍Mean Velocity Matching (MVM),它使用一个单一的学习场来参数化扩散模型中的随机逆向动力学,使得能够进行随机和确定性采样,并具有竞争力的生成质量。

0 人收藏 0 人点赞
#diffusion-models

缓解Diffusion数据点遗忘中的顺序重现问题

arXiv cs.LG ↗ · 昨天 缓存

本文将顺序重现识别为Diffusion数据点遗忘过程中的失效模式,并提出一种锐度引导方法,以提升跨删除序列的遗忘持久性。

0 人收藏 0 人点赞
#diffusion-models

大型语言模型的概率结构

arXiv cs.LG ↗ · 昨天 缓存

该论文为大型语言模型提出了一个统一的概率框架,通过概率测度描述模型,通过最大似然估计进行训练,并将文本生成视为随机模拟过程,同时对幻觉现象和扩散模型的作用提供了深入见解。

0 人收藏 0 人点赞
#diffusion-models

所有模态平等,但视频更平等:弥合联合视频生成中的跨注意力差距

Hugging Face Daily Papers ↗ · 昨天 缓存

本文介绍了RecCAR,一种正则化方法,用于解决联合多模态扩散变换器中的互惠对应差距,从而提高视频生成任务的性能。

0 人收藏 0 人点赞
#diffusion-models

高维潜变量的扩散性

Hugging Face Daily Papers ↗ · 昨天 缓存

本文表明,为重建而微调自编码器会降低有效维度,使得标准速度预测在扩散模型中效率低下,并提出使用x0预测来聚焦于信号流形,从而持续提升文本到图像生成性能。

0 人收藏 0 人点赞
#diffusion-models

Flash-dLLM:IO感知的KV缓存和并行解码,用于快速、内存高效的扩散LLMs

Hugging Face Daily Papers ↗ · 2天前 缓存

Flash-dLLM是一个用于扩散LLMs的免训练推理加速框架,它通过IO感知的KV缓存和并行解码来实现显著的加速和内存效率提升。

0 人收藏 0 人点赞
#diffusion-models

量子增强扩散语言模型的电路超网络

Hugging Face Daily Papers ↗ · 3天前 缓存

HyperQ 在冻结的掩码扩散语言模型中引入了令牌条件化的量子残差分支,使用电路超网络动态生成量子电路参数。这种方法在基准测试中提高了性能,并且计算效率高,与经典基线相比需要更少的微调示例。

0 人收藏 0 人点赞
#diffusion-models

流式视频编辑与便捷适配

Hugging Face Daily Papers ↗ · 3天前 缓存

本文介绍了SVEET,一个用于高质量流式视频编辑的框架,它利用预训练的视频扩散模型,实现自动回归编辑,并在单个GPU上实现实时性能。

0 人收藏 0 人点赞
#diffusion-models

UltraTex: 释放2K多视角扩散在3D纹理生成中的潜力

Hugging Face Daily Papers ↗ · 5天前 缓存

UltraTex是一个高效框架,用于基于高分辨率多视角扩散的3D纹理生成,引入了技术以减少冗余并在训练和推理中实现显著加速。

0 人收藏 0 人点赞
#diffusion-models

通过推测性草稿树加速扩散采样

arXiv cs.LG ↗ · 2026-09-17 缓存

本文介绍了推测性草稿树,通过丰富候选草稿和使用贪婪拒绝采样来加速扩散模型采样,实现了比基线方法高达8.3%的加速。

0 人收藏 0 人点赞
#diffusion-models

Video DeltaNet: 面向直播视频生成的视频原生混合注意力机制

Hugging Face Daily Papers ↗ · 2026-09-17 缓存

Video DeltaNet提出了一种混合注意力机制,结合Softmax和线性注意力,以提高视频生成模型的效率,实现了比基线方法快14.5倍的加速。

0 人收藏 0 人点赞
#diffusion-models

训练文本到图像模型速度提升3.6倍

Hacker News Top ↗ · 2026-09-16 缓存

Linum AI 推出 JiT-DDT,这是一种新颖的编码器-解码器架构,训练文本到图像模型的速度比之前的方法快3.6倍,同时生成更高分辨率的图像。

0 人收藏 0 人点赞
#diffusion-models

Early-Bird Decoding: 通过可学习块大小和并行采样加速扩散大语言模型

arXiv cs.CL ↗ · 2026-09-16 缓存

本文提出'Early-Bird Decoding',这是一个通过可学习块大小和并行采样来加速扩散大语言模型的框架,在不修改预训练权重的情况下实现了显著的吞吐量提升。

0 人收藏 0 人点赞
#diffusion-models

用于扩散语言模型中有界状态推理的注册令牌

arXiv cs.CL ↗ · 2026-09-16 缓存

本文提出在扩散语言模型中使用注册令牌来维护跨生成块的有界状态推理,在数学和代码基准测试中显示出显著的提升,而无需完整保留上下文。

0 人收藏 0 人点赞
#diffusion-models

基于联合多流扩散的高效一对多翻译

arXiv cs.CL ↗ · 2026-09-16 缓存

本文提出了一种离散扩散框架,用于高效的一对多机器翻译,实现了随目标语言数量次线性延迟扩展,并支持对未见源语言的零样本迁移。

0 人收藏 0 人点赞
#diffusion-models

@HaoyiZhu: I wrote up some notes on when ODE and SDE sampling are equivalent, and what changes in practice. https://haoyizhu.site/…

X AI KOLs Timeline ↗ · 2026-09-15 缓存

Notes on the equivalence between ODE and SDE sampling in diffusion models, discussing conditions and practical changes.

0 人收藏 0 人点赞
#diffusion-models

ReCAST:在线扩散强化中的时间步奖励信用分配

arXiv cs.LG ↗ · 2026-09-15 缓存

ReCAST 提出了一种在扩散模型微调中实现按奖励、时间步依赖的信用分配方法,将用户偏好与时间分配分离,以提升对齐性和信息价值。

0 人收藏 0 人点赞
#diffusion-models

GradRepair-ODE:神经网络ODE训练中的认证梯度修复

arXiv cs.LG ↗ · 2026-09-15 缓存

GradRepair-ODE引入了一个可靠性框架,用于认证和修复神经网络ODE训练中的梯度,以解决科学机器学习和生成模型中的数值稳定性问题。

0 人收藏 0 人点赞
#diffusion-models

基于分数的离群点生成:控制Radon-Nikodym导数

arXiv cs.LG ↗ · 2026-09-14 缓存

本文提出了一种通过扩散模型利用Radon-Nikodym导数操纵似然性来实现受控离群点生成的方法,无需重新训练即可创建低似然性样本。

0 人收藏 0 人点赞
#diffusion-models

DCRA:基于扩散条件的表示对齐以提升时间序列学习的鲁棒性

arXiv cs.LG ↗ · 2026-09-14 缓存

DCRA提出了一种扩散条件表示对齐框架,旨在增强时间序列学习的鲁棒性,尤其适用于脑电图(EEG)和心电图(ECG)等临床信号,通过对不同噪声水平下的表示进行对齐来实现。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈