diffusion-models

标签

Cards List
#diffusion-models

往返一致性:双向扩散模型可预测自身的展开误差 [R]

Reddit r/MachineLearning · 3天前

本文提出一种双向潜在扩散模型,可让动力系统在时间上向前或向后步进,并利用往返一致性作为自监督的测试时误差信号,在无需真实值或集成的情况下预测展开误差。

0 人收藏 0 人点赞
#diffusion-models

面向中尺度保持的海面温度降尺度的可迁移双流表示

arXiv cs.LG · 3天前 缓存

本文介绍了EddyFlow,一个用于公里级海面温度降尺度的深度学习框架,它在预测精度、尺度相关结构和区域泛化之间取得平衡。该框架在多个海洋区域实现了强大的零样本性能和近乎理想的频谱保真度。

0 人收藏 0 人点赞
#diffusion-models

Long-term Traffic Scene Prediction via Polynomial Representations in Autonomous Driving

arXiv cs.AI · 4天前 缓存

This thesis introduces polynomial representations for long-term traffic scene prediction in autonomous driving, showing improved computational efficiency, generalization, and prediction plausibility over sequence-based baselines, validated on Argoverse 2 and Waymo Open datasets.

0 人收藏 0 人点赞
#diffusion-models

UniWorld-View:基于视频扩散模型的大基线视图合成

Hugging Face Daily Papers · 4天前 缓存

提出了UniWorld-View,一个用于从单目输入进行大基线新视图合成的统一框架,将遮挡感知的点云渲染与视频扩散模型相结合,以实现精确的相机控制和几何一致性。

0 人收藏 0 人点赞
#diffusion-models

FairDiffuseVQVAE:通过向量量化潜变量的条件细化实现表格扩散中的采样时公平性

arXiv cs.LG · 6天前 缓存

介绍了FairDiffuseVQVAE,一种两阶段表格扩散模型,通过在采样时以受保护属性为条件来实现公平性,在人口统计均等和均等化几率方面优于以往的公平表格生成器。

0 人收藏 0 人点赞
#diffusion-models

@BioSpace9:利用基于扩散的系综采样进行蛋白质开关的从头设计

X AI KOLs Timeline · 6天前 缓存

这篇bioRxiv预印本介绍了Diff-Switch框架,该框架利用基于扩散的系综采样生成构象状态,用于从头设计蛋白质开关,从而提高找到开关兼容序列的成功率。

0 人收藏 0 人点赞
#diffusion-models

冻结的像素空间扩散模型可利用自身样本进行自我引导

Hugging Face Daily Papers · 2026-07-31 缓存

本文介绍了合成自引导(Synthetic Self-Guidance, SSG)方法,该方法将一个轻量级预测头附加到冻结的预训练像素空间扩散模型上,在采样过程中利用中间预测与最终预测之间的差异作为自引导。研究表明,模型生成的样本足以训练这个预测头,在无需分类器自由引导(CFG)的情况下,多个变体的FID降低了50%以上,并且增强了使用CFG的强基线。

0 人收藏 0 人点赞
#diffusion-models

视觉生成中文本条件化的缩放特性

Hugging Face Daily Papers · 2026-07-31 缓存

本文研究了视觉生成中文本条件化的经验缩放特性,表明收敛的扩散损失随提示中的结构化语言而变化,并引入了改进可扩散性和可提示性的方法。

0 人收藏 0 人点赞
#diffusion-models

通过非梯度向量流的流图学习

arXiv cs.LG · 2026-07-30 缓存

本文介绍了SGFlow,一种为扩散模型学习流图的方法,该方法避免了可逆性约束和通过模型迭代的反向传播,在CIFAR上取得了有竞争力的FID分数,并具有经过证明的稳定点保证。

0 人收藏 0 人点赞
#diffusion-models

Chimera:混合视觉扩散Transformer的设计与Chinchilla式缩放

Hugging Face Daily Papers · 2026-07-30 缓存

本文介绍了Chimera,一种具有原则性缩放方案的混合视觉扩散骨干网络,结合了Kimi Delta Attention、多头潜在注意力和稀疏混合专家,以高效处理长上下文图像和视频生成。它还提出了HeteroP,一种模块级超参数迁移方案,以及Chinchilla式缩放定律,用于训练一个具有20亿激活参数的110亿参数模型。

0 人收藏 0 人点赞
#diffusion-models

视频生成的并行解码(10分钟阅读)

TLDR AI · 2026-07-30 缓存

NVIDIA推出并行解码蒸馏(PDD)技术,用于加速图像和视频生成,能够以更少的神经函数评估在LTX-2.3和Wan2.1-14B等模型上实现高质量输出。

0 人收藏 0 人点赞
#diffusion-models

神经形态扩散语言模型:通过稀疏性和块去噪解决计算与内存瓶颈

arXiv cs.CL · 2026-07-29 缓存

提出神经形态掩码扩散语言模型(N-MDLMs),该模型将块扩散与基于尖峰的神经形态计算相结合,通过利用稀疏性和每次参数访问生成多个token来提高吞吐量和能效,并通过类屋顶线模型进行分析。

0 人收藏 0 人点赞
#diffusion-models

引导拓扑分布以实现架构超材料的统一生成设计

arXiv cs.AI · 2026-07-29 缓存

介绍了GenTO,一种基于扩散模型的框架,通过引导拓扑分布实现架构超材料的统一设计,利用可复用的拓扑先验和实验验证完成多种设计任务。

0 人收藏 0 人点赞
#diffusion-models

PRESTO: 前缀对齐的树状草稿生成用于扩散推测解码

arXiv cs.AI · 2026-07-28 缓存

PRESTO 提出了一种用于扩散推测解码的前缀对齐树状草稿生成框架,在专用扩散草稿模型上实现了高达 1.5 倍的加速,在自推测扩散大语言模型上实现了 1.12 倍的加速。

0 人收藏 0 人点赞
#diffusion-models

针对时间序列预测中不确定性成分的扩散轨迹差分

arXiv cs.AI · 2026-07-28 缓存

本文提出了DiffDiff,一种用于概率时间序列预测的扩散框架,它将可预测性不对称性嵌入到扩散轨迹中,在四个预测跨度的七个基准测试上优于六个扩散基线。

0 人收藏 0 人点赞
#diffusion-models

一体化:生成式建模作为平均场游戏设计

arXiv cs.LG · 2026-07-28 缓存

本文通过一个代价元组将十二种连续时间生成模型统一在平均场博弈论框架下,介绍了MFGLab(一个自动共享训练循环和求解器的PyTorch库),并提出了使用可微熵函数以改善模式覆盖的DI-Flow。

0 人收藏 0 人点赞
#diffusion-models

SeT-Diff:面向HPC遥测和时间序列的语义基础模型

arXiv cs.AI · 2026-07-28 缓存

SeT-Diff提出了首个面向HPC遥测的基础模型,利用基于语义传感器描述的扩散机制,在插补、预测和虚拟传感等任务上实现零样本泛化,重建任务的MAE达到0.0470。

0 人收藏 0 人点赞
#diffusion-models

基于概念的扩散模型反事实视觉解释

arXiv cs.AI · 2026-07-28 缓存

介绍C-VCE,这是一种扩散框架,它在生成模型中内置了一个可解释的概念瓶颈层,从而无需依赖外部噪声鲁棒分类器即可实现人类引导的视觉反事实解释。

0 人收藏 0 人点赞
#diffusion-models

并行解码蒸馏加速图像与视频生成

Hugging Face Daily Papers · 2026-07-28 缓存

并行解码蒸馏(PDD)是一种基于轨迹的蒸馏方法,通过每次网络评估预测多个去噪步骤来加速图像与视频生成,在 LTX-2.3、Wan14B 和 Qwen-Image 等模型上仅需 4-8 次函数评估即可达到最优性能。

0 人收藏 0 人点赞
#diffusion-models

医学图像修复中的扩散模型:挑战、解决方案分类与未来方向

arXiv cs.CL · 2026-07-27 缓存

对基于扩散的医学图像修复方法的系统性综述,涵盖架构、应用、数据集和评估策略,提出了分类方法并识别了挑战(如缺乏标准化基准)。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈