diffusion-models

标签

Cards List
#diffusion-models

针对时间序列预测中不确定性成分的扩散轨迹差分

arXiv cs.AI · 2026-07-28 缓存

本文提出了DiffDiff,一种用于概率时间序列预测的扩散框架,它将可预测性不对称性嵌入到扩散轨迹中,在四个预测跨度的七个基准测试上优于六个扩散基线。

0 人收藏 0 人点赞
#diffusion-models

一体化:生成式建模作为平均场游戏设计

arXiv cs.LG · 2026-07-28 缓存

本文通过一个代价元组将十二种连续时间生成模型统一在平均场博弈论框架下,介绍了MFGLab(一个自动共享训练循环和求解器的PyTorch库),并提出了使用可微熵函数以改善模式覆盖的DI-Flow。

0 人收藏 0 人点赞
#diffusion-models

SeT-Diff:面向HPC遥测和时间序列的语义基础模型

arXiv cs.AI · 2026-07-28 缓存

SeT-Diff提出了首个面向HPC遥测的基础模型,利用基于语义传感器描述的扩散机制,在插补、预测和虚拟传感等任务上实现零样本泛化,重建任务的MAE达到0.0470。

0 人收藏 0 人点赞
#diffusion-models

基于概念的扩散模型反事实视觉解释

arXiv cs.AI · 2026-07-28 缓存

介绍C-VCE,这是一种扩散框架,它在生成模型中内置了一个可解释的概念瓶颈层,从而无需依赖外部噪声鲁棒分类器即可实现人类引导的视觉反事实解释。

0 人收藏 0 人点赞
#diffusion-models

并行解码蒸馏加速图像与视频生成

Hugging Face Daily Papers · 2026-07-28 缓存

并行解码蒸馏(PDD)是一种基于轨迹的蒸馏方法,通过每次网络评估预测多个去噪步骤来加速图像与视频生成,在 LTX-2.3、Wan14B 和 Qwen-Image 等模型上仅需 4-8 次函数评估即可达到最优性能。

0 人收藏 0 人点赞
#diffusion-models

医学图像修复中的扩散模型:挑战、解决方案分类与未来方向

arXiv cs.CL · 2026-07-27 缓存

对基于扩散的医学图像修复方法的系统性综述,涵盖架构、应用、数据集和评估策略,提出了分类方法并识别了挑战(如缺乏标准化基准)。

0 人收藏 0 人点赞
#diffusion-models

Comfy-Org/Mage-Flow

Hugging Face Models Trending · 2026-07-24 缓存

来自微软Mage-Flow模型的ComfyUI重新打包模型文件,包含扩散模型、文本编码器和VAE。

0 人收藏 0 人点赞
#diffusion-models

从原子到熵:凸域中扩散训练的最优噪声分配

arXiv cs.LG · 2026-07-24 缓存

本文构建了一个用于扩散模型训练中噪声水平最优分配的统计框架,表明在耦合机制下最优调度是原子化的,而在独立学习机制下遵循平方根熵代理,实验证实了这些预测。

0 人收藏 0 人点赞
#diffusion-models

用于减少扩散模型曝光偏差的频谱先验

Hugging Face Daily Papers · 2026-07-24 缓存

本文提出频谱对齐(SPA),一种轻量级的引导方法,通过校准中间预测的功率谱来减少扩散模型中的曝光偏差,在像素空间、潜在空间和流匹配模型上均展现出持续改进,且计算开销极小。

0 人收藏 0 人点赞
#diffusion-models

将 Nunchaku 4-bit 扩散推理引入 Diffusers

Hugging Face Blog · 2026-07-23 缓存

Nunchaku 是一款基于 SVDQuant 的 4-bit 扩散推理引擎,现已原生集成到 Hugging Face Diffusers 中,通过简单的 from_pretrained() 调用即可快速、节省内存地加载量化扩散模型。

0 人收藏 0 人点赞
#diffusion-models

Diffusion模型在评分函数不敏感的情况下仍能准确恢复混合权重

arXiv cs.LG · 2026-07-20 缓存

本文解决了扩散模型在评分函数对混合权重不敏感时仍能准确恢复混合权重的悖论,引入了扩散评分敏感性指数(DSSI),并表明中间噪声级别为权重恢复提供了信息性信号。

0 人收藏 0 人点赞
#diffusion-models

DiFA:扩散模型的推理时前向过程对齐方法

Hugging Face Daily Papers · 2026-07-20 缓存

提出DiFA,一种无需训练的框架,将推理时的数据预测优化重新定义为使用卡尔曼滤波的序列状态估计,显著提升了CIFAR-10和ImageNet上的生成保真度。

0 人收藏 0 人点赞
#diffusion-models

使用 NVIDIA NeMo Automodel 和 🤗 Diffusers 大规模微调视频和图像模型

Hugging Face Blog · 2026-07-17 缓存

NVIDIA NeMo Automodel 与 Hugging Face Diffusers 集成,支持对扩散模型进行可扩展的分布式微调,用于图像和视频生成,支持的模型包括 FLUX.1-dev、Wan 2.1 和 HunyuanVideo。

0 人收藏 0 人点赞
#diffusion-models

FVAttn: 用于视频生成的自适应稀疏注意力与运行时负载均衡

Hugging Face Daily Papers · 2026-07-17 缓存

FVAttn是一种无需训练的稀疏注意力系统,利用运行时负载均衡提升多GPU序列并行下自适应稀疏注意力的分布式执行效率。在基于步骤蒸馏的Wan2.2 I2V上,相比于FlashAttention,注意力速度提升最高达4.41倍,推理速度提升2.11倍,同时保持有竞争力的视频质量。

0 人收藏 0 人点赞
#diffusion-models

离散扩散模型:从分词到生成的统一框架

arXiv cs.LG · 2026-07-16 缓存

本文介绍了一种离散扩散模型的统一概念框架,通过分词、状态空间构建来分析其设计空间,并强调了训练、推理和扩展中的权衡。

0 人收藏 0 人点赞
#diffusion-models

并行图像理解与生成:自校正耦合马尔可夫跳跃过程

arXiv cs.LG · 2026-07-16 缓存

介绍了自校正耦合马尔可夫跳跃过程(SC-CMJP)及一种无需训练的采样器CO2Jump,用于并行图像理解与生成,在编辑、迷宫和nonogram任务上实现了最先进的联合性能。

0 人收藏 0 人点赞
#diffusion-models

@GoogleResearch:什么驱动了扩散模型的创造力(即其生成新数据而非记忆的能力)?今天我们…

X AI KOLs Timeline · 2026-07-15 缓存

Google Research 表明,扩散模型的创造力是神经网络正则化导致得分平滑和插值的数学结果,揭开了它们能够生成新数据而不仅仅是记忆的能力的神秘面纱。

0 人收藏 0 人点赞
#diffusion-models

ReDiTT: 面向异步时间序列的检索增强条件扩散Transformer

arXiv cs.LG · 2026-07-15 缓存

本文提出了 ReDiTT,一种面向异步时间序列预测的检索增强条件扩散Transformer。该模型检索结构相似的潜在序列作为参考条件,以改进长时域预测和样本多样性,在七个真实数据集上取得了最先进的性能。

0 人收藏 0 人点赞
#diffusion-models

学习离散化:基于扩散的自适应网格与谱引导

arXiv cs.LG · 2026-07-15 缓存

本文提出了一种基于扩散的框架,用于学习条件于观测到的偏微分方程动力学的自适应网格离散化,利用谱引导和物理约束在需要的地方分配分辨率。该方法在五种偏微分方程场景中取得了具有竞争力或更优的性能。

0 人收藏 0 人点赞
#diffusion-models

扩散模型的守恒律

arXiv cs.LG · 2026-07-14 缓存

本文利用广义外信息传递(GEXIT)函数为扩散模型建立了守恒律,表明交叉熵可以表示为沿噪声路径的局部信息论导数的积分,从而统一了离散和连续扩散的似然表征。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈