flow-models

标签

Cards List
#flow-models

@alec_helbling: 越来越多的研究工作使用连续流模型来处理像语言生成这样的离散问题。一个简单的做法:表示…

X AI KOLs Following ↗ · 2026-09-18 缓存

这条推文讨论了越来越多地使用连续流模型来处理像语言生成这样的离散任务,提出了一种方法来将词汇表示为独热向量,并在连续空间中学习流。

0 人收藏 0 人点赞
#flow-models

Newton Matching 在生成建模中的应用:微调与采样的统一框架

arXiv cs.LG ↗ · 2026-09-10 缓存

本文介绍了 Newton Matching,这是一种用于生成模型微调和采样的统一框架。它通过将学习视为迭代优化过程并利用条件匹配结构,解决了现有方法的局限性。

0 人收藏 0 人点赞
#flow-models

PathGuide:通过在线策略传输对齐的动态无分类器引导

arXiv cs.LG ↗ · 2026-09-01 缓存

PathGuide 将无分类器引导的选择重新表述为基于流的生成模型中的在线策略传输问题,利用连续性方程的弱形式动态优化引导尺度,以提高样本保真度。

0 人收藏 0 人点赞
#flow-models

@r_de_santi: 生成模型无法发现它们无法触及的东西。我们很高兴推出 ActFlow:一个持续预训练方案…

X AI KOLs Timeline ↗ · 2026-08-26 缓存

本文介绍了 ActFlow,这是一种持续预训练方案,旨在扩展流模型和扩散模型的有效设计空间,从而实现分布外生成建模,并为科学发现提供可进化的搜索空间。

0 人收藏 0 人点赞
#flow-models

连续对抗性MeanFlow迁移

arXiv cs.LG ↗ · 2026-08-21 缓存

本文提出MeanFlow-Transfer(MF-T)和连续对抗性MeanFlow(CAMF),以统一预训练扩散和流动模型的适配和加速,实现数据有限新领域的高质量少步生成。

0 人收藏 0 人点赞
#flow-models

GS-Voxel:无需拟合的大规模3DGS生成结构化潜变量

Hugging Face Daily Papers ↗ · 2026-08-18 缓存

GS-Voxel引入了一个无需拟合的框架,将3D Gaussian Splatting重建转换为结构化潜变量,通过流模型和分块推理实现大规模空中3D场景的可扩展生成。

0 人收藏 0 人点赞
#flow-models

CrystalGRPO:面向流基晶体结构预测的目标对齐与覆盖保持强化学习

arXiv cs.LG ↗ · 2026-08-10 缓存

介绍了CrystalGRPO,一个用于流基晶体结构预测的强化学习后训练框架,它对齐目标恢复并保持候选覆盖,在MP-20和MPTS-52基准上提升了Top-1和Top-20性能。

0 人收藏 0 人点赞
#flow-models

LC-GRPO:利用朗之万校正弥合基于流的GRPO训练-推理差距

arXiv cs.LG ↗ · 2026-08-07 缓存

本文介绍了LC-GRPO,一种带有朗之万校正的基于流的GRPO框架,通过将随机训练轨迹与确定性ODE采样对齐来弥合训练与推理之间的差距,从而在SD3.5、FLUX.1-Dev和HunyuanVideo等模型上提升奖励优化效果。

0 人收藏 0 人点赞
#flow-models

FLUX 3 - 现实世界模型:迈向多模态流模型作为视觉智能的骨干

Reddit r/LocalLLaMA ↗ · 2026-07-24

FLUX 3 提出了多模态流模型作为现实世界视觉智能的基础方法,建立在之前的 FLUX 工作之上。

0 人收藏 0 人点赞
#flow-models

MeanFlowNFT: 将前向过程强化学习引入平均速度生成器

Hugging Face Daily Papers ↗ · 2026-07-16 缓存

MeanFlowNFT为平均速度生成器引入了一种前向过程强化学习方法,能够在保持快速少步采样的同时,高效地与人类偏好对齐。实验表明,它在大多数指标上优于先前经过强化学习调优的少步生成器,甚至超越了多步调优的扩散模型。

0 人收藏 0 人点赞
#flow-models

Flow Reasoning Models: 通过迭代自我精化扩展推理能力

arXiv cs.AI ↗ · 2026-06-30 缓存

Flow Reasoning Models (FRMs) 为离散流模型在结构化推理任务上引入了一个训练和测试时扩展框架。通过使用 self-verification 和 self-conditioning,FRMs 在 Sudoku 和 Zebra 谜题上达到了近乎100%的求解率,而所需的迭代次数远少于之前的基准模型。

0 人收藏 0 人点赞
#flow-models

掩码语言流模型

arXiv cs.CL ↗ · 2026-06-29 缓存

本文介绍了掩码语言流模型(MLFMs),该模型将掩码机制引入基于流的语言模型,从而实现连续流进行条件生成,并允许转换预训练的掩码扩散模型。作者提出了一种新型采样器,交替进行连续去噪和离散去掩码,首次证明了基于流的语言模型可以扩展至下游推理和指令遵循任务。

0 人收藏 0 人点赞
#flow-models

FlowBender: 自校正条件流的反馈感知训练

Hugging Face Daily Papers ↗ · 2026-06-18 缓存

FlowBender 是一个闭环框架,通过训练网络利用推理时反馈来纠正对齐误差,从而提升扩散模型和流模型中的约束满足能力,优于传统的监督方法和基于引导的方法。

0 人收藏 0 人点赞
#flow-models

@aditya_oberai: 如果我们把流程步骤视为 RL 动作?结合我们的“流反转”技术,这产生了一个非常简洁且……

X AI KOLs Timeline ↗ · 2026-06-17 缓存

提出将流程步骤视为 RL 动作,并结合“流反转”技术用于流程离线强化学习。

0 人收藏 0 人点赞
#flow-models

强化学习中流策略的测试时梯度引导

Hugging Face Daily Papers ↗ · 2026-06-09 缓存

QGF 是一种强化学习算法,通过使用价值梯度来指导预训练的流策略,在测试时改进策略,避免了训练时的不稳定性,同时保持了竞争力的性能。

0 人收藏 0 人点赞
#flow-models

我们真的在倾斜吗?流模型与扩散模型中奖励引导的机制

arXiv cs.LG ↗ · 2026-06-03 缓存

本文解释了奖励引导的流模型和扩散模型中奖励作弊的根本原因,将其归因于Doob h函数的有限粒子插件估计,并提出了一种奖励阻尼调度方案,在不增加计算成本的情况下校正模态内偏差。

0 人收藏 0 人点赞
#flow-models

约束流优化:基于序列微调的分子设计方法

arXiv cs.LG ↗ · 2026-06-01 缓存

介绍了约束流优化(CFO)框架,该框架通过微调生成流模型,在分子设计中最大化奖励的同时满足约束,具有理论保证和实验验证。

0 人收藏 0 人点赞
#flow-models

面向组合奖励的流模型冲突感知加性引导

arXiv cs.AI ↗ · 2026-05-22 缓存

本文识别了组合奖励下引导流模型中的流形外漂移,并提出冲突感知加性引导(CAR),这是一种轻量级方法,可动态解决梯度冲突,从而无需重新训练即可提升生成保真度。

0 人收藏 0 人点赞
#flow-models

Flow-Direct: 通过非参数引导场实现高效反馈与可复用的流模型引导

arXiv cs.LG ↗ · 2026-05-19 缓存

Flow-Direct 提出了一种用于基于流的生成模型的非参数引导场,该引导场持续累积奖励反馈,提高了反馈效率,并使得收集的样本可重复用于引导多目标生成,无需额外的奖励评估。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈