标签
该论文利用OperatorCLIP——一种采用CLIP风格对比对齐、并配备FiLM控制的FNO——研究文本条件化是否真的能引导神经PDE代理模型。研究发现,常量提示的对照组往往与任务文本条件化表现相当甚至更优,且单描述训练会使文本对齐变得不可辨识。
本文研究了视觉生成中文本条件化的经验缩放特性,表明收敛的扩散损失随提示中的结构化语言而变化,并引入了改进可扩散性和可提示性的方法。