image-generation

标签

Cards List
#image-generation

SpheRoPE:基于球形RoPE的零样本无优化360度全景生成

Hugging Face Daily Papers · 2026-06-30 缓存

本文介绍了SpheRoPE,一个零样本且无需优化的框架,它将球形先验注入预训练的扩散变换器中,用于生成360度全景图像和视频,无需重新训练即可克服拓扑约束。

0 人收藏 0 人点赞
#image-generation

DataEvolver: 文本丰富图像生成的自进化多智能体数据构建

Hugging Face Daily Papers · 2026-06-30 缓存

DataEvolver是一个自进化多智能体框架,利用被拒绝样本的反馈迭代提升文本丰富图像生成的数据质量,在使用PixArt-alpha的TextScenesHQ上实现85.3%的OCR-F1提升,在LongTextBench上实现35.3%的提升。

0 人收藏 0 人点赞
#image-generation

Krea-2-Turbo 图像模型 - 易于完全无审查,而且还能编辑图像!

Reddit r/LocalLLaMA · 2026-06-29

Krea-2-Turbo 是一个本地 AI 图像生成模型,能在约 3 秒内生成高质量图像。通过提示重新平衡可以轻松实现无审查,尽管它被宣传为仅文本到图像,但实际上也支持通过遮罩进行图像编辑。

0 人收藏 0 人点赞
#image-generation

Gemini个性化AI图像生成现面向美国用户免费开放

TechCrunch AI · 2026-06-29 缓存

Google的Gemini应用现面向所有美国用户免费提供个性化AI图像生成功能,可根据Google账户数据中的用户偏好生成图像。

0 人收藏 0 人点赞
#image-generation

eric-venti-seeds/Sun-Direction-Lora-Flux2Klein9B

Hugging Face Models Trending · 2026-06-29 缓存

一个用于 Flux 2 Klein 9B 的 LoRA 模型,通过使用参考球图像和阴天中间步骤,使能够在室外图像中控制太阳方向。包含一个自定义的 ComfyUI 节点,用于渲染球体光源参考。

0 人收藏 0 人点赞
#image-generation

NormGuard:流匹配强化学习中保持奖励的范数约束

arXiv cs.LG · 2026-06-29 缓存

本文提出了NormGuard,一种范数预算正则化器,用于在流匹配生成模型的强化学习后训练过程中抑制与奖励无关的速度范数膨胀,从而在不牺牲奖励的情况下改善感知图像质量。

0 人收藏 0 人点赞
#image-generation

面向扩散模型的类频率引导噪声调度

arXiv cs.LG · 2026-06-29 缓存

本文提出了一种面向扩散模型的类频率引导噪声调度,为低频类别分配更大尺度的噪声,以改善在不平衡数据集上的生成质量,相较于基线方法取得了显著提升。

0 人收藏 0 人点赞
#image-generation

PhotoQuilt: 无需训练的任意分辨率照片马赛克生成,通过自举分块去噪

Hugging Face Daily Papers · 2026-06-29 缓存

PhotoQuilt 是一个无需训练的框架,通过结合全局布局构图与潜空间中的独立分块生成,生成高分辨率照片马赛克,克服了扩散模型在平衡局部细节与全局结构上的局限性。

0 人收藏 0 人点赞
#image-generation

ilkerzgi/fal-Krea-2-Style-LoRAs

Hugging Face Models Trending · 2026-06-26 缓存

一系列适用于Krea 2的多种风格LoRA(低秩适应)集合,包含如Acid Horror Manga、Airy Anime Watercolor等风格,托管于Hugging Face。

0 人收藏 0 人点赞
#image-generation

Parallel Rollout Approximation 用于像素空间自回归图像生成

Hugging Face Daily Papers · 2026-06-26 缓存

Parallel Rollout Approximation (PRA) 通过使用低维中间状态和并行训练改进了像素空间自回归图像生成,在ImageNet-1K生成任务上取得了新的最先进结果。

0 人收藏 0 人点赞
#image-generation

Un-0:利用耦合振荡器生成图像

Hacker News Top · 2026-06-25 缓存

Un-0 是一个由模拟耦合振荡器系统驱动的图像生成器,在 ImageNet 64×64 上达到了 6.74 的 FID,与早期的传统方法相当。该项目开源,旨在展示在物理基板上实现节能人工智能的可能性。

0 人收藏 0 人点赞
#image-generation

Databricks前AI负责人认为可将AI能耗降低1000倍

TechCrunch AI · 2026-06-25 缓存

由Databricks前AI负责人Naveen Rao领导的Unconventional AI公司声称,其基于振荡器的计算机架构可将AI推理能耗降低多达1000倍,并已通过其首个图像生成模型Un0进行了验证。

0 人收藏 0 人点赞
#image-generation

@NaveenGRao: 今天我们介绍来自 @unconvAI 的 Un-0:首个以物理学作为计算原语构建的大规模生成模型……

X AI KOLs Timeline · 2026-06-25 缓存

Unconventional AI 介绍了 Un-0,这是首个以物理学作为计算原语构建的大规模生成模型,使用耦合振荡器生成具有竞争品质的图像,同时承诺大幅提升能效。

0 人收藏 0 人点赞
#image-generation

Qwen-Image-2.0-RL 技术报告

Hugging Face Daily Papers · 2026-06-25 缓存

本技术报告介绍了 Qwen-Image-2.0-RL,这是一个基于强化学习与人类反馈及在策略蒸馏的后训练流程,旨在提升图像生成与编辑任务中的视觉质量和指令遵循能力。

0 人收藏 0 人点赞
#image-generation

LISA: 面向视觉条件可控生成的似然分数对齐

Hugging Face Daily Papers · 2026-06-25 缓存

本文介绍了LISA,一种正则化方法,它将侧网络的中间特征与近似的似然分数对齐,以提高基于分数的生成模型中视觉条件可控生成的训练效率和质量。

0 人收藏 0 人点赞
#image-generation

Qwen-Image-Agent:弥合真实图像生成中的上下文差距

Hugging Face Daily Papers · 2026-06-25 缓存

Qwen-Image-Agent 提出了一种统一的代理框架,通过整合规划、推理、搜索和记忆机制,解决了文本到图像生成中的上下文差距问题。该框架引入了 IA-Bench 进行评估,并取得了最先进的性能。

0 人收藏 0 人点赞
#image-generation

基于信息论的无分类器引导与自适应调度优化

arXiv cs.LG · 2026-06-24 缓存

提出了一种基于信息论的框架,用于优化扩散模型中的无分类器引导调度,在ImageNet和COCO基准上实现了条件一致性与样本多样性之间更优的权衡。

0 人收藏 0 人点赞
#image-generation

DiffusionBench:迈向生成式扩散变换器的全面评估

Hacker News Top · 2026-06-24 缓存

介绍了DiffusionBench,这是一个统一的基准,用于全面评估生成式扩散变换器,支持多种生成任务,并提供标准化的训练与评估。

0 人收藏 0 人点赞
#image-generation

MIMFlow: 集成掩码图像建模与归一化流的端到端图像生成

Hugging Face Daily Papers · 2026-06-24 缓存

MIMFlow 集成了掩码图像建模与归一化流,用于端到端图像生成,在 ImageNet 256x256 上实现了 2.50 的 FID,且使用的 token 数量比标准模型少 50%。

0 人收藏 0 人点赞
#image-generation

Krea 2 技术报告 (59分钟阅读)

TLDR AI · 2026-06-24 缓存

Krea 2 是一系列用于创意图像生成的基础模型,构建于大规模数据基础设施和多阶段训练流程之上。它引入了提示扩展器和风格参考系统,以提高可操控性并实现创意探索。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈