@drfeifei: 我非常兴奋于这个适用于大规模生成模型新时代的视觉生成新基准数据集…
摘要
介绍GPIC(Giant Permissive Image Corpus),一个大规模数据集,包含1亿个VLM标注的图像-文本对用于训练,以及100万个用于基准测试的对,完全许可用于研究和商业用途。
我非常兴奋于这个适用于大规模生成模型新时代的视觉生成新基准数据集!🤩
查看缓存全文
缓存时间: 2026/05/29 21:56
我对这个全新的视觉生成基准数据集感到非常兴奋,它非常适合现代大规模生成模型的时代!🤩
Keshigeyan Chandrasegaran (@keshigeyan): 1/ 介绍 GPIC:一个用于视觉生成的巨型宽松许可图像语料库及基准!
🚀 1亿条经 VLM 标注的图像-文本训练对 📊 100万条图像-文本基准测试对 🖼️ 约28万亿像素 🤗 集中托管 ✅ 完全许可用于研究 + 商业用途
数据集,
相似文章
@jcjohnss: GPIC 应该成为生成建模的新标准基准。在 GPIC 上训练 1 个 epoch 的成本相当于在 ImageNet 上训练 100 个 epo…
GPIC 是一个新的大规模图像-文本数据集和生成建模基准,据称比 ImageNet 高效得多,并且是现实世界问题的更好代理,具有完全许可的研究和商业使用许可。
PixVerve:利用大规模高质量数据集推动原生UHR图像生成至100MP
本文介绍了PixVerve-95K,一个包含95K张超高清(100MP)图像及标注的大规模开源数据集,以及PixVerve-Bench,一个用于评估原生100MP文本到图像生成的基准,将现有T2I模型扩展到前所未有的分辨率。
SciIR:用于科学图像推理生成的大规模训练数据集与基准
SciIR 引入了大规模数据集 SciIR-82k 和基准 SciIR-Bench,以增强文本到图像模型中的科学推理能力,对 Qwen 进行微调后取得了显著的性能提升。
一个包含52个文本到图像模型评估的数据集 [P]
一个新的基准数据集和评估方法已经发布,用于评估52个文本到图像模型,包括结果、排行榜和图库,以测试在复杂提示上的表现。
全新 ChatGPT 图像模型树立逼真图像生成新标杆
OpenAI 发布全新 ChatGPT 图像模型,为逼真图像生成设立新基准。