@drfeifei: 我非常兴奋于这个适用于大规模生成模型新时代的视觉生成新基准数据集…
摘要
介绍GPIC(Giant Permissive Image Corpus),一个大规模数据集,包含1亿个VLM标注的图像-文本对用于训练,以及100万个用于基准测试的对,完全许可用于研究和商业用途。
查看缓存全文
缓存时间: 2026/05/29 21:56
我对这个全新的视觉生成基准数据集感到非常兴奋,它非常适合现代大规模生成模型的时代!🤩
Keshigeyan Chandrasegaran (@keshigeyan): 1/ 介绍 GPIC:一个用于视觉生成的巨型宽松许可图像语料库及基准!
🚀 1亿条经 VLM 标注的图像-文本训练对 📊 100万条图像-文本基准测试对 🖼️ 约28万亿像素 🤗 集中托管 ✅ 完全许可用于研究 + 商业用途
数据集,
相似文章
@jcjohnss: GPIC 应该成为生成建模的新标准基准。在 GPIC 上训练 1 个 epoch 的成本相当于在 ImageNet 上训练 100 个 epo…
GPIC 是一个新的大规模图像-文本数据集和生成建模基准,据称比 ImageNet 高效得多,并且是现实世界问题的更好代理,具有完全许可的研究和商业使用许可。
PixVerve:利用大规模高质量数据集推动原生UHR图像生成至100MP
本文介绍了PixVerve-95K,一个包含95K张超高清(100MP)图像及标注的大规模开源数据集,以及PixVerve-Bench,一个用于评估原生100MP文本到图像生成的基准,将现有T2I模型扩展到前所未有的分辨率。
SciIR:用于科学图像推理生成的大规模训练数据集与基准
SciIR 引入了大规模数据集 SciIR-82k 和基准 SciIR-Bench,以增强文本到图像模型中的科学推理能力,对 Qwen 进行微调后取得了显著的性能提升。
全新 ChatGPT 图像模型树立逼真图像生成新标杆
OpenAI 发布全新 ChatGPT 图像模型,为逼真图像生成设立新基准。
DataComp-VLM:面向视觉语言模型的改进型开放数据集
本文介绍了DataComp-VLM(DCVLM),这是一个用于评估视觉语言模型数据策展策略的综合基准。作者发现,数据混合而非数据过滤能显著提升性能,由此产生的DCVLM-Baseline数据集在33项下游任务中取得了最先进的结果。