@drfeifei: 我非常兴奋于这个适用于大规模生成模型新时代的视觉生成新基准数据集…

X AI KOLs Following 论文

摘要

介绍GPIC(Giant Permissive Image Corpus),一个大规模数据集,包含1亿个VLM标注的图像-文本对用于训练,以及100万个用于基准测试的对,完全许可用于研究和商业用途。

我非常兴奋于这个适用于大规模生成模型新时代的视觉生成新基准数据集!🤩
查看原文
查看缓存全文

缓存时间: 2026/05/29 21:56

我对这个全新的视觉生成基准数据集感到非常兴奋,它非常适合现代大规模生成模型的时代!🤩

Keshigeyan Chandrasegaran (@keshigeyan): 1/ 介绍 GPIC:一个用于视觉生成的巨型宽松许可图像语料库及基准!

🚀 1亿条经 VLM 标注的图像-文本训练对 📊 100万条图像-文本基准测试对 🖼️ 约28万亿像素 🤗 集中托管 ✅ 完全许可用于研究 + 商业用途

数据集,

相似文章

DataComp-VLM:面向视觉语言模型的改进型开放数据集

Hugging Face Daily Papers

本文介绍了DataComp-VLM(DCVLM),这是一个用于评估视觉语言模型数据策展策略的综合基准。作者发现,数据混合而非数据过滤能显著提升性能,由此产生的DCVLM-Baseline数据集在33项下游任务中取得了最先进的结果。