跳到正文
北京时间
原文
Fei-Fei Li· @drfeifei · X·· 2026-05-30精选AI 评分83
AI 导读

我对这个适用于大规模生成模型新时代的视觉生成基准数据集感到非常兴奋!🤩

推荐理由

李飞飞都来站台,这个数据集不简单。完全允许商业用途是关键,对做视觉生成的团队来说,终于有了一个不用再为版权头疼的超级训练库。

正文 · AI 翻译

我非常兴奋能看到这个针对视觉生成的全新基准数据集,它非常适合当前大规模生成模型时代的需求!🤩

引用Keshigeyan Chandrasegaran@keshigeyan
1/ 介绍 GPIC:一个用于视觉生成的巨型宽松许可图像语料库和基准! 🚀1 亿 VLM 标注的图像-文本对用于训练 📊100 万图像-文本对用于基准测试 🖼️约 28 万亿像素 🤗集中托管 ✅完全允许用于研究 + 商业用途 数据集、基准和模型🧵👇 与 @KyleSargentAI 共同领导
原文

1/ Introducing GPIC: a Giant Permissive Image Corpus and benchmark for visual generation! 🚀100M VLM-captioned image-text pairs for training 📊1M image-text pairs for benchmarking 🖼️~28 trillion pixels 🤗Centrally Hosted ✅Fully permissive for research + commercial use Dataset, benchmark and models🧵👇 Co-led with @KyleSargentAI

在 X 查看被引用的帖子

来源:Fei-Fei Li · x.com