off-the-shelf datasets, dataset provider logo

fr

300 millions d'ensembles de descriptions d'images de haute qualité

multimodal
image
description

Un ensemble de 300 millions d’images, chacune accompagnée d’une légende. Toutes les images proviennent de photographes professionnels et sont protégées par des licences officielles. La majorité des descriptions sont en anglais, tandis qu’une petite fraction est rédigée en chinois.

Volume des données
300 millions d’images, chacune associée à une seule description.Bibliothèque complète de près de 300 millions d’images (photos + vecteurs) ; environ 100 millions d’images utilisables pour l’IA générative, hors images éditoriales
Format des données
Formats d’images : .jpg, .png, .svg ; descriptions au format .txt
Contenu des données
Images originales publiées par leurs auteurs, avec descriptions correspondantes
Type d’image
Photographies et illustrations vectorielles couvrant de multiples scènes
Résolution d’image
Résolution 4K et plus
Langue utilisée pour la description
Principalement en anglais, très rarement en chinois

e1a232b0-561e-4129-bb5d-962ff8e256ee

0a1b6c72-cf7c-477d-8d49-f14aebab67e8