fr

Please fill in your name

Mobile phone format error

Veuillez entrer le téléphone

Veuillez entrer le nom de votre entreprise

Veuillez entrer votre e-mail professionnel

Veuillez entrer l'exigence de données

Successful submission! Thank you for your support.

Format error, Please fill in again

Confirm

L'exigence de données ne peut pas faire moins de 5 mots et ne peut pas être constituée uniquement de chiffres

Jeux de données OCR

Améliorez instantanément les performances de votre modèle IA avec des Jeux de données prêts à l’emploi de haute qualité.

Type de données

Tout
27
Document
3
Scénario général
11
Écriture manuscrite
16
Image internet
1
Facture
3
Autres
4
Sujet d’examen
1
Tableau
1

Langue

Tout
27
Chinois
5
Anglais
5
Hindi
4
Japonais
7
Coréen
6
Autres
19
Vietnamien
4

9 574 images, 8 langues : Données OCR d'écriture manuscrite sur tableau blanc/tableau noir

Données OCR d'écriture manuscrite pour 9 574 images de tableaux noirs/tableaux blancs en 8 langues : Anglais, Espagnol, Portugais, Français, Allemand, Japonais, Italien, Néerlandais. Diversité : environnements, supports, langues, angles de prise de vue (hauteur des yeux, aérien, contre-plongée). Annotation : Boîte quadrilatère/polygone au niveau de la ligne, transcription. Utilisable pour l'OCR d'écriture manuscrite.
Écriture manuscrite OCR tableau noir tableau blanc tableau vert

Données OCR en viêtnamien avec annotation et transcription de 4 995 images

Vietnamese, OCR, document images, Internet images, natural scenes, multiple angles, different light conditions, quadrilateral bounding box annotation, line-level transcription for the texts, column-level transcription for the texts
Vietnamien OCR images de documents images Internet scènes naturelles angles multiples conditions des lumières différentes annotation de cadres rectangulaires transcription au niveau des lignes pour les textes transcription au niveau des colonnes pour les textes

500 000 images OCR de scènes naturelles et de documents multi-pays

Ce jeu de données comprend 500 000 images issues de documents ou de scènes naturelles, couvrant 20 langues telles que le chinois traditionnel, le japonais, le coréen, l’indonésien, le malais, le thaï, le vietnamien ou encore le polonais. Grâce à sa diversité linguistique et contextuelle, ce corpus constitue une base robuste pour le développement de systèmes OCR multilingues performants.
Scènes naturelles documents OCR

9 497 images, 10 types de formulaires, Données OCR

9 497 images de 10 types de formulaires, annotées avec des boîtes de délimitation rectangulaires. Utilisable pour la reconnaissance de formulaires.
OCR formulaires

Données OCR en hindi avec annotation et transcription de 3 506 images

Hindi, OCR, document images, Internet images, natural scenes, multiple angles, different light conditions, quadrilateral bounding box annotation, line-level transcription for the texts, column-level transcription for the texts
Hindi OCR images de documents images Internet scènes naturelles angles multiples conditions des lumières différentes annotation de cadres rectangulaires transcription au niveau des lignes pour les textes transcription au niveau des colonnes pour les textes

Données de copies d'examens de mathématiques du primaire de 17 561 images

Primary School Mathematics Papers, OCR, multiple types of questions (Vertical calculation, Horizontal calculation, Recursive calculation, Fraction, Solving equation, etc.), multiple types of test papers (math workbooks, test papers, competition test questions, etc.), multiple grades
Examens de mathématiques du primaire OCR types de questions multiples (calcul vertical calcul horizontal calcul récursif fractions résolution d'équations etc.) types d'examens multiples (cahiers d'exercices de mathématiques examens questions d'examens de concours etc.) niveaux scolaires multiples

14 511 images OCR manuscrites en anglais

Corpus manuscrit OCR en langue anglaise contenant 14 511 images. Les supports papier incluent des feuilles A4, du papier ligné et du papier à lettres anglais. Les les images ont été saisies à l’aide de smartphones, selon un angle de vue perpendiculaire. Elles couvrent des contenus variés : essais, poèmes, récits, articles de presse et histoires. Chaque ligne de texte a été annotée avec une boîte quadrilatérale et une transcription précise ligne par ligne. Ce corpus est conçu pour l’entraînement et à l’évaluation de modèles OCR pour l’écriture manuscrite anglaise.
Écriture manuscrite anglaise OCR

104 320 images OCR de scènes naturelles – coréen et hindi

Ce corpus de 104 320 images OCR en contextes naturels coréen et hindi comprend des scènes telles que des emballages de produits, affiches, billets, panneaux d'information, menus et enseignes de bâtiments. La diversité des données repose sur la variété des environnements, angles de prise de vue et conditions lumineuses. Les langues représentées sont le coréen, l'hindi, ainsi qu'un faible pourcentage d’anglais. Les annotations sont réalisées à deux niveaux : au niveau ligne et colonne, avec des encadrements polygonaux (ou quadrilatères/rectangles), transcription textuelle et étiquetage linguistique. Ce jeu de données est parfaitement adapté aux tâches OCR sur scènes naturelles en coréen et hindi.
Coréen hindi données OCR scène naturelle données de translittération OCR

Données OCR en anglais dans des scènes naturelles de 71 535 images

English, natural scenes, OCR, multiple scenes, multiple photographic angles, multiple light conditions, line-level & word-level & character-level bounding box, text transcription
Anglais scènes naturelles OCR scènes multiples angles photographiques multiples conditions des lumières multiples cadre de sélection au niveau de la ligne du mot et du caractère transcription de texte

loading

Personnalisez vos données dès maintenant

Pourquoi choisir des jeux de données prêts à l'emploi

  • Droits d'auteur

    Droits d'auteur

    Droits d’auteur clairs vérifiables à tout moment
  • Sécurité

    Sécurité

    Correctement autorisés Sécurisés à l’usage
  • Professionnel

    Professionnel

    Conçus et produits par des experts en données d’IA
  • Diversité

    Diversité

    Collectés à partir de diverses scènes réelles
  • Rentabilité

    Rentabilité

    Plus rentable Que les données personnalisées
  • Efficacité

    Efficacité

    Prêt à l'emploi, livré en quelques secondes
8f6fc8da-4f9b-4992-b368-f995164a22ec