fr

Please fill in your name

Mobile phone format error

Veuillez entrer le téléphone

Veuillez entrer le nom de votre entreprise

Veuillez entrer votre e-mail professionnel

Veuillez entrer l'exigence de données

Successful submission! Thank you for your support.

Format error, Please fill in again

Confirm

L'exigence de données ne peut pas faire moins de 5 mots et ne peut pas être constituée uniquement de chiffres

Jeux de données OCR

Améliorez instantanément les performances de votre modèle IA avec des Jeux de données prêts à l’emploi de haute qualité.

Type de données

Tout
28
Document
3
Scénario général
13
Écriture manuscrite
15
Image internet
1
Facture
3
Autres
4
Sujet d’examen
1
Tableau
1

Langue

Tout
28
Chinois
6
Anglais
4
Hindi
4
Japonais
7
Coréen
7
Autres
20
Vietnamien
4

Données de 14 980 images OCR PPT en 8 langues

PPT, OCR, meeting room, conference room,different photographic angles, different photographic distances, different light conditions,line-level quadrilateral bounding box annotation and transcription for the texts
PPT OCR salle de réunion salle de conférence différents angles de prise de vue différentes distances de prise de vue différentes conditions des lumières annotation et transcription des textes à l'aide d'un cadre rectangulaire de niveau ligne

Données OCR de 222 289 scènes naturelles en chinois

Les scènes d'acquisition des données OCR de 222 289 scènes naturelles en chinois couvrent les scènes intérieures et extérieures. La diversité des données comprend une variété de scènes et plusieurs angles de prise de vue. En termes d'annotation, l'annotation au niveau de la ligne, l'annotation au niveau du mot, l'annotation au niveau du caractère et la transcription du contenu sont effectuées sur les caractères chinois de l'image. Cet ensemble de données OCR de scènes naturelles en chinois peut être utilisé pour les tâches d'OCR de scènes naturelles.
OCR Scènes naturelles Annotation au niveau de la ligne Annotation au niveau du mot Annotation au niveau du caractère Transcription des textes

5 156 images OCR manuscrites de formules mathématiques

Ce corpus comprend 5 156 images manuscrites de formules mathématiques. Les supports utilisés incluent du papier A4, du papier quadrillé, du papier ligné et des tableaux blancs. Il couvre une diversité de supports, de types de formules et d’angles de capture (notamment en vision frontale et en contre-plongée). Ce jeu de données est parfaitement adapté aux tâches d’OCR appliquées à l’écriture manuscrite de formules mathématiques.
Formules mathématiques écriture manuscrite OCR papier A4 papier quadrillé papier ligné tableau blanc papier A4 papier quadrillé papier ligné tableau blanc angle en contre-plongée angle à hauteur des yeux

8 604 images OCR de scènes naturelles en arabe

Ce corpus OCR en langue arabe se compose de 8 604 images capturées dans une grande variété de scènes naturelles, sous différents angles de prise de vue. L’annotation inclut des encadrements quadrilatéraux et polygonaux au niveau des lignes de texte, accompagnés de transcriptions précises. Cette base de données est spécifiquement conçue pour les tâches de reconnaissance optique de caractères (OCR) en arabe.
Données OCR en arabe conversion de contenu OCR données OCR ensemble de données OCR étiquetage OCR collecte de données OCR traitement des données OCR données de conversion OCR

57 645 images OCR de textes verticaux dans des environnements réels

Ensemble de 57 645 images OCR de textes en disposition verticale, prises dans divers environnements tels que les rues, enseignes, panneaux publicitaires, affiches, décors artistiques ou couvertures de magazines. Les textes sont majoritairement en chinois, avec une minorité en anglais. L’annotation comprend des boîtes de type polygone ou parallélogramme au niveau des colonnes, ainsi que la transcription correspondante. Ce corpus est conçu pour le traitement OCR des textes verticaux complexes.
Données OCR de scènes à texte vertical données d’images OCR données OCR ensemble de données OCR annotation OCR acquisition OCR traitement des données OCR données OCR réécrites

Données OCR en viêtnamien avec annotation et transcription de 4 995 images

Vietnamese, OCR, document images, Internet images, natural scenes, multiple angles, different light conditions, quadrilateral bounding box annotation, line-level transcription for the texts, column-level transcription for the texts
Vietnamien OCR images de documents images Internet scènes naturelles angles multiples conditions des lumières différentes annotation de cadres rectangulaires transcription au niveau des lignes pour les textes transcription au niveau des colonnes pour les textes

Données OCR en hindi avec annotation et transcription de 3 506 images

Hindi, OCR, document images, Internet images, natural scenes, multiple angles, different light conditions, quadrilateral bounding box annotation, line-level transcription for the texts, column-level transcription for the texts
Hindi OCR images de documents images Internet scènes naturelles angles multiples conditions des lumières différentes annotation de cadres rectangulaires transcription au niveau des lignes pour les textes transcription au niveau des colonnes pour les textes

Données d'écriture manuscrite japonaise et coréenne de 100 personnes

Données d'écriture manuscrite japonaise et coréenne de 100 personnes, un total de 100 personnes ont saisi les données, 50 Japonais, 49 Coréens et 1 Afghan. Le corpus d'écriture est différent pour chaque personne. Cette diversité de données comprend plusieurs appareils de téléphonie téléphone portable et différents corpus. Cet ensemble de données d'écriture manuscrite japonaise et coréenne peut être utilisé pour la reconnaissance OCR des polices d'écriture manuscrite japonaises et coréennes.
Japonais Coréen Écriture manuscrite OCR Trace d'écriture manuscrite

5 147 données OCR d'écriture manuscrite japonaise

5 147 images d'écriture manuscrite japonaise sur papier A4, papier ligné/quadrillé, etc. Capture : Smartphone, hauteur des yeux. Contenu : rédactions, poèmes, prose, informations, histoires, etc. Annotation : Boîte quadrilatère au niveau de la ligne, transcription. Utilisable pour l'OCR d'écriture manuscrite japonaise.
Japonais écriture manuscrite OCR annotation au niveau de la ligne transcription ligne par ligne

loading

Personnalisez vos données dès maintenant

Pourquoi choisir des jeux de données prêts à l'emploi

  • Droits d'auteur

    Droits d'auteur

    Droits d’auteur clairs vérifiables à tout moment
  • Sécurité

    Sécurité

    Correctement autorisés Sécurisés à l’usage
  • Professionnel

    Professionnel

    Conçus et produits par des experts en données d’IA
  • Diversité

    Diversité

    Collectés à partir de diverses scènes réelles
  • Rentabilité

    Rentabilité

    Plus rentable Que les données personnalisées
  • Efficacité

    Efficacité

    Prêt à l'emploi, livré en quelques secondes
f93aea3d-7341-4f21-9396-a643fb90d584