fr

Please fill in your name

Mobile phone format error

Veuillez entrer le téléphone

Veuillez entrer le nom de votre entreprise

Veuillez entrer votre e-mail professionnel

Veuillez entrer l'exigence de données

Successful submission! Thank you for your support.

Format error, Please fill in again

Confirm

L'exigence de données ne peut pas faire moins de 5 mots et ne peut pas être constituée uniquement de chiffres

Jeux de données d’entraînement de haute qualité

Améliorez les performances de vos modèles d’IA grâce à nos jeux de données d’entraînement prêts à l’emploi et de haute qualité.

Langue

Tout

Type de données

Tout

262 Heures de Données Vocales d'Enfants Japonais

411 Locuteurs – Environ 262 Heures de Données Vocales d'Enfants Japonais, comprenant 147 668 énoncés scriptés. Les locuteurs sont des enfants japonais âgés de 6 à 13 ans, répartis en petites classes (6–9 ans, 179 locuteurs) et grandes classes (10–13 ans, 232 locuteurs), avec une répartition équilibrée entre les sexes. Les enregistrements ont été effectués avec des smartphones au format WAV mono 16kHz/16bit, accompagnés de transcriptions d'énoncés et de scripts de lecture. Le jeu de données est applicable à des tâches telles que l'ASR pour enfants en japonais, la TTS, la reconnaissance du locuteur et l'évaluation de la prononciation.
Japonais Enfants Lecture à voix haute

68750 groupes de données d’édition d’images (édition par inférence)

68750 groupes au total, dont 62 500 pour l’édition basée sur la connaissance et 6 250 pour l’édition basée sur les règles physiques. Les images couvrent une grande variété de scènes et de catégories. Pour l’annotation, l’image originale est éditée conformément aux instructions du document afin de générer une image résultante ; pour la plupart des catégories, le processus inclut également une étape de raisonnement. La précision de la correspondance entre l’image et le contenu textuel est d’au moins 95 %. Les données peuvent être utilisées pour des tâches telles que la génération de scènes virtuelles, la synthèse d’images et l’augmentation de données.
édition d’images édition par inférence édition basée sur la connaissance édition basée sur les règles physiques

12 500 ensembles de données d'édition d'images (édition de scènes)

12 500 ensembles de données d'édition d'images (édition de scènes), comprenant 2 500 ensembles pour le réglage des ombres, 2 500 pour le réglage de la lumière, 2 500 pour l'ajout/la suppression d'objets réfléchissants, 2 500 pour la correction d'exposition et 2 500 pour les filtres d'effets spéciaux. Les images couvrent une grande variété de scènes, de catégories, de conditions météorologiques et de moments de la journée. La précision de correspondance entre l'image et le contenu textuel est d'au moins 95 %. Les données peuvent être utilisées pour des tâches telles que la synthèse d'images et la génération de scènes virtuelles.
Édition d'images édition de scènes réglage des ombres réglage de la lumière ajout/suppression d'effets de réflexion correction d'exposition filtres d'effets spéciaux

Données d'images de haute qualité_T

3 millions de données d'images de haute qualité. Cette base de données est constituée d'œuvres d'images sous licence publiées par l'auteur, dont la majorité est en résolution 4K ou supérieure, et couvre diverses catégories telles que les portraits, la gastronomie, les paysages, l'architecture, etc.
Images haute résolution.

Ensemble de données pour le concours de dialogue vocal multilingue Interspeech 2025 - MLC-SLM

Le contexte de l'ensemble de données pour le concours de dialogue vocal multilingue Interspeech 2025 - MLC-SLM est que Datatang a organisé le concours de discours de dialogue multilingue MLC-SLM en 2025, et l'ensemble de données provient des 15 ensembles de données de discours de dialogue de Datatang. Il est conçu pour briser le goulot d'étranglement de la reconnaissance vocale multilingue et de la technologie de compréhension de contexte long, et capturer véritablement des scénarios d'interaction complexes tels que le chevauchement des locuteurs et l'interruption impromptue, fournissant ainsi de riches ressources pour la recherche et les applications liées à la reconnaissance vocale, et aidant le modèle à bien fonctionner face à la diversité du monde réel. Nous respectons strictement les réglementations sur la protection des données et de la vie privée, en veillant à préserver la confidentialité et les droits légitimes des utilisateurs tout au long des processus d'acquisition, de stockage et d'utilisation. Toutes les données sont conformes au RGPD, à la CCPA et à la PIPL.
ensemble de données audio d'atelier ensemble de données mlc-slm données de reconnaissance vocale ASR

111 heures de données vocales de lecture en grec collectées par téléphone portable

Données vocales de lecture en grec collectées par téléphone portable, lues et simulées basé sur un script donné et enregistré, avec un total de 95 enregistreurs, enregistrés depuis la Grèce, et enregistrés dans un environnement calme et sans écho. L'enregistrement est vaste, environ 1 000 phrases par personne. Le texte a été relu manuellement, il garantit une grande exactitude. Cette ressource riche constitue un outil précieux pour la recherche et les applications liées à la reconnaissance vocale. Validé par plusieurs entreprises en intelligence artificielle, il contribue à améliorer les performances des modèles face à la diversité des situations réelles. Nous respectons strictement les réglementations sur la protection des données et de la vie privée, en veillant à préserver la confidentialité et les droits légitimes des utilisateurs tout au long des processus d'acquisition, de stockage et d'utilisation. Toutes les données sont conformes au RGPD, à la CCPA et à la PIPL.
Ensemble de données de monologue scénarisé en grec Ensemble de données vocales grecques Données audio grecques Données vocales grecques Données de synthèse vocale grecques

280 heures de données vocales de lecture en norvégien collectées par téléphone portable

Données vocales de lecture en norvégien collectées par téléphone portable, lues et simulées basé sur un script donné et enregistré, avec un total de 157 enregistreurs, enregistrés depuis la Norvège et enregistrés dans un environnement calme sans écho. L'enregistrement est vaste, environ 1 000 phrases par personne. Le texte a été relu manuellement, il garantit une grande exactitude. Cette ressource riche constitue un outil précieux pour la recherche et les applications liées à la reconnaissance vocale. Validé par plusieurs entreprises en intelligence artificielle, il contribue à améliorer les performances des modèles face à la diversité des situations réelles. Nous respectons strictement les réglementations sur la protection des données et de la vie privée, en veillant à préserver la confidentialité et les droits légitimes des utilisateurs tout au long des processus d'acquisition, de stockage et d'utilisation. Toutes les données sont conformes au RGPD, à la CCPA et à la PIPL.
Ensemble de données de monologue scénarisé norvégien Ensemble de données vocales norvégiennes Données de synthèse vocale norvégiennes Corpus NLP norvégien Données vocales norvégiennes Ensemble de données audio norvégiennes

500 000 images de données OCR annotées provenant de scènes naturelles, de scènes de documents photographiés et de scènes électroniques dans 21 pays

500 000 images de données OCR annotées provenant de scènes naturelles, de scènes de documents photographiés et de scènes électroniques dans 21 pays. Les données contiennent 21 langues, et le nombre de feuilles dans chaque langue est réparti entre 20 000 et 25 000. Les types de données incluent les scènes naturelles, les scènes photo de document et les scènes électroniques. La diversité des données comprend plusieurs types de données, plusieurs angles de prise de vue et plusieurs langues. En termes d'annotation, l'annotation quadrilatérale ou polygonale au niveau de la ligne (colonne) et la transcription du contenu au niveau de la ligne (colonne) sont adoptées. Les données peuvent être utilisées pour des tâches de reconnaissance OCR multilingues.
ensemble de données OCR multilingues données de reconnaissance de texte de scène ensemble de données OCR de document données OCR d'écran électronique ensemble de données OCR 21 langues données d'entraînement OCR AI ensemble de données de reconnaissance de texte

200 000 ensembles de données image-texte de bâtiments emblématiques de plusieurs pays

200 000 ensembles de données image-texte de bâtiments emblématiques de plusieurs pays. Chaque ensemble de données contient une image et un document de description en chinois et en anglais. Les points de repère nationaux comprennent 80 000 groupes et les autres points de repère nationaux 120 000 groupes. Il n'y a pas moins de 20 pays, dont les États-Unis, le Royaume-Uni, la France, la Russie, l'Allemagne et d'autres pays. Le nombre d'images correspondant à chaque point de repère est réparti de 1 à 10, y compris des informations sur les points de repère sous différents angles, à différentes distances et à différentes périodes. Les types de points de repère comprennent de nombreux types de bâtiments emblématiques, tels que des bâtiments commerciaux, des bâtiments anciens, des monuments, des bibliothèques, des attractions, etc. En termes de contenu d'étiquetage, le pays de repère, la ville de repère, l'emplacement spécifique du point de repère, la classification et la description du point de repère sont marqués. Les données peuvent être utilisées pour l'identification et l'analyse des bâtiments emblématiques.
ensemble de données d'images de point de repère ensemble de données de reconnaissance de bâtiment ensemble de légende d'image de point de repère mondial données de légende d'image bilingue ensemble de légende chinois-anglais ensemble de données de classification de point de repère ensemble de données image-texte ensemble de données de point de repère touristique ensemble de données d'image du patrimoine culturel sous-titrage d'image pour l'entraînement de l'IA

581 heures de données vocales parlées en grec

Données vocales parlées en grec,reflétant des situations interactives du monde réel. Cet ensemble de données est marqué avec divers attributs tels que le contenu du texte, l'identité du locuteur et le sexe, et est enregistré par plusieurs Roumains de différents milieux géographiques et culturels, avec une grande précision et une grande facilité d'utilisation, fournissant de riches ressources pour la recherche et les applications liées à la reconnaissance vocale, aidant le modèle à bien fonctionner face à la diversité du monde réel. Nous respectons strictement les réglementations sur la protection des données et de la vie privée, en veillant à préserver la confidentialité et les droits légitimes des utilisateurs tout au long des processus d'acquisition, de stockage et d'utilisation. Toutes les données sont conformes au RGPD, à la CCPA et à la PIPL.
ensemble de données de parole grecque données d'entraînement ASR grecques corpus de conversation grecque discours de monologue grec ensemble de données de reconnaissance vocale grecque données grecques de synthèse vocale ensemble de données vocales grecques ensemble de données de transcription grecque

600 heures de données vocales parlées en norvégien

Données vocales parlées en norvégien, couvrant des domaines généraux tels que les médias personnels, le dialogue et la diffusion en direct, reflétant des situations interactives du monde réel. Cet ensemble de données est marqué avec divers attributs tels que le contenu du texte, l'identité du locuteur et le sexe, et est enregistré par plusieurs Roumains de différents milieux géographiques et culturels, avec une grande précision et une grande facilité d'utilisation, fournissant de riches ressources pour la recherche et les applications liées à la reconnaissance vocale, aidant le modèle à bien fonctionner face à la diversité du monde réel. Nous respectons strictement les réglementations sur la protection des données et de la vie privée, en veillant à préserver la confidentialité et les droits légitimes des utilisateurs tout au long des processus d'acquisition, de stockage et d'utilisation. Toutes les données sont conformes au RGPD, à la CCPA et à la PIPL.
ensemble de données vocales norvégiennes données d'entraînement ASR norvégiennes corpus de conversations norvégiennes discours monologue norvégien ensemble de données norvégiennes de reconnaissance vocale données norvégiennes de reconnaissance vocale données norvégiennes de reconnaissance vocale ensemble de données vocales norvégiennes données vocales multilingues ensemble de données de transcription norvégienne

10 000 groupes de données Q/A pour diagrammes numériques

10 000 groupes de données Q/A pour diagrammes numériques : diagrammes linéaires, diagrammes à barres, diagrammes circulaires, diagrammes de dispersion, combinaisons, tableaux. Chaque image deux tours Q/A : un pour lire les valeurs, un pour le calcul.
Questions-réponses texte japonais
. . .
loading

loading

c6f2560e-8ff8-4ac6-b3d5-e331624b18cf