fr

Please fill in your name

Mobile phone format error

Veuillez entrer le téléphone

Veuillez entrer le nom de votre entreprise

Veuillez entrer votre e-mail professionnel

Veuillez entrer l'exigence de données

Successful submission! Thank you for your support.

Format error, Please fill in again

Confirm

L'exigence de données ne peut pas faire moins de 5 mots et ne peut pas être constituée uniquement de chiffres

Jeux de données de reconnaissance de la parole

Améliorez instantanément les performances de votre modèle IA avec des Jeux de données prêts à l’emploi de haute qualité.

Langue

Tout
209
Arabe
5
Birman
3
Dialects chinois
3
Anglais
44
Français
11
Allemand
9
Hindi
6
Indonésien
8
Italien
9
Japonais
9
Coréen
14
Malais
5
Mandarin
3
Autres
47
Portugais
12
Russe
6
Espagnol
14
Thaï
9
Vietnamien
6

Type de données

Tout
209
Dialogue
106
Lecture
104

97 heures de données vocales d’enfants en portugais brésilien – style oral

Les données vocales d’enfants lusophones brésiliens _ conversation informelle, couvrent des domaines généraux tels que les médias sociaux, les dialogues, les émissions en direct, les conférences et les divertissements, reflétant des situations interactives réelles. Cet ensemble de données comprend des annotations sur le contenu textuel, l’identité, le sexe et l’accent des locuteurs. Il a été enregistré par plusieurs enfants brésiliens âgés de 12 ans ou moins, issus de différentes régions et cultures. Ces données sont précises et simples d’utilisation, constituant une ressource de valeur pour les recherches et applications en reconnaissance vocale. Elles permettent aux modèles de s’adapter efficacement à la diversité du monde réel. Nous nous conformons strictement aux lois sur la protection des données et la confidentialité, garantissant les droits et la vie privée des utilisateurs à chaque étape du processus. Toutes les données respectent le GDPR, le CCPA et la PIPL.
Portugais brésilien spontané parole annotation textuelle

406 heures de dialogues en portugais européen (téléphone mobile)

Les données vocales en portugais européen _ conversations (téléphone portable) ont été enregistrées sur la base d’environ une trentaine de thèmes courants. Cet ensemble de données contient des annotations détaillant le contenu textuel, les horodatages des phrases, l'identité des locuteurs, leur sexe, ainsi que d'autres attributs. Il a été enregistré par 590 locuteurs natifs portugais européens, issus de différentes régions et cultures, garantissant ainsi une grande précision. Ces données constituent une ressource précieuse pour la recherche et les applications en reconnaissance vocale, validée par plusieurs entreprises spécialisées en intelligence artificielle. Elles permettent aux modèles d’atteindre des performances exceptionnelles face à la diversité du monde réel. Nous respectons scrupuleusement les réglementations en matière de protection des données et de confidentialité, garantissant ainsi la protection des droits et de la vie privée des utilisateurs tout au long de la collecte, du stockage et de l'utilisation des données. Toutes les données respectent le GDPR, le CCPA et la PIPL.
audio données ensemble de données conversationnel données ASR portugais européen

101 heures de données vocales d’enfants en italien (Italie) – style oral

Les données vocales d’enfants italophones _ conversation informelle, couvrent des domaines généraux tels que les médias sociaux, les dialogues, les émissions en direct, les conférences et les divertissements, reflétant des situations interactives réelles. Cet ensemble de données comprend des annotations sur le contenu textuel, l’identité, le sexe et l’accent des locuteurs. Il a été enregistré par plusieurs enfants italiens âgés de 12 ans ou moins, issus de diverses régions et cultures. Les données sont précises et faciles à exploiter, offrant une ressource précieuse pour la recherche et les applications en reconnaissance vocale. Elles permettent aux modèles de faire face efficacement à la diversité du monde réel. Nous respectons scrupuleusement les réglementations relatives à la protection des données et à la confidentialité, garantissant ainsi les droits et la vie privée des utilisateurs tout au long du processus. Toutes les données respectent le GDPR, le CCPA et la PIPL.
Données de parole spontanée annotation textuelle italien

200 heures de dialogues en malais (téléphone mobile)

Les données vocales en malais _ conversations (téléphone portable) ont été enregistrées sur la base d’environ une trentaine de thèmes courants. Cet ensemble de données contient des annotations détaillant le contenu textuel, les horodatages des phrases, l'identité des locuteurs, leur sexe, ainsi que d'autres attributs. Il a été enregistré par 228 locuteurs natifs malaisiens, issus de différentes régions et cultures, garantissant ainsi une grande précision. Ces données constituent une ressource précieuse pour la recherche et les applications en reconnaissance vocale, validée par plusieurs entreprises spécialisées en intelligence artificielle. Elles permettent aux modèles d’atteindre des performances exceptionnelles face à la diversité du monde réel. Nous respectons scrupuleusement les réglementations en matière de protection des données et de confidentialité, garantissant ainsi la protection des droits et de la vie privée des utilisateurs tout au long de la collecte, du stockage et de l'utilisation des données. Toutes les données respectent le GDPR, le CCPA et la PIPL.
Comportement normal des passagers comportement de mal des transports comportement de somnolence comportement de perte d’objets groupes d’âge variés périodes temporelles multiples

162 heures de données vocales d’enfants en français (France) – style oral

Ce corpus audio en français, enregistré par des enfants de 12 ans ou moins originaires de différentes régions de France, couvre un large éventail de situations orales : médias sociaux, échanges conversationnels, conférences, diffusions en direct ou encore émissions ludiques. Chaque enregistrement est annoté avec précision (contenu textuel, identité, genre, accent), offrant un niveau de détail propice aux recherches avancées en reconnaissance vocale appliquée aux voix d’enfants. Sa fiabilité, combinée à une grande souplesse d’utilisation, en fait une base de données de référence. Conformément aux réglementations RGPD, CCPA et PIPL, la confidentialité et les droits des mineurs sont pleinement protégés tout au long du cycle de vie des données.
Français spontané parole enfant

494 heures de données vocales en hindi – style oral

Les données vocales en hindi _ conversation informelle, reflètent des situations interactives réelles. Cet ensemble de données comporte des annotations sur le contenu textuel, l’identité des locuteurs, leur sexe et d’autres caractéristiques. Il a été enregistré par des locuteurs natifs hindis issus de diverses régions et cultures. Ces données sont précises, faciles à utiliser et offrent une base solide pour la recherche et les applications en reconnaissance vocale. Nous respectons strictement les lois sur la protection des données et la confidentialité, garantissant ainsi la protection des droits et de la vie privée des utilisateurs tout au long du processus de collecte, du stockage et de l'utilisation des données. Toutes les données respectent le GDPR, le CCPA et la PIPL.
Spontané parole hindi

136 heures de données audio coréennes (Dialogue, téléphone)

Données audio coréennes (dialogue, téléphone), basées sur environ 30 sujets courants simulés. Annotation : contenu textuel, horodatage de phrase, ID du locuteur, genre, etc. Enregistrées par 216 Coréens. Validation par des entreprises d'IA. Conforme à la protection des données (RGPD, CCPA, PIPL).
Conversationnel téléphone coréen

347 heures de dialogues en indonésien (téléphone mobile)

Les données vocales en indonésien _ conversations (téléphone portable) ont été enregistrées sur la base d’environ une trentaine de thèmes courants. Cet ensemble de données contient des annotations détaillant le contenu textuel, les horodatages des phrases, l'identité des locuteurs, leur sexe, ainsi que d'autres attributs. Il a été enregistré par 412 locuteurs natifs indonésiens, issus de différentes régions et cultures, garantissant ainsi une grande précision. Ces données constituent une ressource précieuse pour la recherche et les applications en reconnaissance vocale, validée par plusieurs entreprises spécialisées en intelligence artificielle. Elles permettent aux modèles d’atteindre des performances exceptionnelles face à la diversité du monde réel. Nous respectons scrupuleusement les réglementations en matière de protection des données et de confidentialité, garantissant ainsi la protection des droits et de la vie privée des utilisateurs tout au long de la collecte, du stockage et de l'utilisation des données. Toutes les données respectent le GDPR, le CCPA et la PIPL.
audio données ensemble de données conversationnel données ASR indonésien

Données vidéo multimodales de mouvements labiaux sous angles multiples – 202 participants

Ce corpus multimodal dédié à l’analyse des mouvements labiaux comprend des vidéos de 202 participants, filmées sous 13 angles distincts. Les enregistrements ont été réalisés en intérieur, sous lumière naturelle et artificielle, à l’aide de téléphones portables. Il intègre une diversité de scènes et de tranches d’âge. Les contenus, enregistrés en mandarin standard, couvrent un large éventail de domaines. Cette ressource est destinée à la recherche avancée en apprentissage multimodal dans le domaine audio-visuel.
Multi-angles multimodalité labiale scènes intérieures en lumière naturelle scènes intérieures sous éclairage fluorescent 13 angles de prise de vue chinois mandarin domaine général
. . .

loading

Personnalisez vos données dès maintenant

Pourquoi choisir des jeux de données prêts à l'emploi

  • Droits d'auteur

    Droits d'auteur

    Droits d’auteur clairs vérifiables à tout moment
  • Sécurité

    Sécurité

    Correctement autorisés Sécurisés à l’usage
  • Professionnel

    Professionnel

    Conçus et produits par des experts en données d’IA
  • Diversité

    Diversité

    Collectés à partir de diverses scènes réelles
  • Rentabilité

    Rentabilité

    Plus rentable Que les données personnalisées
  • Efficacité

    Efficacité

    Prêt à l'emploi, livré en quelques secondes
3fee380f-57a4-4c7c-a5f1-16ace57d63f3