en

Please fill in your name

Mobile phone format error

Veuillez entrer le téléphone

Veuillez entrer le nom de votre entreprise

Veuillez entrer votre e-mail professionnel

Veuillez entrer l'exigence de données

Successful submission! Thank you for your support.

Format error, Please fill in again

Confirm

L'exigence de données ne peut pas faire moins de 5 mots et ne peut pas être constituée uniquement de chiffres

346 heures de dialogues en espagnol mexicain (téléphone mobile)

audio
données
ensemble de données
conversationnel
données ASR
espagnol
mexicain

Le corpus de données vocales en espagnol mexicain — constitué à partir de conversations téléphoniques simulées — couvre une trentaine de thématiques courantes. Il comprend des annotations exhaustives, notamment le contenu textuel, les horodatages des phrases, l’identité des locuteurs ainsi que leur sexe. Les enregistrements ont été réalisés par 338 locuteurs natifs du Mexique, représentant une diversité de régions et de milieux culturels. Doté d’une grande précision et d’une facilité d’exploitation remarquable, ce corpus constitue une ressource précieuse pour la recherche et les applications en reconnaissance vocale. Son efficacité a été confirmée par de nombreuses entreprises spécialisées en intelligence artificielle, notamment pour l’entraînement de modèles robustes capables de s’adapter à la diversité des situations du monde réel. Toutes les données ont été collectées, stockées et utilisées dans le strict respect des réglementations en matière de protection des données personnelles, conformément au RGPD, au CCPA et au PIPL.

Données payantes
Il s'agit d'un ensemble de données payant destiné à un usage commercial, à la recherche et plus encore. Ces Jeux de données prêts à l'emploi et sous licence contribuent au lancement de projets d'IA.
SpécificationsSpécifications
Format
16 kHz, 16 bits, format WAV non compressé, mono
Catégorisation du contenu
Les locuteurs sélectionnent plusieurs sujets familiers à partir d’une liste prédéfinie, et enregistrent des dialogues fluides et naturels
Conditions d'enregistrement
Environnement intérieur relativement silencieux, sans réverbération
Dispositifs d'enregistrement
Smartphones Android et iPhone ;
Informations d'enregisteur
338 participants au total, dont 152 hommes et 186 femmes ;
Pays
Mexique
Code de région linguistique
es-MX
Langue
Espagnol
Caractéristiques d'annotation
Annotation du contenu textuel, des horodatages de phrases, de l’identifiant du locuteur, du sexe et du bruit de fond
Précision
Taux de précision lexicale : 98%
Échantillon Exemple
  • Audio

    Doy esta clase cuatro semestres,

  • Audio

    porque doy la asignatura de desarrollo físico y salud.

  • Audio

    Pues más o menos, qué crees que este es un tema que yo trabajo regularmente con mis alumnos

  • Audio

    sentirte bien físicamente en movilidad,

  • Audio

    físico del, del cuerpo, o sea,

Données recommandéesJeux de données recommandés
600 heures de données vocales de conversation naturelle avec pistes séparées en anglais philippin collectées par téléphone portable

Données vocales de conversation naturelle avec pistes séparées en anglais philippin collectées par téléphone portable, enregistré sur la base d'une simulation de thèmes courants. Cet ensemble de données est marqué par du contenu textuel, des horodatages de phrases, l'identité du locuteur, le sexe et d'autres attributs, enregistré par des natifs philippins de différents milieux géographiques et culturels, il garantit une grande exactitude. Cette ressource riche constitue un outil précieux pour la recherche et les applications liées à la reconnaissance vocale. Validé par plusieurs entreprises en intelligence artificielle, il contribue à améliorer les performances des modèles face à la diversité des situations réelles. Nous respectons strictement les réglementations sur la protection des données et de la vie privée, en veillant à préserver la confidentialité et les droits légitimes des utilisateurs tout au long des processus d'acquisition, de stockage et d'utilisation. Toutes les données sont conformes au RGPD, à la CCPA et à la PIPL.

dialogue AI dataset données d'entraînement à la reconnaissance vocale ensemble de données audio multicanaux données vocales de smartphone ensemble de données de parole spontanée ensemble de données vocales multi-flux ensemble de données vocales en anglais des Philippines ensemble de données vocales en duplex intégral
600 heures de données vocales de conversation naturelle avec pistes séparées en anglais américain collectées par téléphone portable

Données vocales de conversation naturelle avec pistes séparées en anglais américain collectées par téléphone portable, enregistré sur la base d'une simulation de thèmes courants. Cet ensemble de données est marqué par du contenu textuel, des horodatages de phrases, l'identité du locuteur, le sexe et d'autres attributs, enregistrés par des Amérindiens de différents milieux géographiques et culturels, il garantit une grande exactitude. Cette ressource riche constitue un outil précieux pour la recherche et les applications liées à la reconnaissance vocale. Validé par plusieurs entreprises en intelligence artificielle, il contribue à améliorer les performances des modèles face à la diversité des situations réelles. Nous respectons strictement les réglementations sur la protection des données et de la vie privée, en veillant à préserver la confidentialité et les droits légitimes des utilisateurs tout au long des processus d'acquisition, de stockage et d'utilisation. Toutes les données sont conformes au RGPD, à la CCPA et à la PIPL.

Ensemble de données vocales en anglais américain Ensemble de données vocales multi-flux ensemble de données de dialogue en duplex intégral ensemble de données vocales spontanées données vocales de smartphone ensemble de données audio multicanaux données d'entraînement de reconnaissance vocale ensemble de données de dialogue AI
Veuillez nous indiquer vos besoins particuliers

En soumettant, j’accepte la politique de confidentialité

767503ba-4b28-4f07-881b-8bb4bb684799

79ec52d5-a853-4ceb-833d-9d2d803894a0