off-the-shelf datasets, dataset provider logo

fr

711 heures de données audio informelles en vietnamien

Vietnamien
Vidéo en langage courant
Annotation textuelle

Données audio informelles en vietnamien, domaines : médias sociaux, dialogues, live-streams, etc. Reflète des interactions réelles. Annotation : contenu textuel, ID du locuteur, genre, etc. Validation par des entreprises d'IA. Conforme à la protection des données (RGPD, CCPA, PIPL).

Format
16 kHz, 16 bits, mono, fichier au format WAV
Catégorisation du contenu
Contenu couvrant plusieurs domaines tels que les variétés, les interviews, les dialogues et les évaluations
Environnement d'enregistrement
Faible bruit de fond
Caractéristiques d'annotation
Annotation du contenu textuel, des points de début et de fin des phrases valides, de l’identifiant du locuteur et du sexe
Langue
Vietnamien
Code de région linguistique
vi-VN
Pays
Viêt Nam
Scène d'application
Reconnaissance vocale, génération de sous-titres et modération de contenu
Précision
Taux de précision lexicale : 98%
  • Audio

    xin mời quý vị và các bạn cùng theo dõi cuộc trò chuyện về một chủ đề mà Thảo Vân nghĩ rằng, ờ, luôn luôn mới

  • Audio

    Như ngày hôm nay, chúng tôi muốn mời quý vị, ờ không chỉ là chị em phụ nữ mà cả các anh, hãy cùng lắng nghe, cùng theo dõi với chúng tôi

  • Audio

    luôn luôn không bao giờ cũ, mặc dù nó là một chủ đề chúng ta vẫn nói nhiều lần, đó là chủ đề làm đẹp.

  • Audio

    Thưa quý vị, trong câu chuyện à đêm muộn ngày hôm nay

  • Audio

    Xin kính chào quý vị khán giả.

600 heures de données vocales de conversation naturelle avec pistes séparées en anglais philippin collectées par téléphone portable

Données vocales de conversation naturelle avec pistes séparées en anglais philippin collectées par téléphone portable, enregistré sur la base d'une simulation de thèmes courants. Cet ensemble de données est marqué par du contenu textuel, des horodatages de phrases, l'identité du locuteur, le sexe et d'autres attributs, enregistré par des natifs philippins de différents milieux géographiques et culturels, il garantit une grande exactitude. Cette ressource riche constitue un outil précieux pour la recherche et les applications liées à la reconnaissance vocale. Validé par plusieurs entreprises en intelligence artificielle, il contribue à améliorer les performances des modèles face à la diversité des situations réelles. Nous respectons strictement les réglementations sur la protection des données et de la vie privée, en veillant à préserver la confidentialité et les droits légitimes des utilisateurs tout au long des processus d'acquisition, de stockage et d'utilisation. Toutes les données sont conformes au RGPD, à la CCPA et à la PIPL.

dialogue AI dataset données d'entraînement à la reconnaissance vocale ensemble de données audio multicanaux données vocales de smartphone ensemble de données de parole spontanée ensemble de données vocales multi-flux ensemble de données vocales en anglais des Philippines ensemble de données vocales en duplex intégral
600 heures de données vocales de conversation naturelle avec pistes séparées en anglais américain collectées par téléphone portable

Données vocales de conversation naturelle avec pistes séparées en anglais américain collectées par téléphone portable, enregistré sur la base d'une simulation de thèmes courants. Cet ensemble de données est marqué par du contenu textuel, des horodatages de phrases, l'identité du locuteur, le sexe et d'autres attributs, enregistrés par des Amérindiens de différents milieux géographiques et culturels, il garantit une grande exactitude. Cette ressource riche constitue un outil précieux pour la recherche et les applications liées à la reconnaissance vocale. Validé par plusieurs entreprises en intelligence artificielle, il contribue à améliorer les performances des modèles face à la diversité des situations réelles. Nous respectons strictement les réglementations sur la protection des données et de la vie privée, en veillant à préserver la confidentialité et les droits légitimes des utilisateurs tout au long des processus d'acquisition, de stockage et d'utilisation. Toutes les données sont conformes au RGPD, à la CCPA et à la PIPL.

Ensemble de données vocales en anglais américain Ensemble de données vocales multi-flux ensemble de données de dialogue en duplex intégral ensemble de données vocales spontanées données vocales de smartphone ensemble de données audio multicanaux données d'entraînement de reconnaissance vocale ensemble de données de dialogue AI

dfac038f-79db-40c1-95b9-310e5dcaf5cc

b63eebea-5f60-4157-8bb0-c3115f19070a