off-the-shelf datasets, dataset provider logo

fr

215 heures de données vocales en coréen – domaine financier – annotation des entités – style oral

Coréen
entité
dialogue spontané
domaine financier

Les données vocales annotées en entités pour le domaine financier en coréen _ conversation informelle, comprennent un large éventail de termes spécialisés, couvrant à la fois des sujets macroéconomiques et microéconomiques, et reflètent des situations interactives réelles. L’ensemble est annoté avec le contenu textuel, l’identité et le sexe des locuteurs, ainsi que des entités couramment utilisées. Ces données, validées par plusieurs entreprises d’intelligence artificielle, constituent une ressource précieuse pour diverses applications en IA. Elles permettent aux modèles de s’adapter efficacement à la complexité du monde réel. Nous respectons strictement les réglementations sur la protection des données et la confidentialité, assurant la protection des droits et de la vie privée des utilisateurs tout au long du processus. Toutes les données sont conformes au GDPR, au CCPA et à la PIPL.

Format
16kHz, 16 bits, format WAV, mono
Catégorisation du contenu
Ce jeu de données inclut une large gamme de termes financiers spécialisés, structurés autour de deux axes principaux : 1. Contenu macro-financier : économie globale, tendances des marchés, politiques monétaires, fluctuations des taux de change, etc. 2. Contenu micro-financier : données d'entreprises individuelles, actions, obligations, portefeuilles d'investissement, etc.
Environnement d'enregistrement
Environnement intérieur relativement calme
Pays
Corée du Sud
Code de région linguistique
ko-KR
Langue
Langue coréenne
Caractéristiques d'annotation
Annotations détaillées : - Transcription textuelle intégrale - Horodatage de début et de fin des phrases valides - Identifiant et genre du locuteur - Annotation des bruits parasites - Marquage des informations sensibles - Annotation d'entités : - Personnes - Lieux - Dates et heures - Produits financiers - Systèmes logiciels - Organisations - Préservation de la casse (majuscules/minuscules)
Précision
Taux de précision lexicale : 98%
  • Audio

    지난 주에 또 시끄러웠던 게 오염수가 아니라 이제 또 홍범도 장군

  • Audio

    얘기가 진짜 많이 [OVERLAP/]나왔었는데[/OVERLAP]

  • Audio

    예 어쨌든 간에 또 일요일이 돌아왔고

  • Audio

    반갑습니다.

  • Audio

    얘기가 나오다 보니까

600 heures de données vocales de conversation naturelle avec pistes séparées en anglais philippin collectées par téléphone portable

Données vocales de conversation naturelle avec pistes séparées en anglais philippin collectées par téléphone portable, enregistré sur la base d'une simulation de thèmes courants. Cet ensemble de données est marqué par du contenu textuel, des horodatages de phrases, l'identité du locuteur, le sexe et d'autres attributs, enregistré par des natifs philippins de différents milieux géographiques et culturels, il garantit une grande exactitude. Cette ressource riche constitue un outil précieux pour la recherche et les applications liées à la reconnaissance vocale. Validé par plusieurs entreprises en intelligence artificielle, il contribue à améliorer les performances des modèles face à la diversité des situations réelles. Nous respectons strictement les réglementations sur la protection des données et de la vie privée, en veillant à préserver la confidentialité et les droits légitimes des utilisateurs tout au long des processus d'acquisition, de stockage et d'utilisation. Toutes les données sont conformes au RGPD, à la CCPA et à la PIPL.

dialogue AI dataset données d'entraînement à la reconnaissance vocale ensemble de données audio multicanaux données vocales de smartphone ensemble de données de parole spontanée ensemble de données vocales multi-flux ensemble de données vocales en anglais des Philippines ensemble de données vocales en duplex intégral
600 heures de données vocales de conversation naturelle avec pistes séparées en anglais américain collectées par téléphone portable

Données vocales de conversation naturelle avec pistes séparées en anglais américain collectées par téléphone portable, enregistré sur la base d'une simulation de thèmes courants. Cet ensemble de données est marqué par du contenu textuel, des horodatages de phrases, l'identité du locuteur, le sexe et d'autres attributs, enregistrés par des Amérindiens de différents milieux géographiques et culturels, il garantit une grande exactitude. Cette ressource riche constitue un outil précieux pour la recherche et les applications liées à la reconnaissance vocale. Validé par plusieurs entreprises en intelligence artificielle, il contribue à améliorer les performances des modèles face à la diversité des situations réelles. Nous respectons strictement les réglementations sur la protection des données et de la vie privée, en veillant à préserver la confidentialité et les droits légitimes des utilisateurs tout au long des processus d'acquisition, de stockage et d'utilisation. Toutes les données sont conformes au RGPD, à la CCPA et à la PIPL.

Ensemble de données vocales en anglais américain Ensemble de données vocales multi-flux ensemble de données de dialogue en duplex intégral ensemble de données vocales spontanées données vocales de smartphone ensemble de données audio multicanaux données d'entraînement de reconnaissance vocale ensemble de données de dialogue AI

a8b62623-1efa-41ad-87d0-c71aef7f3cfa

182dd0b2-58fc-4c59-b846-b40d663bbb9b