[{"@type":"PropertyValue","name":"Format","value":"16kHz, 16 bits, format WAV, mono"},{"@type":"PropertyValue","name":"Contenu des données","value":"Contenus vidéo et audio en mandarin à accent taïwanais, enregistrés dans des contextes oraux réels"},{"@type":"PropertyValue","name":"Caractéristiques d'annotation","value":"Annotation du contenu textuel, des horodatages de phrases, de l’identifiant du locuteur, du sexe et du bruit de fond"},{"@type":"PropertyValue","name":"Langue","value":"Mandarin avec accent taïwanais"},{"@type":"PropertyValue","name":"Pays","value":"Chine"},{"@type":"PropertyValue","name":"Scène d'application","value":"Reconnaissance vocale; génération de sous-titres et modération de contenu"},{"@type":"PropertyValue","name":"Précision","value":"Taux de précision par phrase : 97%"}]
{"id":1295,"datatype":"1","titleimg":"https://fr.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp","type1":"165","type1str":null,"type2":"166","type2str":null,"dataname":"548 heures de données vocales en mandarin taïwanais – style oral","datazy":[{"title":"Format","desc":"Format","content":"16kHz, 16 bits, format WAV, mono"},{"title":"Contenu des données","desc":"Contenu des données","content":"Contenus vidéo et audio en mandarin à accent taïwanais, enregistrés dans des contextes oraux réels"},{"title":"Caractéristiques d'annotation","desc":"Caractéristiques d'annotation","content":"Annotation du contenu textuel, des horodatages de phrases, de l’identifiant du locuteur, du sexe et du bruit de fond"},{"title":"Langue","desc":"Langue","content":"Mandarin avec accent taïwanais"},{"title":"Pays","desc":"Pays","content":"Chine"},{"title":"Scène d'application","desc":"Scène d'application","content":"Reconnaissance vocale; génération de sous-titres et modération de contenu"},{"title":"Précision","desc":"Précision","content":"Taux de précision par phrase : 97%"}],"datatag":"Accent mandarin; taiwanese,Colloquial Video","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":"","samplePresentation":[],"officialSummary":"Ce corpus de mandarin standard de Taïwan, à tonalité orale, couvre de nombreux domaines d’application généraux et reflète fidèlement les contextes d’interaction réelle. Les données sont annotées avec précision, incluant le contenu textuel, l’identité et le sexe des locuteurs. Ce corpus, enregistré par des locuteurs natifs taïwanais, se distingue par sa fiabilité et sa facilité d’utilisation. Validé par plusieurs entreprises d’intelligence artificielle, il permet aux modèles de mieux s’adapter à la diversité des scénarios du monde réel. Toutes les données ont été collectées, stockées et utilisées dans le strict respect des réglementations sur la protection de la vie privée (GDPR, CCPA, PIPL).","dataexampl":null,"datakeyword":["Données vocales de vidéos orales en chinois","données vocales en chinois","vidéos orales en chinois","données multimodales en chinois"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Data Type,Language","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"speechRec","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,JP,PT,DE,KO,FR,ES\"},{\"code\":\"4\",\"language\":\"JP\"}]","productNameEn":"1250 Hours - Taiwanese Accent Mandarin Spontaneous Speech Data","BGimg":"brightSpot_audio","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
548 heures de données vocales en mandarin taïwanais – style oral
Données vocales de vidéos orales en chinois
données vocales en chinois
vidéos orales en chinois
données multimodales en chinois
Ce corpus de mandarin standard de Taïwan, à tonalité orale, couvre de nombreux domaines d’application généraux et reflète fidèlement les contextes d’interaction réelle. Les données sont annotées avec précision, incluant le contenu textuel, l’identité et le sexe des locuteurs. Ce corpus, enregistré par des locuteurs natifs taïwanais, se distingue par sa fiabilité et sa facilité d’utilisation. Validé par plusieurs entreprises d’intelligence artificielle, il permet aux modèles de mieux s’adapter à la diversité des scénarios du monde réel. Toutes les données ont été collectées, stockées et utilisées dans le strict respect des réglementations sur la protection de la vie privée (GDPR, CCPA, PIPL).
Jeu de données payant sous licence commerciale. Prêt à intégrer dans des projets d'IA.
Spécifications
Format
16kHz, 16 bits, format WAV, mono
Contenu des données
Contenus vidéo et audio en mandarin à accent taïwanais, enregistrés dans des contextes oraux réels
Caractéristiques d'annotation
Annotation du contenu textuel, des horodatages de phrases, de l’identifiant du locuteur, du sexe et du bruit de fond
Langue
Mandarin avec accent taïwanais
Pays
Chine
Scène d'application
Reconnaissance vocale; génération de sous-titres et modération de contenu