off-the-shelf datasets, dataset provider logo

fr

14 heures – corpus de synthèse vocale – voix moyenne – mandarin taïwanais – sept styles

TTS (synthèse vocale)
mandarin de Taïwan
styles multiples

Corpus de synthèse vocale en mandarin taïwanais de 14 heures, intégrant sept styles vocaux distincts enregistrés par quatre comédiens professionnels. Les styles comprennent entre autres : sbire de gangster, homme à la voix grave, fillette, grand-mère bienveillante, commerçant, grand-père et sergent. Toutes les données ont été annotées par des linguistes spécialisés afin de garantir une adéquation fine aux exigences des systèmes de synthèse vocale.

Format
48 kHz, 24 bits, WAV, mono
Environnement d'enregistrement
Environnement de studio d’enregistrement professionnel
Contenu d'enregistrement
Le corpus audio reflète fidèlement les contenus textuels propres à chaque rôle
Intervenants
4 locuteurs professionnels, 7 styles : sbire, homme rude, petite fille, grand-mère affectueuse, homme d'affaires, grand-père, soldat. Le sbire et l'homme rude par le même locuteur ; la petite fille, la grand-mère, l'homme d'affaires par la même locutrice. 2 h/style.
Caractéristiques d'annotation
Annotation phonétique et prosodique
Dispositifs
Équipement et logiciel d'enregistrement professionnel
Langue
Mandarin taïwanais
Scène d'application
Synthèse vocale

057e62f4-1daa-44be-9d0a-5e0fd9dfd7f2

00f5298c-4a50-40c1-9a0e-b19ef7e09de1