off-the-shelf datasets, dataset provider logo

fr

100 000 paires de corpus parallèles sino-ouïgour

Données de corpus parallèle chinois-ouïghour
corpus aligné
données de corpus parallèle
données de corpus aligné

Les données du corpus parallèle Han-ouïgour comprennent 100 000 paires de corpus de traduction parallèle du chinois et de l'ouïgour, et le format de stockage des données est un document TXT, avec une fluidité et une fidélité des données de plus de 80 %. Elles ont été nettoyées, désensibilisées et inspectées, et peuvent être utilisées comme corpus de base pour l'analyse de données de texte dans la Traduction automatique et dans d'autres domaines.

Format de stockage
TXT
Contenu des données
Corpus parallèle sino-ouïgour
Volume des données
100 000 paires de corpus parallèles sino-ouïgour
Langue
Chinois, Ouïgour
Scène d'application
Traduction automatique
  • 100 000 paires de corpus parallèles sino-ouïgour

5ee96eb4-685b-4881-af77-c747d21c9f43

5a24c3a3-df54-431a-9313-b80e8a30ae08