off-the-shelf datasets, dataset provider logo

fr

1,99 million de paires de corpus parallèles chinois-tchèque

Corpus parallèle chinois-tchèque
corpus aligné
données de corpus parallèle
données de corpus align

Ce vaste corpus bilingue sino-tchèque contient 1,99 million de paires de phrases en chinois et en tchèque, stockées au format texte (.txt). Les données ont été nettoyées, désensibilisées et vérifiées, offrant une ressource fiable pour la traduction automatique et l’analyse de textes multilingues.

Format de stockage
TXT
Contenu des données
Corpus parallèle chinois-tchèque, préalablement classé par domaines : technologie, santé, tourisme, actualités, langue orale et armée
Volume des données
1,99 million de paires de données parallèles chinois-tchèque
Langue
Chinois, tchèque
Scène d'application
Traduction automatique

33b58fbd-fa23-4312-8764-d8f14fb001a5

2bf1ddd6-53d9-4d4b-9f27-e3a1e3ae63ac