[{"@type":"PropertyValue","name":"Format","value":"TXT"},{"@type":"PropertyValue","name":"Data content","value":"Chinese-Russian Parallel Corpus Data"},{"@type":"PropertyValue","name":"Data size","value":"1 million pairs of Chinese-Russian Parallel Corpus Data. The Chinese sentences contain 14.6 characters on average."},{"@type":"PropertyValue","name":"Language","value":"Chinese, Russian"},{"@type":"PropertyValue","name":"Applications","value":"machine translation"}]
{"id":1071,"datatype":"1","titleimg":"https://res.datatang.com/asset/productNew/APY200214003.png?Expires=2007353679&OSSAccessKeyId=LTAI5tQwXnJZbubgVfVa1ep9&Signature=ENpmDTNr3Z9Z3PGh4v3iWGHXzwU%3D","type1":"183","type1str":null,"type2":"185","type2str":null,"dataname":"1M Chinese-Russian Sentence Pairs – Machine Translation Dataset","datazy":[{"title":"Format","desc":"Format","content":"TXT"},{"title":"Data content","desc":"Data content","content":"Chinese-Russian Parallel Corpus Data"},{"title":"Data size","desc":"Data size","content":"1 million pairs of Chinese-Russian Parallel Corpus Data. The Chinese sentences contain 14.6 characters on average."},{"title":"Language","desc":"Language","content":"Chinese, Russian"},{"title":"Applications","desc":"Applications","content":"machine translation"}],"datatag":"Chinese,Russian,Chinese-Russian,Parallel corpus","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":"","samplePresentation":[{"name":"/data/apps/damp/temp/ziptemp/APY200214003_demo1711015207620/APY200214003_demo/APY200214003.jpeg","url":"https://bj-oss-datatang-03.oss-cn-beijing.aliyuncs.com/filesInfoUpload/data/apps/damp/temp/ziptemp/APY200214003_demo1711015207620/APY200214003_demo/APY200214003.jpeg?Expires=4102329599&OSSAccessKeyId=LTAI8NWs2pDolLNH&Signature=aHqzFroaIoDYyUGvhr4Wr0IdTlk%3D","intro":"","size":0,"progress":100,"type":"jpg"}],"officialSummary":"This dataset contains 1 million Chinese-Russian parallel sentence pairs stored in TXT format. The corpus covers multiple domains, including tourism, healthcare, daily life, TV dialogue, and other topics. The data has undergone cleaning, anonymization, and quality inspection. It can be used as a basic corpus for text data analysis in fields such as machine translation.","dataexampl":null,"datakeyword":["Chinese Russian parallel corpus","Chinese Russian translation dataset","Chinese Russian parallel dataset","Chinese Russian sentence pairs"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Type","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"nlu","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"1\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,JP,PT,DE,KO,FR,ES\"},{\"code\":\"3\",\"language\":\"EN\"},{\"code\":\"4\",\"language\":\"JP\"}]","productNameEn":"1,000,000 Groups - Chinese-Russian Parallel Corpus Data","BGimg":"","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
https://www.nexdata.ai/shujutang/static/image/index/datatang_wenben_default.webp
[{"@type":"ImageObject","embedUrl":"https://bj-oss-datatang-03.oss-cn-beijing.aliyuncs.com/filesInfoUpload/data/apps/damp/temp/ziptemp/APY200214003_demo1711015207620/APY200214003_demo/APY200214003.jpeg?Expires=4102329599&OSSAccessKeyId=LTAI8NWs2pDolLNH&Signature=aHqzFroaIoDYyUGvhr4Wr0IdTlk%3D"}]
1M Chinese-Russian Sentence Pairs – Machine Translation Dataset
Chinese Russian parallel corpus
Chinese Russian translation dataset
Chinese Russian parallel dataset
Chinese Russian sentence pairs
This dataset contains 1 million Chinese-Russian parallel sentence pairs stored in TXT format. The corpus covers multiple domains, including tourism, healthcare, daily life, TV dialogue, and other topics. The data has undergone cleaning, anonymization, and quality inspection. It can be used as a basic corpus for text data analysis in fields such as machine translation.
This is a paid datasets for commercial use, research purpose and more. Licensed ready made datasets help jump-start AI projects.
![Specifications]()
Specifications
Data content
Chinese-Russian Parallel Corpus Data
Data size
1 million pairs of Chinese-Russian Parallel Corpus Data. The Chinese sentences contain 14.6 characters on average.
Applications
machine translation
![Sample]()
Sample
![Recommended Datasets]()
Recommended Dataset
Tell Us Your Special Needs
78cfb9c8-56eb-4342-a0e2-2feb0a4c827d