[{"@type":"PropertyValue","name":"Storage format","value":"TXT"},{"@type":"PropertyValue","name":"Data content","value":"English-Russian Parallel Corpus Data"},{"@type":"PropertyValue","name":"Data size","value":"1.08 million pairs of English-Russian Parallel Corpus Data"},{"@type":"PropertyValue","name":"Language","value":"English,Russian"},{"@type":"PropertyValue","name":"Application scenario","value":"machine translation"}]
{"id":1161,"datatype":"1","titleimg":"https://res.datatang.com/asset/productNew/APY220223001.png?Expires=2007353706&OSSAccessKeyId=LTAI5tQwXnJZbubgVfVa1ep9&Signature=EgH2IISVLz3OemUoJ1/gULYFyZ8%3D","type1":"183","type1str":null,"type2":"185","type2str":null,"dataname":"1.08 Million English Russian Parallel Corpus Dataset for Machine Translation","datazy":[{"title":"Storage format","content":"TXT","desc":"Storage format"},{"title":"Data content","content":"English-Russian Parallel Corpus Data","desc":"Data content"},{"title":"Data size","content":"1.08 million pairs of English-Russian Parallel Corpus Data","desc":"Data size"},{"title":"Language","content":"English,Russian","desc":"Language"},{"title":"Application scenario","content":"machine translation","desc":"Application scenario"}],"datatag":"English-Russian parallel corpus","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":["1,080,000 groups","English and Russian parallel corpus","exclusion of sensitive information"],"samplePresentation":[{"name":"/data/apps/damp/temp/ziptemp/APY220223001_demo1711015208273/APY220223001_demo/en-ru ????.png","url":"https://bj-oss-datatang-03.oss-cn-beijing.aliyuncs.com/filesInfoUpload/data/apps/damp/temp/ziptemp/APY220223001_demo1711015208273/APY220223001_demo/en-ru%20%3F%3F%3F%3F.png?Expires=4102329599&OSSAccessKeyId=LTAI8NWs2pDolLNH&Signature=%2F1NNj5zLYWX%2FmXN90lAYksiCeD8%3D","intro":"","size":0,"progress":100,"type":"jpg"}],"officialSummary":"This dataset contains 1.08 million English-Russian sentence pairs, the corpus consists of aligned English and Russian text data covering diverse topics and general language usage scenarios. Sensitive content, including political, adult, and personally identifiable information (PII), has been filtered and removed. it can be a base corpus for machine translation, natural language processing, and multilingual AI model development.","dataexampl":null,"datakeyword":["english russian parallel corpus","english russian translation dataset","english russian bilingual dataset","parallel corpus dataset","machine translation dataset"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Type","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"nlu","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,JP,PT,DE,KO,FR,ES\"},{\"code\":\"4\",\"language\":\"JP\"}]","productNameEn":"1,080,000 Groups – English-Russian Parallel Corpus Data","BGimg":"","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
https://www.nexdata.ai/shujutang/static/image/index/datatang_wenben_default.webp
[{"@type":"ImageObject","embedUrl":"https://bj-oss-datatang-03.oss-cn-beijing.aliyuncs.com/filesInfoUpload/data/apps/damp/temp/ziptemp/APY220223001_demo1711015208273/APY220223001_demo/en-ru%20%3F%3F%3F%3F.png?Expires=4102329599&OSSAccessKeyId=LTAI8NWs2pDolLNH&Signature=%2F1NNj5zLYWX%2FmXN90lAYksiCeD8%3D"}]
1.08 Million English Russian Parallel Corpus Dataset for Machine Translation
english russian parallel corpus
english russian translation dataset
english russian bilingual dataset
parallel corpus dataset
machine translation dataset
This dataset contains 1.08 million English-Russian sentence pairs, the corpus consists of aligned English and Russian text data covering diverse topics and general language usage scenarios. Sensitive content, including political, adult, and personally identifiable information (PII), has been filtered and removed. it can be a base corpus for machine translation, natural language processing, and multilingual AI model development.
This is a paid datasets for commercial use, research purpose and more. Licensed ready made datasets help jump-start AI projects.
![Specifications]()
Specifications
Data content
English-Russian Parallel Corpus Data
Data size
1.08 million pairs of English-Russian Parallel Corpus Data
Application scenario
machine translation
![Sample]()
Sample
![Recommended Datasets]()
Recommended Dataset
Tell Us Your Special Needs
312fc89e-3077-4635-9a86-1f5ee2d53df1