[{"@type":"PropertyValue","name":"Storage format","value":"TXT"},{"@type":"PropertyValue","name":"Data content","value":"English-Korean Parallel Corpus Data"},{"@type":"PropertyValue","name":"Data size","value":"1.34 million pairs of English-Korean Parallel Corpus Data"},{"@type":"PropertyValue","name":"Language","value":"English,Korean"},{"@type":"PropertyValue","name":"Application scenario","value":"machine translation"},{"@type":"PropertyValue","name":"Accuracy rate","value":"90%"}]
{"id":154,"datatype":"1","titleimg":"https://res.datatang.com/asset/productNew/APY170101230.png?Expires=2007353639&OSSAccessKeyId=LTAI5tQwXnJZbubgVfVa1ep9&Signature=QrHtHoKu1MGDukNHcfJYXttPpuc%3D","type1":"183","type1str":null,"type2":"185","type2str":null,"dataname":"1.34 Million English Korean Parallel Corpus Dataset for Machine Translation","datazy":[{"title":"Storage format","desc":"Storage format","content":"TXT"},{"title":"Data content","desc":"Data content","content":"English-Korean Parallel Corpus Data"},{"title":"Data size","desc":"Data size","content":"1.34 million pairs of English-Korean Parallel Corpus Data"},{"title":"Language","desc":"Language","content":"English,Korean"},{"title":"Application scenario","desc":"Application scenario","content":"machine translation"},{"title":"Accuracy rate","desc":"Accuracy rate","content":"90%"}],"datatag":"English-Korean parallel corpus","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":["1340,000 groups","English and Korean parallel corpus","exclusion of sensitive information"],"samplePresentation":[{"name":"/data/apps/damp/temp/ziptemp/APY170101230_demo1711015203502/APY170101230_demo/en-ko ????.png","url":"https://bj-oss-datatang-03.oss-cn-beijing.aliyuncs.com/filesInfoUpload/data/apps/damp/temp/ziptemp/APY170101230_demo1711015203502/APY170101230_demo/en-ko%20%3F%3F%3F%3F.png?Expires=4102329599&OSSAccessKeyId=LTAI8NWs2pDolLNH&Signature=Vo%2BLjKmUdUCwoKpjtWBPOzQwj5Y%3D","intro":"","size":0,"progress":100,"type":"jpg"}],"officialSummary":"This dataset contains 1.34 million English-Korean sentence pairs, providing high-quality bilingual text resources for machine translation, natural language processing, and multilingual AI model training. The corpus consists of aligned English and Korean text data covering diverse topics and general language usage scenarios. Sensitive content, including political, adult, and personally identifiable information (PII), has been filtered and removed. It can be a base corpus for text-based data analysis, used in machine translation and other fields.","dataexampl":null,"datakeyword":["english korean parallel corpus","english korean translation dataset","korean english translation dataset","korean bilingual dataset","machine translation dataset","parallel corpus dataset"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Type","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"nlu","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"1\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,JP,PT,DE,KO,FR,ES\"},{\"code\":\"3\",\"language\":\"EN\"},{\"code\":\"4\",\"language\":\"JP\"}]","productNameEn":"1,340,000 Groups – English-Korean Parallel Corpus Data","BGimg":"","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
https://www.nexdata.ai/shujutang/static/image/index/datatang_wenben_default.webp
[{"@type":"ImageObject","embedUrl":"https://bj-oss-datatang-03.oss-cn-beijing.aliyuncs.com/filesInfoUpload/data/apps/damp/temp/ziptemp/APY170101230_demo1711015203502/APY170101230_demo/en-ko%20%3F%3F%3F%3F.png?Expires=4102329599&OSSAccessKeyId=LTAI8NWs2pDolLNH&Signature=Vo%2BLjKmUdUCwoKpjtWBPOzQwj5Y%3D"}]
1.34 Million English Korean Parallel Corpus Dataset for Machine Translation
english korean parallel corpus
english korean translation dataset
korean english translation dataset
korean bilingual dataset
machine translation dataset
parallel corpus dataset
This dataset contains 1.34 million English-Korean sentence pairs, providing high-quality bilingual text resources for machine translation, natural language processing, and multilingual AI model training. The corpus consists of aligned English and Korean text data covering diverse topics and general language usage scenarios. Sensitive content, including political, adult, and personally identifiable information (PII), has been filtered and removed. It can be a base corpus for text-based data analysis, used in machine translation and other fields.
This is a paid datasets for commercial use, research purpose and more. Licensed ready made datasets help jump-start AI projects.
![Specifications]()
Specifications
Data content
English-Korean Parallel Corpus Data
Data size
1.34 million pairs of English-Korean Parallel Corpus Data
Application scenario
machine translation
![Sample]()
Sample
![Recommended Datasets]()
Recommended Dataset
Tell Us Your Special Needs
05eed97c-ec72-448f-8a2b-4ceb745e48bd