[{"@type":"PropertyValue","name":"Storage format","value":"text"},{"@type":"PropertyValue","name":"Data content","value":"Chinese-Urdu Parallel Corpus Data"},{"@type":"PropertyValue","name":"Data size","value":"0.98 million pairs of Chinese-Urdu Parallel Corpus Data. The Chinese sentences contain 19.9 characters on average."},{"@type":"PropertyValue","name":"Language","value":"Chinese, Urdu"},{"@type":"PropertyValue","name":"Accuracy rate","value":"90%"},{"@type":"PropertyValue","name":"Application scenario","value":"machine translation"}]
{"id":1247,"datatype":"1","titleimg":"https://www.nexdata.ai/shujutang/static/image/index/datatang_wenben_default.webp","type1":"183","type1str":null,"type2":"185","type2str":null,"dataname":"980K Chinese-Urdu Sentence Pairs – Machine Translation Dataset","datazy":[{"title":"Storage format","content":"text","desc":"Storage format"},{"title":"Data content","content":"Chinese-Urdu Parallel Corpus Data","desc":"Data content"},{"title":"Data size","content":"0.98 million pairs of Chinese-Urdu Parallel Corpus Data. The Chinese sentences contain 19.9 characters on average.","desc":"Data size"},{"title":"Language","content":"Chinese, Urdu","desc":"Language"},{"title":"Accuracy rate","content":"90%","desc":"Accuracy rate"},{"title":"Application scenario","content":"machine translation","desc":"Application scenario"}],"datatag":"Chinese,Urdu,Chinese-Urdu,Parallel Corpus","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":"","samplePresentation":[{"name":"/data/apps/damp/temp/ziptemp/APY230328001_demo1729159200917/zh-ur-demo.png","url":"https://bj-oss-datatang-03.oss-cn-beijing.aliyuncs.com/filesInfoUpload/data/apps/damp/temp/ziptemp/APY230328001_demo1729159200917/zh-ur-demo.png?Expires=4102329599&OSSAccessKeyId=LTAI8NWs2pDolLNH&Signature=nUPuvCfxkLg92E5Ay0vj079s53I%3D","intro":"","size":0,"progress":100,"type":"jpg"}],"officialSummary":"This dataset contains 980,000 Chinese-Urdu parallel sentence pairs stored in TXT format.The data has undergone cleaning, anonymization, and quality inspection to improve data quality and protect sensitive information. The dataset is suitable for machine translation, bilingual language modeling, and translation model training.","dataexampl":null,"datakeyword":["Chinese Urdu parallel corpus","Chinese Urdu translation dataset","Chinese Urdu parallel dataset","Chinese Urdu sentence pairs","Chinese Urdu translation corpus"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Type","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"nlu","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"1\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,JP,PT,DE,KO,FR,ES\"},{\"code\":\"3\",\"language\":\"EN\"},{\"code\":\"4\",\"language\":\"JP\"}]","productNameEn":"980,000 Groups - Chinese-Urdu Parallel Corpus Data","BGimg":"","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
https://www.nexdata.ai/shujutang/static/image/index/datatang_wenben_default.webp
[{"@type":"ImageObject","embedUrl":"https://bj-oss-datatang-03.oss-cn-beijing.aliyuncs.com/filesInfoUpload/data/apps/damp/temp/ziptemp/APY230328001_demo1729159200917/zh-ur-demo.png?Expires=4102329599&OSSAccessKeyId=LTAI8NWs2pDolLNH&Signature=nUPuvCfxkLg92E5Ay0vj079s53I%3D"}]
980K Chinese-Urdu Sentence Pairs – Machine Translation Dataset
Chinese Urdu parallel corpus
Chinese Urdu translation dataset
Chinese Urdu parallel dataset
Chinese Urdu sentence pairs
Chinese Urdu translation corpus
This dataset contains 980,000 Chinese-Urdu parallel sentence pairs stored in TXT format.The data has undergone cleaning, anonymization, and quality inspection to improve data quality and protect sensitive information. The dataset is suitable for machine translation, bilingual language modeling, and translation model training.
This is a paid dataset licensed for commercial use. Ready-made datasets are available for immediate integration into AI projects.
![Specifications]()
Specifications
Data content
Chinese-Urdu Parallel Corpus Data
Data size
0.98 million pairs of Chinese-Urdu Parallel Corpus Data. The Chinese sentences contain 19.9 characters on average.
Application scenario
machine translation
![Sample]()
Sample
![Recommended Datasets]()
Recommended Dataset
Tell Us Your Special Needs
94112cd2-2232-4ae2-8778-05b628bf2fb7