{"id":1268,"datatype":"1","titleimg":"https://www.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp","type1":"165","type1str":null,"type2":"166","type2str":null,"dataname":"1900 Hours Indonesian Speech Dataset with Real-world Speech Recordings","datazy":[{"title":"Format","content":"16kHz, 16 bit, wav, mono channel","desc":"Format"},{"title":"Recording environment","content":"Low background noise","desc":"Recording environment"},{"title":"Country","content":"Indonesia(IDN)","desc":"Country"},{"title":"Language(Region) Code","content":"id-ID","desc":"Language(Region) Code"},{"title":"Language","content":"Indonesian","desc":"Language"},{"title":"Features of annotation","content":"Transcription text, timestamp, speaker ID, gender, noise","desc":"Features of annotation"},{"title":"Accuracy","content":"Word Accuracy Rate (WAR) 98%","desc":"Accuracy"}],"datatag":"Indonesian,Casual Conversation,Monologue,Asr","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":"","samplePresentation":[{"name":"/data/apps/damp/temp/ziptemp/APY230831001_demo1713866400258/APY230831001_demo/000002_10.wav","url":"https://bj-oss-datatang-03.oss-cn-beijing.aliyuncs.com/filesInfoUpload/data/apps/damp/temp/ziptemp/APY230831001_demo1713866400258/APY230831001_demo/000002_10.wav?Expires=4102329599&OSSAccessKeyId=LTAI8NWs2pDolLNH&Signature=U7DE%2B8PaUh3mGc5rQjSLFoEZvlg%3D","intro":"Então pessoal, vamos começar! Olha só, aqui é a porta da entrada. [N]","size":0,"progress":100,"type":"mp3"},{"name":"/data/apps/damp/temp/ziptemp/APY230831001_demo1713866400258/APY230831001_demo/000002_6.wav","url":"https://bj-oss-datatang-03.oss-cn-beijing.aliyuncs.com/filesInfoUpload/data/apps/damp/temp/ziptemp/APY230831001_demo1713866400258/APY230831001_demo/000002_6.wav?Expires=4102329599&OSSAccessKeyId=LTAI8NWs2pDolLNH&Signature=nPINx1%2FDIzkRA7fBc2u9Ck8sLmA%3D","intro":"E eu vou mostrar tudinho pra vocês. Então vamos nessa! [N]","size":0,"progress":100,"type":"mp3"},{"name":"/data/apps/damp/temp/ziptemp/APY230831001_demo1713866400258/APY230831001_demo/000002_3.wav","url":"https://bj-oss-datatang-03.oss-cn-beijing.aliyuncs.com/filesInfoUpload/data/apps/damp/temp/ziptemp/APY230831001_demo1713866400258/APY230831001_demo/000002_3.wav?Expires=4102329599&OSSAccessKeyId=LTAI8NWs2pDolLNH&Signature=%2F06p6X64O14Md99%2FifY97ClflUA%3D","intro":"Pessoal, como vocês sabem eu me mudei de novo aqui no Canadá. [N]","size":0,"progress":100,"type":"mp3"},{"name":"/data/apps/damp/temp/ziptemp/APY230831001_demo1713866400258/APY230831001_demo/000002_11.wav","url":"https://bj-oss-datatang-03.oss-cn-beijing.aliyuncs.com/filesInfoUpload/data/apps/damp/temp/ziptemp/APY230831001_demo1713866400258/APY230831001_demo/000002_11.wav?Expires=4102329599&OSSAccessKeyId=LTAI8NWs2pDolLNH&Signature=drrQSehnTtj0aNB0AMig555Qrc4%3D","intro":"E a primeira coisa que a gente vê quando a gente entra é o estúdio! [N]","size":0,"progress":100,"type":"mp3"},{"name":"/data/apps/damp/temp/ziptemp/APY230831001_demo1713866400258/APY230831001_demo/000002_7.wav","url":"https://bj-oss-datatang-03.oss-cn-beijing.aliyuncs.com/filesInfoUpload/data/apps/damp/temp/ziptemp/APY230831001_demo1713866400258/APY230831001_demo/000002_7.wav?Expires=4102329599&OSSAccessKeyId=LTAI8NWs2pDolLNH&Signature=fMSWclv5tUQGQrM6dedOEuqPpXA%3D","intro":"Mas antes eu vou dar um tempinho para vocês darem o seu like. [N]","size":0,"progress":100,"type":"mp3"}],"officialSummary":"This dataset contains 1900 hours of real-world Indonesian speech collected from natural conversations and monologue recordings. Each audio sample is transcribed with corresponding text content, speaker ID, gender, and additional metadata attributes. Quality tested by various AI companies. We strictly adhere to data protection regulations and privacy standards, ensuring the maintenance of user privacy and legal rights throughout the data collection, storage, and usage processes, our datasets are all GDPR, CCPA, PIPL complied.","dataexampl":null,"datakeyword":["indonesian speech dataset","indonesian ASR dataset","indonesian conversational speech dataset","indonesian speech corpus","conversational AI dataset","speech recognition training data"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Data Type,Language","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"speechRec","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"1\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,JP,PT,DE,KO,FR,ES\"},{\"code\":\"3\",\"language\":\"EN\"},{\"code\":\"4\",\"language\":\"JP\"}]","productNameEn":"1900 Hours - Indonesian Spontaneous Speech Data","BGimg":"brightSpot_audio","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
1900 Hours Indonesian Speech Dataset with Real-world Speech Recordings
indonesian speech dataset
indonesian ASR dataset
indonesian conversational speech dataset
indonesian speech corpus
conversational AI dataset
speech recognition training data
This dataset contains 1900 hours of real-world Indonesian speech collected from natural conversations and monologue recordings. Each audio sample is transcribed with corresponding text content, speaker ID, gender, and additional metadata attributes. Quality tested by various AI companies. We strictly adhere to data protection regulations and privacy standards, ensuring the maintenance of user privacy and legal rights throughout the data collection, storage, and usage processes, our datasets are all GDPR, CCPA, PIPL complied.
This is a paid datasets for commercial use, research purpose and more. Licensed ready made datasets help jump-start AI projects.