ဘာသာပြန်ချက်နှင့် ASR အတွက်အသံရှင်းလင်း
ဤ tool ကို transcription အတွက်အထူးသဖြင့်မှတ်တမ်းတင် denoises - သန့်ရှင်းသောနှင့်အနည်းငယ်-artifact ဒါကြောင့်သင်၏ ASR သို့မဟုတ်လူသား transcriber အားလုံးစကားလုံးရယူ.
လုပ်ဆောင်ပုံ
ကျနော်တို့ generative ပုံစံထက်အနည်းငယ်-artifact denoiser ကိုအသုံးပြု (DeepFilterNet): ၎င်းသည်အသေးစိတ်ကိုဖန်တီးခြင်းမရှိဘဲအသံကိုဖယ်ရှား, ဤသည်စကားပြော-အသိအမှတ်ပြုအင်ဂျင်နီယာများတိကျစွာနေထိုင်ရန်လိုအပ်သောအရာကိုဖြစ်ပါသည်.
ဘာအတွက်ကောင်းတယ်
- Whisper / ASR အတွက် pre-cleaning
- ဥပဒေနှင့်ဆေးဘက်ဆိုင်ရာ transcription
- တွေ့ဆုံဆွေးနွေးခြင်းနှင့်တွေ့ဆုံမေးမြန်းခြင်းမှတ်စုများ
- စာသားနှင့်စာတန်းထိုး
အသေးစိတ်
- အင်ဂျင်
- DeepFilterNet
- ပုံစံများ
- MP3, WAV, M4A, FLAC, OGG, AAC, MP4, MOV
- ဈေးနှုန်း
- ကြိုးစားရန်အခမဲ့
မေးလေ့ရှိသောမေးခွန်းများ
Generative enhancers ASR ရောနှောကြောင်းအသေးစိတ်ကို hallucinate နိုင်ပါတယ်. ဤသည် artifacts ထည့်သွင်းခြင်းမရှိဘဲအသံထွက်စကားပြော lifts သောသန့်ရှင်းသော, ထိန်းသိမ်းစောင့်ရှောက် denoiser ကိုအသုံးပြု, အသိအမှတ်ပြုမှုတိကျမှုတိုးမြှင့်.
transcription အတွက်, ဟုတ်ကဲ့ - အလင်း, ရှင်းလင်း denoising ကြီးမားသောပြန်လည်ထူထောင်ရေးကိုတိုက်. နားထောင်ဖို့အတွက်အသံ-တိုးမြှင့် Save, တိကျမှုအတွက်ဤသုံးပါ။
ဟုတ်ကဲ့ - ရှင်းလင်းသောမှတ်တမ်းတင်ခြင်းသည်လူသား transcribers များသာမကစက်ပစ္စည်းများအတွက်ပိုမိုမြန်ဆန်ပြီးပိုမိုတိကျသည်။
ဟုတ်ကဲ့. ဒါဟာ transcriber ပိုကောင်းတဲ့အလုပ်လုပ်တဲ့အတွက်အသံကိုရှင်းလင်း, ဒါပေမဲ့၎င်းသည်စာသားကိုကိုယ် output ကိုမပေး. Whisper နှင့်အတူရှင်းလင်းဖိုင်ကိုပေါင်းစပ်, စကားလုံးများကိုရဖို့သင့်ရဲ့ captioning ဝန်ဆောင်မှုသို့မဟုတ်လူသား typist.
အကြောင်းမှာအသေးစိတ်ကိုဖန်တီးခြင်းမရှိဘဲအသံထွက်စကားပြော lifts, Whisper ကဲ့သို့အင်ဂျင်များနှင့်အခြား ASR ပုံစံများသန့်ရှင်းဖိုင်ပေါ်တွင်အနည်းငယ် misrecognitions ပြန်ပေးဆွဲဖို့လေ့ရှိပါတယ်.
DeepFilterNet သတိရှိရှိ conservative ဖြစ်ပါတယ်, စကားပြောမထိခိုက်ထားပြီးအသံကိုဖယ်ရှားခြင်း, တစ်ခုမှာ ASR တိကျမှုအပေါ်မူတည်သည်ဘာဖြစ်ပါသည်.
ဟုတ်ကဲ့. ရှင်းလင်းဆုံးစကားပြောအတွက်ပထမဦးဆုံးဒီရှင်းလင်းရေးကို run, ထို့နောက်တိတ်ဆိတ်မှုဖယ်ရှားရေးနှင့် pacing တင်းကျပ်ဖို့ filler ဖြတ်သန်း, ထို့ကြောင့်နောက်ဆုံးဖိုင်ကို transcribe ဖို့နှစ်ဦးစလုံးတိကျပြီးနားထောင်ဖို့မြန်ဆန်တဲ့ဖြစ်ပါတယ်.
အများအပြားအသံ formats များလက်ခံရရှိကြသည်, သင်သည်သင်၏ ASR pipeline သို့ feed သို့မဟုတ် transcriber သို့ပို့ဖို့အဆင်သင့်ဖြစ်သော transcription-friendly format တွင်ပြန် denoised ဖိုင်ကိုရယူပါ.