Audio bersih untuk transkripsi & ASR
Enjin ucapan-ke-teks tergelincir pada audio bising. Alat ini membuang bunyi bising pada rakaman khusus untuk transkripsi - bersih dan artefak rendah supaya ASR atau transkripsi manusia anda dapat setiap perkataan.
Bagaimana ia berfungsi
Kami menggunakan denoiser artefak rendah (DeepFilterNet) bukannya model generatif: ia menghapuskan bunyi tanpa mencipta perincian, yang adalah apa yang enjin pengenalan ucapan perlu untuk kekal tepat.
Apa yang baik untuk
- Pra-pembersihan untuk Whisper / ASR
- Transkripsi undang-undang dan perubatan
- Nota Mesyuarat dan Wawancara
- Captioning dan subtitle
Perincian
- Enjin
- DeepFilterNet
- Format
- MP3, WAV, M4A, FLAC, OGG, AAC, MP4, MOV
- Harga
- Bebas untuk mencuba
Pertanyaan yang kerap ditanya
Peningkatan generatif boleh menghasut perincian yang mengelirukan ASR. Ini menggunakan denoiser bersih, konservatif yang mengangkat percakapan dari bunyi bising tanpa menambah artefak, memaksimumkan ketelusan pengenalan.
Untuk transkripsi, tidak — pengurangan bunyi yang ringan dan bersih lebih baik daripada pemulihan yang berat. Simpan penambahbaikan suara untuk mendengar, gunakan ini untuk ketelusan.
Ya — rakaman yang bersih lebih cepat dan lebih tepat untuk penterjemah manusia dan mesin.
Tidak. Ia membersihkan audio supaya penterjemah berfungsi dengan lebih baik, tetapi ia tidak menghasilkan teks sendiri. Pair fail yang dibersihkan dengan Whisper, perkhidmatan subtitel anda atau jurutulis manusia untuk mendapatkan perkataan.
Kerana ia mengangkat ucapan dari bunyi tanpa mencipta rincian, enjin seperti Whisper dan model ASR lain cenderung untuk mengembalikan kurang kesalahan pengenalan pada fail yang dibersihkan.
Peningkatan berat atau generatif boleh merosakkan atau mencipta fonem yang membuang pengenalan. DeepFilterNet adalah konservatif, menghapuskan bunyi bising sambil meninggalkan ucapan tidak disentuh, yang mana ketelusan ASR bergantung padanya.
Ya. Jalankan pembersihan ini pertama untuk ucapan yang jelas, kemudian pembersihan kesunyian dan laluan pengisi untuk mengetatkan pergerakan, jadi fail akhir adalah baik untuk transkripsi dan cepat untuk mendengar.
Format audio biasa diterima, dan anda akan mendapat fail denoised kembali dalam format transkripsi-mesra sedia untuk dimasukkan ke dalam paip ASR anda atau dihantar ke transkripsi.