Tīrīt audio transkripciju un ASR

Vārdu tulkošanas dzinēji klūp uz trokšņaina audio. Šis rīks denozē ierakstu īpaši transkripcijai — tīru un zemu artifaktu, lai jūsu ASR vai cilvēka transkripcija saņemtu katru vārdu.

🎧

Šeit nomest audio vai video failu

vai

MP3, WAV, M4A, FLAC, OGG, AAC, MP4, MOV

Maiga Agresīva

Nolaist to par vieglu pieskārienu, kad audio jau ir diezgan tīrs.

Attīrīt audio...

Pirms

Padoms: nospiediet starpdevēju, lai pārslēgtos pirms / pēc.

Lejupielādēt iztīrītu audio Pieteikties pilna garuma failiem

Kā tas darbojas

Mēs izmantojam zemu artifaktu denozatoru (DeepFilterNet), nevis ģeneratīvu modeli: tas novērš troksni bez izgudrojuma detaļām, kas ir tieši tas, kam ir jābūt valodas atpazīšanas dzinējiem, lai saglabātu precizitāti.

Ko tas nāk par labu

  • Iepriekšēja Whisper/ASR tīrīšana
  • Tiesiskā un medicīniskā transkripcija
  • Tikšanās un intervijas piezīmes
  • Paraksts un subtitri

Detaļas

Motors
DeepFilterNet
Formāti
MP3, WAV, M4A, FLAC, OGG, AAC, MP4, MOV
Cena
Var mēģināt

Bieži uzdotie jautājumi

Ģeneratoriskie pastiprinātāji var halucinēt detaļas, kas mulsina ASR. Tas izmanto tīru, konservatīvu denoiser, kas paceļ runu no trokšņa, nepievienojot artefaktus, maksimāli palielinot atpazīstamības precizitāti.

Transkripcijai, nē — gaismai, tīrai denoizēšanai – tā ir smaga restaurācija. Saglabājiet balss pastiprinājumu klausīšanās nolūkā, izmantojiet to precizitātei.

Jā — tīrāka ierakstīšana ir ātrāka un precīzāka gan cilvēku transkrīleriem, gan mašīnām.

Nē. Tā attīra audio, tāpēc caurspīdīgums darbojas labāk, bet pats nevada tekstu. Pāris notīrīto failu ar Whisper, jūsu pareizrakstības pakalpojumu vai cilvēka tipogrāfistu, lai iegūtu vārdus.

Tā kā runas tiek izceltas no trokšņa, neizgudrojot detaļas, tādiem dzinējiem kā Whisper un citiem SR modeļiem ir tendence atgriezties mazāk kļūdainas atziņas uz attīrītās datnes.

Smags vai ģeneratīvs uzlabojums var nosmakdīt vai izgudrot fonēmu, kas izmet atpazīšanu off. DeepFilterNet ir apzināti konservatīvs, novēršot troksni, vienlaikus atstājot runu neskartu, kas ir tas, ko AZR precizitāte ir atkarīga no.

Jā. Palaist šo tīrīšana vispirms par visskaidrāko runu, tad klusuma noņemšana un pildviela iet, lai pastiprinātu pacing, tāpēc galīgais fails ir gan precīzi transratēt un ātri klausīties.

Tiek pieņemti kopēji audio formāti, un jūs saņemsiet denozēts failu atpakaļ transkripcijas draudzīgu formātā gatavs barot savā ASR cauruļvadā vai nosūtīt uz transkripcija.

Saistītie rīki