用于追踪和 ASR 的清洁音频

语音到文字引擎在噪音音频上跌倒。这个工具专门记录了记录,专门用于笔录——干净和低艺术,所以你的ASR或人类音译器都得到了每一个字。

🎧

在此放放一个音频或视频文件到这里

MP3, WAV, M4A, FLAC, OGG, AAC, MP4, MOV

轻柔 侵略

当音频已经相当干净时, 降下来给它轻轻触碰。

正在清理您的音频...

之前

提示: 按空格栏在 / 之前切换 。

下载已清理音频 签名全长文件

如何运作

我们使用低艺术消音器(DeepFilterNet), 而不是基因模型:它不发明细节就能消除噪音, 这正是语音识别引擎需要保持准确的。

做对什么好

  • 耳语/ASR预清除
  • 法律和医疗记录
  • 会晤和访谈笔记
  • 字幕和字幕

详细细节

引擎
DeepFilterNet
格式
MP3, WAV, M4A, FLAC, OGG, AAC, MP4, MOV
价格
自由尝试

经常问到的问题

生成增强器可以产生迷幻的细节,混淆ASR。这使用一种清洁、保守的除诺器,它可以将言语从噪音中解脱出来,而不会添加艺术品,从而最大限度地提高识别准确度。

用于转录,不是光,干净的去硝化,比重重恢复。保存扩音以收听,用它来准确。

是的,较清洁的记录对人体笔记本机和机器来说更快、更准确。

。 它清理音频, 使一个音频更能工作, 但不会输出文字本身。 用Whisper、您的字幕服务或打字员来对文件进行对齐, 以获得文字 。

因为它在不发明细节的情况下 将言语从噪音中解脱出来, 诸如Whisper和其他ASR模型的引擎 往往会减少在被清理的文件中 错误识别的回馈。

重力或基因增强可涂抹或发明能引起识别的电话。 DeepFilterNet故意保守,消除噪音,而没有讲话,这是ASR准确性所依赖的。

是的。 首先运行此清理为最清晰的演讲, 然后清除沉默, 填充器通道以收紧节奏, 所以最终文件既准确到可进行剪贴, 也快速听。

通用的音频格式被接受, 并且您可以得到一个解名的文档 以简易的文本格式 准备输入您的 ASR 管道 或者发送到一个音译机。

相关工具