消除背景噪音

拖入一段录音,即可降低其中的嗡嗡声、嘶嘶声、交通噪音和嘈杂人声。整个清理过程完全在你的浏览器中运行:无需注册账户,除非你随后点击“转写”,否则不会上传任何内容。

工作原理

噪音由专为人声打造的开源神经网络 DeepFilterNet 3 消除。它每次分析录音中的 10 毫秒片段,逐个频段调低其判定为非人声的部分。

LICENSE-DeepFilterNet-MIT.txt · LICENSE-DeepFilterNet-APACHE.txt · THIRD-PARTY-NOTICES.txt

你的浏览器会对文件进行解码,模型在你设备的处理器上运行,清理后的音频直接从此页面保存。当你首次选择录音时,页面会从 txscribe.ai 下载该模型及运行代码——解压后约为 20 MB——你的浏览器会将其保留以供下次使用。

清理后的文件与原文件在采样级别完全对齐,因此即使在某个词发音的中途切换,也能准确听出前后的变化。

它能处理什么,不能处理什么

嗡嗡声、嘶嘶声、空调声、雨声、键盘敲击声、交通噪音
调低幅度最大。在我们的测试中,在词与词之间的停顿处,这些噪音的音量均降至原本的一小部分。在说话过程中,若噪音与人声同样响亮,人声也会随之受到轻微损失。
背景中的其他人声
这取决于具体的人声。在我们的测试中,餐厅里的低语杂音降幅与交通噪音相当;而在单个人声较为突出的教室里,降幅还不到交通噪音的一半。该模型旨在保留人声。
麦克风附近的其他人声
声音会被调低,但并未消除:在我们的测试中,第二个人声的音量降至约一半,主要人声也略有损失。模型无法分辨你想保留的是哪位说话人。
音量低于背景噪音的人声
最棘手的情况:人声可能会随噪音一同被消除。在我们的测试中,当房间环境声更响时,远处的人声音量降至约十分之一。在使用处理结果前,请务必试听这些片段。
本身就很干净的录音
处理结果几乎没有变化。

限制与支持的格式

最长 10 分钟且最大 500 MB

支持打开的文件
MP3、M4A、AAC、WAV、FLAC、OGG、Opus 和 WebM 音频,以及 MP4 和 MOV 视频的声音:在我们测试过的每个浏览器引擎中,这些格式均成功解码。其他格式则取决于你的浏览器;如果它无法解码某个文件,页面会明确提示。
你将获得的内容
WAV 文件:16 位、48 kHz、单声道——每分钟约 5.5 MB。立体声录音会先混音为单声道。视频文件导出的是其中的音频,而非新视频。

隐私政策

录音会保留在你的设备上:它在这里完成解码、降噪并保存,任何内容都不会发送到任何地方。我们统计页面使用了哪些步骤——选择文件、降噪、下载——且不附带任何文件名、时长或声音。只有“转写”会上传原录音,按钮旁也对此做了说明。

常见问题

这是免费的吗?

是的,无需账户、无水印,也无需安装任何软件。唯一的限制来自文件本身:最长 10 分钟且最大 500 MB。

我的录音会被上传吗?

全部在本浏览器中完成清理。除非你随后点击“转写”,否则不会上传任何内容。

为什么处理后有些字词听起来变单薄了?

当人声与背景噪音音量相当时,模型必须实时判定哪些是人声,部分人声便会随噪音一同被调低。音量低于背景噪音的字词甚至可能几乎听不见。在使用处理结果前,请务必针对重要片段在“降噪前”与“降噪后”之间进行切换对比。

能清理视频中的声音吗?

可以:选择视频后,你将获得一段清理后的 WAV 音频文件——而非新的视频。

为什么“转写”使用的是原始录音,而非清理后的副本?

清理后的副本专为收听而制作。清理过程在改变噪音的同时也会轻微改变人声,我们并不宣称这能提高转写稿的准确度——因此“转写”发送的是你最初选择的录音。

支持哪些浏览器?

较新的版本均可:Chrome 或 Edge、Firefox 114 或更高版本,或者 Safari 16.4 或更高版本。较旧的浏览器缺少其运行所需的特性(带 SIMD 的 WebAssembly 以及加载模块的 Worker);如果你的浏览器无法运行,页面会给出提示。该工具在你设备的处理器和内存中运行,因此性能较弱的设备耗时会更长,手机在处理长录音时也可能出现内存不足;页面会显示剩余时间。

不只需要声音,还需要文字内容?

txscribe 支持转写 82 种语言的录音,每个词都带有时间戳,点击任意一行即可跳转回放对应的录音片段。免费试用无需账户,可转写一段录音(最多转写至第 10 分钟)。

免费体验