消除背景噪音
拖入一段录音,即可降低其中的嗡嗡声、嘶嘶声、交通噪音和嘈杂人声。整个清理过程完全在你的浏览器中运行:无需注册账户,除非你随后点击“转写”,否则不会上传任何内容。
工作原理
噪音由专为人声打造的开源神经网络 DeepFilterNet 3 消除。它每次分析录音中的 10 毫秒片段,逐个频段调低其判定为非人声的部分。
LICENSE-DeepFilterNet-MIT.txt · LICENSE-DeepFilterNet-APACHE.txt · THIRD-PARTY-NOTICES.txt
你的浏览器会对文件进行解码,模型在你设备的处理器上运行,清理后的音频直接从此页面保存。当你首次选择录音时,页面会从 txscribe.ai 下载该模型及运行代码——解压后约为 20 MB——你的浏览器会将其保留以供下次使用。
清理后的文件与原文件在采样级别完全对齐,因此即使在某个词发音的中途切换,也能准确听出前后的变化。
它能处理什么,不能处理什么
- 嗡嗡声、嘶嘶声、空调声、雨声、键盘敲击声、交通噪音
- 调低幅度最大。在我们的测试中,在词与词之间的停顿处,这些噪音的音量均降至原本的一小部分。在说话过程中,若噪音与人声同样响亮,人声也会随之受到轻微损失。
- 背景中的其他人声
- 这取决于具体的人声。在我们的测试中,餐厅里的低语杂音降幅与交通噪音相当;而在单个人声较为突出的教室里,降幅还不到交通噪音的一半。该模型旨在保留人声。
- 麦克风附近的其他人声
- 声音会被调低,但并未消除:在我们的测试中,第二个人声的音量降至约一半,主要人声也略有损失。模型无法分辨你想保留的是哪位说话人。
- 音量低于背景噪音的人声
- 最棘手的情况:人声可能会随噪音一同被消除。在我们的测试中,当房间环境声更响时,远处的人声音量降至约十分之一。在使用处理结果前,请务必试听这些片段。
- 本身就很干净的录音
- 处理结果几乎没有变化。
限制与支持的格式
最长 10 分钟且最大 500 MB
- 支持打开的文件
- MP3、M4A、AAC、WAV、FLAC、OGG、Opus 和 WebM 音频,以及 MP4 和 MOV 视频的声音:在我们测试过的每个浏览器引擎中,这些格式均成功解码。其他格式则取决于你的浏览器;如果它无法解码某个文件,页面会明确提示。
- 你将获得的内容
- WAV 文件:16 位、48 kHz、单声道——每分钟约 5.5 MB。立体声录音会先混音为单声道。视频文件导出的是其中的音频,而非新视频。
隐私政策
录音会保留在你的设备上:它在这里完成解码、降噪并保存,任何内容都不会发送到任何地方。我们统计页面使用了哪些步骤——选择文件、降噪、下载——且不附带任何文件名、时长或声音。只有“转写”会上传原录音,按钮旁也对此做了说明。
常见问题
这是免费的吗?
是的,无需账户、无水印,也无需安装任何软件。唯一的限制来自文件本身:最长 10 分钟且最大 500 MB。
我的录音会被上传吗?
全部在本浏览器中完成清理。除非你随后点击“转写”,否则不会上传任何内容。
为什么处理后有些字词听起来变单薄了?
当人声与背景噪音音量相当时,模型必须实时判定哪些是人声,部分人声便会随噪音一同被调低。音量低于背景噪音的字词甚至可能几乎听不见。在使用处理结果前,请务必针对重要片段在“降噪前”与“降噪后”之间进行切换对比。
能清理视频中的声音吗?
可以:选择视频后,你将获得一段清理后的 WAV 音频文件——而非新的视频。
为什么“转写”使用的是原始录音,而非清理后的副本?
清理后的副本专为收听而制作。清理过程在改变噪音的同时也会轻微改变人声,我们并不宣称这能提高转写稿的准确度——因此“转写”发送的是你最初选择的录音。
支持哪些浏览器?
较新的版本均可:Chrome 或 Edge、Firefox 114 或更高版本,或者 Safari 16.4 或更高版本。较旧的浏览器缺少其运行所需的特性(带 SIMD 的 WebAssembly 以及加载模块的 Worker);如果你的浏览器无法运行,页面会给出提示。该工具在你设备的处理器和内存中运行,因此性能较弱的设备耗时会更长,手机在处理长录音时也可能出现内存不足;页面会显示剩余时间。
不只需要声音,还需要文字内容?
txscribe 支持转写 82 种语言的录音,每个词都带有时间戳,点击任意一行即可跳转回放对应的录音片段。免费试用无需账户,可转写一段录音(最多转写至第 10 分钟)。
免费体验