消除背景雜音
放入錄音,即可降低電流嗡嗡聲、嘶嘶聲、交通噪音與閒聊雜音。降噪過程直接在您的瀏覽器中執行:除非您隨後按下「轉錄」,否則不會上傳任何內容,且無需登入帳號。
運作方式
雜音由 DeepFilterNet 3 消除,這是一個專為語音設計的開源神經網路。它以每 10 毫秒為單位分析錄音,並逐頻段調低判定非人聲的部分。
LICENSE-DeepFilterNet-MIT.txt · LICENSE-DeepFilterNet-APACHE.txt · THIRD-PARTY-NOTICES.txt
您的瀏覽器會解碼檔案,模型在您裝置的處理器上執行,降噪後的音訊則直接從此頁面儲存。首次選取錄音時,頁面會從 txscribe.ai 下載模型及其執行程式碼(解壓縮後約 20 MB),瀏覽器會保留該內容以供下次使用。
降噪後的檔案與原始檔案在取樣級別完全對齊,因此您可以在一個字的中間隨時切換,確切聽出前後變化。
適用的情境與限制
- 電流嗡嗡聲、嘶嘶聲、冷氣聲、雨聲、鍵盤聲、交通噪音
- 降低幅度最大。在我們的測試中,在說話字句停頓處,這些雜音均降至原本音量的一小部分。在說話聲底下,若雜音與人聲一樣大,人聲也會有些微被一併削弱。
- 背景中其他人的聲音
- 這取決於人聲。在我們的測試中,餐廳的嘈雜聲降幅與交通噪音相同;在個別聲音較突出的教室中,降幅則不到交通噪音的一半。此模型旨在保留人聲。
- 麥克風旁有其他人說話
- 聲音會變小,但不會被消除:在我們的測試中,第二個人的聲音音量降至約一半,而主要聲音也有些微減弱。模型無法判斷您想保留哪位說話者。
- 人聲比覆蓋其上的雜音更小
- 最棘手的情況:人聲可能會連同雜音一起被消除。在我們的測試中,在吵雜環境下的微弱遠處聲音,處理後的音量降至約十分之一。在使用處理結果之前,請先聆聽這些片段。
- 本就清晰無雜音的錄音
- 處理後幾乎沒有變化。
限制與格式
最長 10 分鐘且上限 500 MB
- 支援開啟的格式
- MP3、M4A、AAC、WAV、FLAC、OGG、Opus 與 WebM 音訊,以及 MP4 和 MOV 影片的聲音:在我們測試過的每種瀏覽器引擎中,這些都能成功解碼。其他格式則取決於您的瀏覽器;若無法解碼檔案,頁面上會顯示說明。
- 您將獲得的內容
- WAV 檔案:16-bit、48 kHz、單聲道 — 每分鐘約 5.5 MB。立體聲錄音會先混音為單聲道。若使用影片,您會取得其音訊,而非新的影片。
隱私權
錄音會保留在您的裝置上:它會在此進行解碼、清理與儲存,完全不會傳送到任何地方。我們會統計頁面中使用了哪些步驟——選取檔案、清理、下載——且不附帶任何檔案名稱、長度或聲音。只有「轉錄」會上傳原始錄音,按鈕旁亦有說明。
常見問題
這是免費的嗎?
是的,完全免費,無需帳號、無浮水印且無需安裝任何軟體。限制僅取決於檔案:最長 10 分鐘且上限 500 MB。
我的錄音會被上傳嗎?
直接在此瀏覽器中清除雜音。除非您隨後按下「轉錄」,否則不會上傳任何內容。
為什麼處理後有些字詞聽起來比較單薄?
當人聲與其背景雜音音量相當接近時,模型必須隨時判定何者為人聲,部分人聲便會連同雜音一起被削弱。比覆蓋其上的雜音更微弱的字詞,幾乎會完全消失。在使用處理結果之前,請針對重要片段在「降噪前」與「降噪後」之間切換試聽。
它可以清除影片中的雜音嗎?
可以:選取影片後,您會取得降噪後的聲音 WAV 檔 — 而非新的影片。
為什麼「轉錄」使用的是原始錄音,而非降噪後的版本?
降噪後的版本是為了聆聽而製作。降噪過程在改變雜音的同時也會些微改變人聲,我們並不宣稱這能讓逐字稿更準確 — 因此「轉錄」會傳送您原本選取的錄音檔案。
支援哪些瀏覽器?
較新的版本:Chrome 或 Edge、Firefox 114 或後續版本,或是 Safari 16.4 或後續版本。較舊的瀏覽器缺少執行所需的技術(支援 SIMD 的 WebAssembly 以及載入模組的 Worker);若您的瀏覽器無法執行,頁面會顯示提示。此工具使用您裝置的處理器與記憶體運算,因此效能較弱的裝置需要較長時間,手機處理較長的錄音時也可能耗盡記憶體;頁面會顯示剩餘時間。
除了聲音,還需要文字?
txscribe 支援轉錄 82 種語言的錄音,並為每個字詞標註時間戳記,點擊任何一行皆可回放對應的當下聲音。免費試用版無需帳號即可轉錄一段錄音,最多轉錄至第 10 分鐘。
免費開始使用