Khử tiếng ồn nền

Thả bản ghi âm vào và nhận lại với tiếng ù, tiếng xì, tiếng giao thông và tiếng trò chuyện được giảm nhỏ. Quá trình làm sạch diễn ra ngay trong trình duyệt của quý vị: không có nội dung nào được tải lên trừ khi quý vị nhấn Chép lời sau đó, và không cần tài khoản.

Cách thức hoạt động

Tiếng ồn được khử bằng DeepFilterNet 3, một mạng nơ-ron mã nguồn mở được thiết kế cho giọng nói. Mạng này phân tích bản ghi âm từng mười mili giây một và giảm nhỏ, theo từng dải tần, những âm thanh bị coi là không phải tiếng nói.

LICENSE-DeepFilterNet-MIT.txt · LICENSE-DeepFilterNet-APACHE.txt · THIRD-PARTY-NOTICES.txt

Trình duyệt của quý vị giải mã tệp, mô hình chạy trên bộ xử lý của thiết bị, và âm thanh đã làm sạch được lưu từ trang này. Lần đầu tiên quý vị chọn một bản ghi âm, trang sẽ tải mô hình và mã vận hành từ txscribe.ai — khoảng 20 MB sau khi giải nén — và trình duyệt của quý vị sẽ lưu lại cho lần tiếp theo.

Tệp đã làm sạch khớp chuẩn xác từng mẫu âm thanh với tệp gốc, vì vậy quý vị có thể chuyển đổi qua lại giữa hai bản ngay giữa một từ để nghe rõ những gì đã thay đổi.

Những gì công cụ xử lý được, và không xử lý được

Tiếng ù, tiếng xì, tiếng điều hòa, tiếng mưa, bàn phím, giao thông
Được giảm nhỏ nhiều nhất. Trong các thử nghiệm của chúng tôi, vào các khoảng ngắt nghỉ giữa các từ, mỗi loại tiếng ồn này đều giảm xuống chỉ còn một phần nhỏ âm lượng. Bên dưới các từ, tại những nơi tiếng ồn to ngang tiếng nói, một phần nhỏ giọng nói cũng bị giảm theo.
Giọng nói của người khác trong nền
Điều đó phụ thuộc vào các giọng nói. Trong các thử nghiệm của chúng tôi, tiếng rì rầm trong nhà hàng giảm tương đương với tiếng xe cộ; một lớp học, nơi từng giọng nói riêng lẻ nổi bật, giảm chưa bằng một nửa so với tiếng xe cộ. Mô hình được xây dựng để giữ lại giọng nói.
Người khác đang nói gần micrô
Được giảm nhỏ, không phải bị loại bỏ: trong các thử nghiệm của chúng tôi, giọng nói thứ hai giảm xuống còn khoảng một nửa âm lượng, và giọng nói chính cũng bị mất đi đôi chút. Mô hình không thể nhận biết quý vị muốn giữ người nói nào.
Tiếng nói nhỏ hơn tiếng ồn đè lên
Trường hợp khó nhất: tiếng nói có thể bị mất cùng với tiếng ồn. Trong thử nghiệm của chúng tôi, một giọng nói ở xa bị lấn át bởi tiếng phòng lớn hơn đã giảm xuống còn khoảng một phần mười âm lượng. Quý vị hãy nghe lại các phần đó trước khi sử dụng kết quả.
Bản ghi âm vốn đã sạch tiếng
Nhận lại gần như không thay đổi.

Giới hạn và định dạng

Tối đa 10 phút và 500 MB

Các định dạng mở được
Âm thanh MP3, M4A, AAC, WAV, FLAC, OGG, Opus và WebM, cùng âm thanh của video MP4 và MOV: mỗi định dạng này đều được giải mã trên mọi engine trình duyệt mà chúng tôi đã thử nghiệm. Mọi định dạng khác phụ thuộc vào trình duyệt của quý vị; nếu không thể giải mã một tệp, trang sẽ thông báo điều đó.
Những gì quý vị nhận được
Tệp WAV: 16-bit, 48 kHz, một kênh — khoảng 5.5 MB mỗi phút. Bản ghi âm stereo sẽ được trộn thành mono trước. Với video, quý vị sẽ nhận lại âm thanh chứ không phải video mới.

Quyền riêng tư

Bản ghi âm được giữ lại trên thiết bị của quý vị: tệp được giải mã, làm sạch và lưu tại đây, và không có phần nào được gửi đi bất cứ đâu. Chúng tôi đếm các bước trên trang được sử dụng — tệp được chọn, làm sạch, tải xuống — mà không gắn liền với tên tệp, thời lượng hay âm thanh. Chỉ riêng Chép lời mới tải bản gốc lên, và điều này được ghi rõ bên cạnh nút bấm.

Câu hỏi thường gặp

Công cụ này có miễn phí không?

Có, không cần tài khoản, không có watermark và không cần cài đặt gì. Giới hạn phụ thuộc vào tệp: tối đa 10 phút và 500 MB.

Bản ghi âm của tôi có bị tải lên không?

Được làm sạch ngay trong trình duyệt này. Không có nội dung nào được tải lên trừ khi quý vị nhấn Chép lời sau đó.

Tại sao một số từ nghe mỏng hơn sau đó?

Khi giọng nói và tiếng ồn phía sau có độ to ngang nhau, mô hình phải phân định theo từng khoảnh khắc đâu là tiếng nói, và một phần giọng nói sẽ bị giảm nhỏ cùng với tiếng ồn. Một từ nhỏ hơn tiếng ồn đè lên có thể gần như biến mất hoàn toàn. Hãy chuyển đổi giữa Trước và Sau ở những đoạn quan trọng trước khi quý vị sử dụng kết quả.

Công cụ có làm sạch âm thanh của video được không?

Có: hãy chọn video và quý vị sẽ nhận lại âm thanh đã được làm sạch dưới dạng tệp WAV — chứ không phải một video mới.

Tại sao Chép lời lại dùng bản ghi âm gốc chứ không phải bản đã làm sạch?

Bản sao đã làm sạch được tạo ra để phục vụ việc nghe. Quá trình làm sạch làm thay đổi giọng nói đôi chút cũng như tiếng ồn, và chúng tôi không khẳng định việc này giúp bản chép lời chính xác hơn — vì vậy Chép lời sẽ gửi bản ghi âm đúng như khi quý vị đã chọn.

Công cụ hoạt động trên những trình duyệt nào?

Các trình duyệt gần đây: Chrome hoặc Edge, Firefox 114 trở lên, hoặc Safari 16.4 trở lên. Các trình duyệt cũ hơn thiếu các thành phần cần thiết để vận hành (WebAssembly với SIMD, và worker tải module), và trang sẽ thông báo nếu trình duyệt của quý vị không chạy được. Công cụ chạy trên bộ xử lý và bộ nhớ của thiết bị, do đó thiết bị chậm hơn sẽ mất nhiều thời gian hơn, và điện thoại có thể bị hết bộ nhớ với bản ghi âm dài; trang sẽ hiển thị thời gian còn lại.

Cần bản chép lời chứ không chỉ âm thanh?

txscribe chép lời các bản ghi âm bằng 82 ngôn ngữ, có dấu thời gian cho từng từ, để bất kỳ dòng nào cũng có thể phát lại đúng thời điểm nói ra. Bản dùng thử miễn phí nhận một bản ghi âm, tối đa đến phút thứ 10, không cần tài khoản.

Bắt đầu miễn phí