ตัดเสียงรบกวน

ลากไฟล์บันทึกเสียงมาวาง แล้วรับไฟล์ที่ลดเสียงหึ่ง เสียงซ่า เสียงการจราจร และเสียงพูดคุยรอบข้างลง กระบวนการตัดเสียงรบกวนทำงานในเบราว์เซอร์ของคุณ ไม่มีการอัปโหลดไฟล์ใดๆ เว้นแต่คุณจะกดปุ่มถอดเสียงในภายหลัง และไม่ต้องใช้บัญชีผู้ใช้

วิธีการทำงาน

เสียงรบกวนถูกตัดออกโดย DeepFilterNet 3 ซึ่งเป็นโครงข่ายประสาทเทียมโอเพนซอร์สที่ออกแบบมาสำหรับเสียงพูดโดยเฉพาะ ระบบจะวิเคราะห์การบันทึกเสียงทีละ 10 มิลลิวินาที และปรับลดระดับความถี่ในแต่ละย่านที่ประเมินว่าไม่ใช่เสียงพูดให้เบาลง

LICENSE-DeepFilterNet-MIT.txt · LICENSE-DeepFilterNet-APACHE.txt · THIRD-PARTY-NOTICES.txt

เบราว์เซอร์ของคุณจะถอดรหัสไฟล์ ตัวโมเดลจะประมวลผลบนชิปของอุปกรณ์ และไฟล์เสียงที่ตัดเสียงรบกวนแล้วจะถูกบันทึกจากหน้านี้ เมื่อคุณเลือกการบันทึกเสียงเป็นครั้งแรก หน้านี้จะดาวน์โหลดโมเดลและโค้ดสำหรับประมวลผลจาก txscribe.ai — ประมาณ 20 MB เมื่อแตกไฟล์แล้ว — และเบราว์เซอร์ของคุณจะเก็บข้อมูลนี้ไว้สำหรับใช้งานในครั้งถัดไป

ไฟล์ที่ตัดเสียงรบกวนแล้วจะตรงกับต้นฉบับอย่างแม่นยำในระดับแซมเปิล คุณจึงสามารถสลับฟังระหว่างสองไฟล์ได้แม้จะอยู่กลางคำ เพื่อฟังความเปลี่ยนแปลงได้อย่างชัดเจน

สิ่งใดที่จัดการได้ และสิ่งใดที่จัดการไม่ได้

เสียงหึ่ง, เสียงซ่า, เสียงเครื่องปรับอากาศ, เสียงฝน, เสียงคีย์บอร์ด, เสียงการจราจร
ลดเสียงลงได้มากที่สุด: จากการทดสอบของเรา ในช่วงจังหวะหยุดระหว่างคำ เสียงรบกวนเหล่านี้ลดลงเหลือเพียงเศษเสี้ยวของระดับเดิม แต่ในระหว่างคำพูด หากเสียงรบกวนดังเท่ากับเสียงพูด เสียงพูดจะหายไปเล็กน้อยด้วยเช่นกัน
เสียงพูดคุยของคนอื่นที่อยู่เบื้องหลัง
ขึ้นอยู่กับเสียงพูด ในการทดสอบของเรา เสียงจอแจในร้านอาหารลดลงได้มากเท่ากับเสียงการจราจร ส่วนห้องเรียนที่เสียงพูดของแต่ละคนเด่นชัดขึ้นมานั้น ลดลงได้ไม่ถึงครึ่งหนึ่งของเสียงการจราจร โมเดลนี้ถูกสร้างขึ้นมาเพื่อรักษาเสียงพูดไว้
มีเสียงบุคคลอื่นพูดใกล้กับไมโครโฟน
เสียงจะเบาลงแต่ไม่ได้หายไปทั้งหมด: จากการทดสอบของเรา เสียงที่สองจะมีความดังลดลงเหลือประมาณครึ่งหนึ่ง และเสียงหลักก็ลดลงเล็กน้อยเช่นกัน ตัวโมเดลไม่สามารถแยกแยะได้ว่าคุณต้องการเสียงของผู้พูดคนใด
เสียงพูดที่เบากว่าเสียงรบกวนที่แทรกเข้ามา
กรณีที่ยากที่สุด: เสียงพูดอาจถูกตัดหายไปพร้อมกับเสียงรบกวน ในการทดสอบของเรา เสียงพูดที่อยู่ไกลและถูกกลบด้วยเสียงภายในห้องที่ดังกว่าจะมีความดังลดลงเหลือประมาณหนึ่งในสิบของระดับเดิม โปรดฟังส่วนเหล่านั้นก่อนนำผลลัพธ์ไปใช้งาน
การบันทึกเสียงที่ไม่มีเสียงรบกวนอยู่แล้ว
ได้ผลลัพธ์ที่แทบไม่เปลี่ยนแปลงไปจากเดิม

ข้อจำกัดและรูปแบบไฟล์ที่รองรับ

สูงสุด 10 นาที และ 500 MB

รูปแบบไฟล์ที่เปิดได้
ไฟล์เสียง MP3, M4A, AAC, WAV, FLAC, OGG, Opus และ WebM รวมถึงเสียงจากวิดีโอ MP4 และ MOV รูปแบบทั้งหมดนี้สามารถถอดรหัสได้ในทุกเอนจินเบราว์เซอร์ที่เราทดสอบ นอกเหนือจากนี้จะขึ้นอยู่กับเบราว์เซอร์ของคุณ หากไม่สามารถถอดรหัสไฟล์ได้ หน้าเว็บจะแจ้งให้ทราบ
สิ่งที่คุณจะได้รับ
ไฟล์ WAV: 16-bit, 48 kHz, 1 แชนเนล — ประมาณ 5.5 MB ต่อนาที การบันทึกเสียงแบบสเตอริโอจะถูกมิกซ์เป็นโมโนก่อน สำหรับวิดีโอ คุณจะได้รับเฉพาะเสียง ไม่ใช่วิดีโอใหม่

ความเป็นส่วนตัว

ไฟล์บันทึกเสียงจะอยู่บนอุปกรณ์ของคุณ โดยจะได้รับการถอดรหัส ตัดเสียงรบกวน และบันทึกไว้ที่นี่ และไม่มีส่วนใดถูกส่งไปที่อื่นเลย เรานับขั้นตอนของหน้าเว็บที่มีการใช้งาน — การเลือกไฟล์ การตัดเสียงรบกวน การดาวน์โหลด — โดยไม่มีชื่อไฟล์ ความยาว หรือเสียงแนบไปด้วย มีเพียงการถอดเสียงเท่านั้นที่อัปโหลดไฟล์ต้นฉบับ และมีระบุไว้ข้างปุ่ม

คำถามที่พบบ่อย

ใช้งานได้ฟรีหรือไม่?

ใช่ ใช้งานได้โดยไม่ต้องมีบัญชี ไม่มีลายน้ำ และไม่ต้องติดตั้งโปรแกรมใดๆ โดยมีข้อจำกัดตามไฟล์: สูงสุด 10 นาที และ 500 MB

การบันทึกเสียงของฉันถูกอัปโหลดหรือไม่?

ตัดเสียงรบกวนในเบราว์เซอร์นี้ ไม่มีการอัปโหลดใดๆ เว้นแต่คุณจะกดปุ่มถอดเสียงในภายหลัง

ทำไมบางคำจึงฟังดูเบาบางลงหลังจากตัดเสียงรบกวน?

ในจุดที่เสียงพูดและเสียงรบกวนเบื้องหลังมีความดังใกล้เคียงกัน ตัวโมเดลจำเป็นต้องวิเคราะห์แบบวินาทีต่อวินาทีว่าสิ่งใดคือเสียงพูด ซึ่งอาจทำให้เสียงพูดบางส่วนเบาลงไปพร้อมกับเสียงรบกวน คำพูดที่เบากว่าเสียงรบกวนแทรกอาจแทบจะหายไปทั้งหมด โปรดสลับฟังระหว่าง ก่อน และ หลัง ในส่วนที่สำคัญก่อนที่คุณจะนำผลลัพธ์ไปใช้งาน

สามารถตัดเสียงรบกวนในวิดีโอได้หรือไม่?

ได้: เมื่อเลือกวิดีโอ คุณจะได้รับไฟล์เสียงที่ตัดเสียงรบกวนแล้วกลับมาเป็นไฟล์ WAV — ไม่ใช่วิดีโอใหม่

ทำไมปุ่มถอดเสียงจึงใช้การบันทึกเสียงต้นฉบับ ไม่ใช่ไฟล์ที่ตัดเสียงรบกวนแล้ว?

สำเนาที่ตัดเสียงรบกวนแล้วสร้างขึ้นเพื่อการฟังโดยเฉพาะ การตัดเสียงรบกวนจะทำให้เสียงพูดเปลี่ยนไปเล็กน้อยพร้อมกับเสียงรบกวน และเราไม่ได้อ้างว่าวิธีนี้จะทำให้บทถอดเสียงแม่นยำยิ่งขึ้น ดังนั้นปุ่มถอดเสียงจึงส่งการบันทึกเสียงต้นฉบับตามที่คุณเลือกไว้

ใช้งานได้กับเบราว์เซอร์ใดบ้าง?

เบราว์เซอร์เวอร์ชันล่าสุด: Chrome หรือ Edge, Firefox 114 ขึ้นไป หรือ Safari 16.4 ขึ้นไป เบราว์เซอร์รุ่นเก่าจะไม่รองรับเทคโนโลยีที่จำเป็นในการประมวลผล (WebAssembly ที่มี SIMD และ Web Workers สำหรับโหลดโมดูล) และหน้านี้จะแจ้งเตือนหากเบราว์เซอร์ของคุณไม่สามารถทำงานได้ การประมวลผลจะใช้ชิปและหน่วยความจำของอุปกรณ์คุณ ดังนั้นอุปกรณ์ที่ทำงานช้ากว่าจะใช้เวลานานขึ้น และโทรศัพท์อาจหน่วยความจำไม่เพียงพอหากการบันทึกเสียงมีความยาวมาก ทั้งนี้หน้านี้จะแสดงเวลาที่เหลืออยู่ให้คุณทราบ

ต้องการข้อความด้วย ไม่ใช่แค่ไฟล์เสียงใช่ไหม?

txscribe ถอดเสียงการบันทึกได้ถึง 82 ภาษา พร้อมการประทับเวลาในทุกๆ คำ คุณจึงสามารถคลิกเพื่อฟังเสียงจากบรรทัดใดก็ได้ตรงกับช่วงเวลาต้นฉบับ ช่วงทดลองใช้ฟรีรองรับการบันทึกเสียง 1 รายการ สูงสุดถึงนาทีที่ 10 โดยไม่ต้องมีบัญชี

เริ่มต้นใช้ฟรี