Fjern bakgrunnsstøy

Slipp inn et opptak og få det tilbake med brumming, susing, trafikk og prating dempet. Rensingen kjører i nettleseren din: ingenting lastes opp med mindre du trykker på Transkriber etterpå, og du trenger ingen konto.

Slik fungerer det

Støyen fjernes av DeepFilterNet 3, et nevralt nettverk med åpen kildekode laget for tale. Det lytter til opptaket ti millisekunder av gangen og demper, frekvensbånd for frekvensbånd, det som bedømmes til ikke å være stemme.

LICENSE-DeepFilterNet-MIT.txt · LICENSE-DeepFilterNet-APACHE.txt · THIRD-PARTY-NOTICES.txt

Nettleseren din dekoder filen, modellen kjører på enhetens prosessor, og den rensede lyden lagres fra denne siden. Første gang du velger et opptak, laster siden ned modellen og koden som kjører den fra txscribe.ai – omtrent 20 MB ferdig utpakket – og nettleseren din beholder den til neste gang.

Den rensede filen er synkronisert med originalen ned på samplenivå, så du kan veksle mellom dem midt i et ord og høre nøyaktig hva som ble endret.

Hva den håndterer, og hva den ikke håndterer

Brumming, susing, klimaanlegg, regn, tastaturer, trafikk
Dempet mest. I testene våre, i pausene mellom ordene, falt hver av disse til en liten brøkdel av nivået sitt. Under ordene, der støyen var like høy som stemmen, forsvant også litt av stemmen med den.
Andres stemmer i bakgrunnen
Det kommer an på stemmene. I testene våre falt surret i en restaurant like mye som trafikk; et klasserom, der enkeltstemmer skiller seg ut, falt mindre enn halvparten så mye som trafikk. Modellen er bygget for å bevare stemmer.
En annen person som snakker nær mikrofonen
Dempet, ikke fjernet: I testene våre endte en annen stemme opp på omtrent halvparten av nivået sitt, og hovedstemmen mistet også litt. Modellen kan ikke vite hvilken taler du ønsket.
En stemme som er lavere enn støyen over den
Det vanskeligste tilfellet: den kan forsvinne sammen med støyen. I testen vår kom en fjern stemme under kraftigere romstøy ut på omtrent en tidel av nivået sitt. Hør på disse partiene før du bruker resultatet.
Et opptak som allerede er rent
Kommer tilbake nesten uendret.

Grenser og formater

Opptil 10 minutter og 500 MB

Hva den åpner
MP3-, M4A-, AAC-, WAV-, FLAC-, OGG-, Opus- og WebM-lyd, og lyden fra MP4- og MOV-videoer: hver av disse ble dekodet i alle nettlesermotorene vi testet. Alt annet avhenger av nettleseren din; hvis den ikke kan dekode en fil, gir siden beskjed.
Hva du får
En WAV-fil: 16-bit, 48 kHz, én kanal – omtrent 5.5 MB i minuttet. Et stereoopptak mikses først til mono. Fra en video får du lyden, ikke en ny video.

Personvern

Opptaket forblir på enheten din: det dekodes, renses og lagres her, og ingenting av det sendes noe sted. Vi teller hvilke steg på siden som brukes – en fil valgt, renset, lastet ned – uten at filnavn, lengde eller lyd følger med. Bare Transkriber laster opp originalen, og det står ved siden av knappen.

Spørsmål

Er det gratis?

Ja, uten konto, uten vannmerke og ingenting å installere. Grensene gjelder filen: opptil 10 minutter og 500 MB.

Blir opptaket mitt lastet opp?

Renses i denne nettleseren. Ingenting lastes opp med mindre du trykker på Transkriber etterpå.

Hvorfor høres noen ord tynnere ut etterpå?

Der en stemme og støyen bak den er omtrent like høye, må modellen avgjøre, øyeblikk for øyeblikk, hva som er stemme, og noe av stemmen dempes sammen med støyen. Et ord som er lavere enn støyen over det, kan nesten forsvinne helt. Veksle mellom Før og Etter på partiene som betyr noe før du bruker resultatet.

Kan den rense lyden fra en video?

Ja: Velg videoen, så får du lyden tilbake, renset, som en WAV-fil – ikke en ny video.

Hvorfor bruker Transkriber det opprinnelige opptaket, ikke det rensede?

Den rensede kopien er laget for lytting. Rensingen endrer stemmen litt i tillegg til støyen, og vi påstår ikke at den gjør en transkripsjon mer nøyaktig – derfor sender Transkriber opptaket slik du valgte det.

Hvilke nettlesere fungerer den i?

Nyere versjoner: Chrome eller Edge, Firefox 114 eller nyere, eller Safari 16.4 eller nyere. Eldre nettlesere mangler det den kjører på (WebAssembly med SIMD og workers som laster moduler), og siden sier fra hvis din ikke kan kjøre det. Den kjører på enhetens prosessor og i minnet dens, så en tregere enhet tar lengre tid, og en telefon kan gå tom for minne på et langt opptak; siden viser gjenværende tid.

Trenger du ordene, ikke bare lyden?

txscribe transkriberer opptak på 82 språk, med et tidsstempel på hvert ord, slik at hver linje kan spilles av fra øyeblikket den kom fra. Gratisprøven tar ett opptak, opptil minutt 10, uten konto.

Start gratis