Supprimer le bruit de fond

Déposez un enregistrement et récupérez-le avec les bourdonnements, souffles, bruits de circulation et bavardages atténués. Le nettoyage s'exécute dans votre navigateur : rien n'est téléversé sauf si vous appuyez ensuite sur Transcrire cet enregistrement, et il n'y a aucun compte.

Comment ça fonctionne

Le bruit est supprimé par DeepFilterNet 3, un réseau de neurones open source conçu pour la voix parlée. Il écoute l'enregistrement par tranches de dix millisecondes et atténue, bande par bande, ce qu'il juge ne pas être de la voix.

LICENSE-DeepFilterNet-MIT.txt · LICENSE-DeepFilterNet-APACHE.txt · THIRD-PARTY-NOTICES.txt

Votre navigateur décode le fichier, le modèle s'exécute sur le processeur de votre appareil, et l'audio nettoyé est enregistré depuis cette page. La première fois que vous choisissez un enregistrement, la page télécharge le modèle et le code qui l'exécute depuis txscribe.ai — environ 20 Mo une fois décompressé — et votre navigateur le conserve pour la prochaine fois.

Le fichier nettoyé est calé sur l'original à l'échantillon près, ce qui permet de passer de l'un à l'autre au milieu d'un mot et d'entendre exactement ce qui a changé.

Ce qu'il prend en charge, et ce qu'il ne prend pas en charge

Bourdonnements, souffle, climatisation, pluie, claviers, circulation
Les plus atténués. Lors de nos tests, pendant les silences entre les mots, chacun de ces bruits a chuté à une petite fraction de son niveau d'origine. Sous les mots, là où le bruit était aussi fort que la voix, un peu de la voix a disparu avec lui.
Voix d'autres personnes en arrière-plan
Cela dépend des voix. Dans nos tests, le brouhaha d'un restaurant a diminué autant que la circulation ; une salle de classe, où des voix individuelles se détachent, a diminué de moins de la moitié par rapport à la circulation. Le modèle est conçu pour préserver les voix.
Une autre personne parlant près du micro
Atténuée, pas supprimée : lors de nos tests, une seconde voix est ressortie à environ la moitié de son niveau, et la voix principale a perdu un peu elle aussi. Le modèle ne peut pas savoir quel intervenant vous vouliez.
Une voix plus faible que le bruit qui la couvre
Le cas le plus difficile : la voix peut disparaître avec le bruit. Lors de nos tests, une voix lointaine couverte par une pièce plus bruyante est ressortie à environ un dixième de son volume initial. Écoutez ces passages avant d'utiliser le résultat.
Un enregistrement déjà net
Ressort presque inchangé.

Limites et formats

Jusqu'à 10 minutes et 500 Mo

Formats acceptés
Fichiers audio MP3, M4A, AAC, WAV, FLAC, OGG, Opus et WebM, et le son des vidéos MP4 et MOV : chacun d'eux a été décodé par tous les moteurs de navigateur que nous avons testés. Tout le reste dépend de votre navigateur ; s'il ne peut pas décoder un fichier, la page vous l'indique.
Ce que vous obtenez
Un fichier WAV : 16 bits, 48 kHz, un canal — environ 5.5 Mo par minute. Un enregistrement stéréo est d'abord mixé en mono. À partir d'une vidéo, vous obtenez son son, pas une nouvelle vidéo.

Confidentialité

L'enregistrement reste sur votre appareil : il est décodé, nettoyé et sauvegardé ici, et rien n'est envoyé nulle part. Nous comptabilisons les étapes de la page utilisées — un fichier choisi, nettoyé, téléchargé — sans qu'aucun nom de fichier, durée ou son n'y soit associé. Seul « Transcrire » téléverse l'original, et cela est indiqué à côté du bouton.

Questions

Est-ce gratuit ?

Oui, sans compte, sans filigrane et sans rien à installer. Les seules limites sont celles du fichier : jusqu'à 10 minutes et 500 Mo.

Mon enregistrement est-il téléversé ?

Nettoyé dans ce navigateur. Rien n'est téléversé sauf si vous appuyez ensuite sur Transcrire cet enregistrement.

Pourquoi certains mots semblent-ils plus minces après coup ?

Lorsqu'une voix et le bruit derrière elle ont un volume similaire, le modèle doit déterminer à chaque instant ce qui relève de la parole, et une partie de la voix se retrouve atténuée avec le bruit. Un mot plus faible que le bruit qui le couvre peut presque entièrement disparaître. Basculez entre Avant et Après sur les passages importants avant d'utiliser le résultat.

L'outil peut-il nettoyer le son d'une vidéo ?

Oui : choisissez la vidéo et vous récupérez son son, nettoyé, sous forme de fichier WAV — pas une nouvelle vidéo.

Pourquoi Transcrire cet enregistrement utilise-t-il l'enregistrement original plutôt que la version nettoyée ?

La copie nettoyée est conçue pour l'écoute. Le nettoyage modifie légèrement la voix en plus du bruit, et nous ne prétendons pas qu'il rend la transcription plus précise — le bouton Transcrire cet enregistrement envoie donc l'enregistrement tel que vous l'avez choisi.

Sur quels navigateurs fonctionne-t-il ?

Des versions récentes : Chrome ou Edge, Firefox 114 ou supérieur, ou Safari 16.4 ou supérieur. Les navigateurs plus anciens ne prennent pas en charge ce dont il a besoin (WebAssembly avec SIMD, et des workers chargeant des modules), et la page vous le signale si le vôtre ne peut pas l'exécuter. L'outil tourne sur le processeur et dans la mémoire de votre appareil : un appareil plus lent mettra donc plus de temps, et un téléphone peut manquer de mémoire sur un enregistrement long ; la page affiche le temps restant.

Besoin du texte, pas seulement du son ?

txscribe transcrit les enregistrements dans 82 langues, avec un horodatage sur chaque mot, pour que chaque ligne permette de réécouter le moment d'où elle vient. L'essai gratuit prend en charge un enregistrement, jusqu'à la minute 10, sans compte.

Commencer gratuitement