Word error rate-calculator

Plak de correcte tekst en een automatisch transcript. U krijgt het foutpercentage dat elke leverancier noemt — en daaronder waar de fouten daadwerkelijk zaten. Het draait in uw browser.

Het correcte transcript

Het te beoordelen transcript

Waarom de specificatie ertoe doet

Word error rate is het aantal vervangen, weggelaten en ingevoegde woorden gedeeld door de lengte van het correcte transcript. Het is een echte meetwaarde, en elk woord weegt even zwaar.

Dat is precies het probleem. Neem twee transcripten van hetzelfde uur audio. Het ene scoort 3% fouten, en elke fout is een stopwoord of een hapering. Het andere scoort 1%, maar de fouten zijn een achternaam, een bedrag in een begrotingsgesprek en een weggelaten „niet”. Het tweede wint de benchmark met een factor drie. Het eerste kunt u zonder meer publiceren; het tweede citeert iemand alsof die akkoord ging met iets wat juist werd afgewezen.

Het getal hierboven is dus wat u op een marketingpagina zou zien, en de tabel eronder bepaalt of het transcript werkelijk bruikbaar is. Een uitgebreidere toelichting leest u in Wat „99% nauwkeurigheid” daadwerkelijk betekent.

Hoe er geteld wordt

Hoofdletters en leestekens worden genegeerd
Zoals de metriek standaard is gedefinieerd. „The cat sat.” en „the cat sat” tellen als identiek.
Namen zijn woorden met een hoofdletter midden in de zin
Een eenvoudige benadering, en een eerlijke: elke zin begint met een hoofdletter, dus een hoofdletter aan het begin van de zin zegt niets en wordt niet meegeteld.
Getallen omvatten cijfers en telwoorden
“240”, “eleven” en “percent” belanden allemaal in dezelfde categorie. Cijfers tellen in elke taal; uitgeschreven getallen en ontkenningen alleen in het Engels.
Elk woord valt in precies één categorie
De meest ingrijpende eerst: een weggelaten “no” wordt geteld als ontkenning, ongeacht of het ook met een hoofdletter was geschreven.
Invoegingen vallen buiten de categorieën
De categorieën worden geteld op basis van het correcte transcript, en een verzonnen woord heeft daarin geen tegenhanger. Het telt nog steeds mee voor het foutpercentage.

We publiceren geen nauwkeurigheidspercentage

We zouden een gunstige benchmark kunnen kiezen en een mooi cijfer presenteren, zoals iedereen doet. Maar dat zegt niets over uw specifieke opname. Wat txscribe in plaats daarvan doet, is fouten vindbaar maken: elk woord bevat een tijdstempel, zodat u op een regel klikt en hoort of het klopt.

Bekijk wat het doet