Perché alcune trascrizioni YouTube vengono male
YouTube genera sottotitoli automatici per quasi tutti i video e, per un monologo registrato con chiarezza, di solito bastano. I problemi iniziano quando la registrazione non è nitida: due persone che parlano insieme, un accento marcato, musica di sottofondo, lessico tecnico, una registrazione col telefono in una stanza che rimbomba. I sottotitoli automatici peggiorano in fretta in tutti questi casi e nessuno strumento di estrazione può migliorarli, perché copia un file già sbagliato.
La seconda lacuna è la copertura. Le dirette, i video pubblicati nelle ultime ore, i caricamenti privati e non in elenco e molti canali piccoli non hanno alcuna traccia di sottotitoli. Un estrattore non ha nulla da copiare e restituisce un risultato vuoto: per questo tanti falliscono in silenzio proprio sui video che contano.
La trascrizione vera legge l'audio invece del file dei sottotitoli, quindi nessuna di queste situazioni la ferma. Richiede più calcolo e più tempo rispetto al copiare un file di testo — un podcast di due ore sono pochi minuti di lavoro, non pochi secondi — ma produce una trascrizione dove non ce n'era e una corretta dove i sottotitoli erano sbagliati.
WhoScribe fa proprio questo. Incolla un link e noi trascriviamo l'audio stesso, con etichette per gli oratori e timestamp, nella lingua originale o tradotto in oltre 90 altre lingue.