Почему некоторые расшифровки с YouTube выходят неверными
YouTube создаёт автоматические субтитры почти для всех видео, и для ясно записанного монолога их обычно хватает. Трудности начинаются, когда запись нечистая: двое говорят одновременно, сильный акцент, музыка на фоне, профессиональная лексика, запись на телефон в комнате с эхом. Автосубтитры быстро портятся во всех этих случаях, и никакой сборщик их не улучшит, потому что копирует уже неверный файл.
Вторая брешь — охват. У прямых эфиров, у видео, выложенных в последние часы, у приватных и скрытых загрузок и у многих небольших каналов дорожки субтитров нет вовсе. Сборщику нечего копировать, и он возвращает пустой результат — поэтому так многие из них молча отказывают именно на тех видео, которые важны.
Настоящая расшифровка читает звук, а не файл субтитров, поэтому ни одна из этих ситуаций её не останавливает. Она требует больше вычислений и занимает больше времени, чем копирование текстового файла: двухчасовой подкаст — это несколько минут работы, а не несколько секунд. Зато она создаёт расшифровку там, где её не было, и верную там, где субтитры были ошибочны.
WhoScribe делает второе. Вставьте ссылку, и мы транскрибируем сам звук, с метками дикторов и временными метками, на языке оригинала или с переводом на любой из 90+ других.