Субтитры к видео принято считать инструментом, прежде всего предназначенным для глухих и для слабослышащих людей — а затѣмъ ещё и для таких зрителей видео, которым не извѣстенъ язык его (и тогда полезны субтитры на родном языке или хотя бы на болѣе извѣстномъ — напримѣръ, субтитры на английском языке для видео на японском языке), или которым язык-то неплохо извѣстенъ, однако всё равно приходится понимать «с пятого на десятое» ввиду того, что рѣчь нѣкоторыхъ говорящих (в конкретной видеозаписи) звучит слишком уж невнятно или хрипло, или временами тихо, или с мощным акцентом, или ещё чего.
Однако и русскому человѣку к видеозаписи на русском же языке, в которой каждое слово разборчиво и понятно, всё же могут быть подспорьем субтитры опять же на русском языке. Цѣнность ихъ порождается тѣмъ простым фактом, что большинство грамотных людей (способных читать и писать) читает текст про себя (то есть не вслух) значительно быстрѣе, нежели вслух — по этой же причине устную рѣчь (даже ускоренную процентов на 30% или на 50% в проигрывателе) воспринимать поневоле приходится медленнѣе, нежели записанною текстом в файле субтитров. А уж если въ устной рѣчи чего-нибудь надо быстро найти, то быстрѣе всего будет сдѣлать это не на слух, и даже не глазами пробѣгаться по тексту субтитров, а компьютерным способом: открыть текст субтитров, открыть диалоговое окно поиска (чаще всего сочетанием клавиш Ctrl+F), затѣмъ напечатать искомое и нажать на ввод.
Чтобы имѣть эту цѣнность, субтитры должны быть не впечатанными в пикселы кадра, а непремѣнно текстовыми, то есть либо лежать рядом с видео в файле субтитров (с расширением «.srt», или «.ass», или «.vtt»), либо содержаться рядом с видеодорожкою (внутри видеофайла) въ ѿдѣльной текстовой дорожке, откудова их опять же нетрудно вытащить в файл субтитров, лежащий рядом и значительно болѣе удобный для прочтения и для поиска текста.
Однако изготовление субтитров вручную требует от людей большого труда, причём даже не столько по распознаванию рѣчи (если она остаётся внятною, а язык знаком составителю субтитров), сколько по так называемому таймингу (по привязке ко времени): это ж надо для каждой реплики указать время начала и время конца ея, что трудоёмко даже в том случае, если руководиться одним только временем звучания реплики (не сообразуясь ни со временем начала и окончания движения губ и челюстей говорящих, ни с необходимостью оставить нѣкоторое дополнительное время для прочтения слишком кратких реплик).
А когда нѣкоторая работа вручную требует от людей большого труда, тогда на помощь приходит автоматизация. Изготовление субтитров может быть автоматизировано при помощи искусственнаго интеллекта Whisper, натренированнаго в OpenAI и затѣмъ портированнаго на язык Си и Си++. И так как итоги этого портирования ужé встроены в FFmpeg, то автоматическое изготовление субтитров может быть запущено единственною командою, о которой я собираюсь повѣдать въ слѣдующем сообщении.
Однако и русскому человѣку к видеозаписи на русском же языке, в которой каждое слово разборчиво и понятно, всё же могут быть подспорьем субтитры опять же на русском языке. Цѣнность ихъ порождается тѣмъ простым фактом, что большинство грамотных людей (способных читать и писать) читает текст про себя (то есть не вслух) значительно быстрѣе, нежели вслух — по этой же причине устную рѣчь (даже ускоренную процентов на 30% или на 50% в проигрывателе) воспринимать поневоле приходится медленнѣе, нежели записанною текстом в файле субтитров. А уж если въ устной рѣчи чего-нибудь надо быстро найти, то быстрѣе всего будет сдѣлать это не на слух, и даже не глазами пробѣгаться по тексту субтитров, а компьютерным способом: открыть текст субтитров, открыть диалоговое окно поиска (чаще всего сочетанием клавиш Ctrl+F), затѣмъ напечатать искомое и нажать на ввод.
Чтобы имѣть эту цѣнность, субтитры должны быть не впечатанными в пикселы кадра, а непремѣнно текстовыми, то есть либо лежать рядом с видео в файле субтитров (с расширением «.srt», или «.ass», или «.vtt»), либо содержаться рядом с видеодорожкою (внутри видеофайла) въ ѿдѣльной текстовой дорожке, откудова их опять же нетрудно вытащить в файл субтитров, лежащий рядом и значительно болѣе удобный для прочтения и для поиска текста.
Однако изготовление субтитров вручную требует от людей большого труда, причём даже не столько по распознаванию рѣчи (если она остаётся внятною, а язык знаком составителю субтитров), сколько по так называемому таймингу (по привязке ко времени): это ж надо для каждой реплики указать время начала и время конца ея, что трудоёмко даже в том случае, если руководиться одним только временем звучания реплики (не сообразуясь ни со временем начала и окончания движения губ и челюстей говорящих, ни с необходимостью оставить нѣкоторое дополнительное время для прочтения слишком кратких реплик).
А когда нѣкоторая работа вручную требует от людей большого труда, тогда на помощь приходит автоматизация. Изготовление субтитров может быть автоматизировано при помощи искусственнаго интеллекта Whisper, натренированнаго в OpenAI и затѣмъ портированнаго на язык Си и Си++. И так как итоги этого портирования ужé встроены в FFmpeg, то автоматическое изготовление субтитров может быть запущено единственною командою, о которой я собираюсь повѣдать въ слѣдующем сообщении.