Найдите Строку и Таймкод, Откуда Она Взялась
Вставьте стенограмму или перетащите файл SRT или VTT, наберите искомое слово, и каждое совпадение вернется с прикрепленным таймштампом. Не “где-то в файле”, а 12:04, в этой строке, с выделенным термином в контексте.
Он работает в браузере. Стенограмма разбирается и ищется на вашем устройстве, что важно, когда стенограмма является неопубликованным интервью или внутренним звонком.
Почему бы Просто Не Использовать Ctrl и F
Потому что Ctrl+F находит слово, а затем оставляет вас в затруднительном положении. Оно выделит “pricing” посреди стены текста, и вы все равно понятия не будете иметь, где это было в записи. Таймкод - это то, что вам на самом деле нужно.
Файлы субтитров ухудшают ситуацию. Откройте .srt, и это будет наполовину каркас: порядковый номер, строка времени со стрелками, затем две строки текста, снова и снова. Ctrl+F ищет внутри этого беспорядка, и вы отсчитываете назад, чтобы найти, в какой реплике вы оказались. Это сначала разбирает реплики, так что текст чист для чтения, и каждое совпадение уже знает свое время начала.
Он также объединяет перенесенные строки обратно. Файлы субтитров разбивают предложение на три реплики, поэтому фраза вроде “usage based pricing” может быть разделена в файле, и Ctrl+F ее просто не найдет. Здесь текст реплики объединяется перед поиском, так что фраза совпадает с тем, как бы вы ее произнесли.
Поиск по Стенограмме YouTube
YouTube покажет вам стенограмму, но не даст возможности ее искать. Откройте видео, нажмите “Показать стенограмму” под описанием, и вы получите весь текст в прокручиваемой панели с таймштампами, но без поля поиска. На сорока минутном видео эта панель почти бесполезна, если вы ищете одно предложение.
Выход из ситуации состоит из трех шагов. Выделите текст стенограммы на этой панели, скопируйте его и вставьте сюда. Стенограмма YouTube поставляется с прикрепленными таймкодами, поэтому каждое совпадение, которое вы получите, все равно будет указывать на правильную минуту видео. Затем ищите слово.
Это работает так же и с автоматически сгенерированными субтитрами, что составляет большинство на YouTube. Именно их стоит искать, потому что авто-субтитры - это именно то, где вы не можете доверять своей памяти о формулировке, и они несут таймштампы, которые вам нужны, чтобы вернуться к моменту.
На Телефоне Нет Ctrl и F
Это та версия проблемы, на которую ни у кого нет хорошего ответа. На ноутбуке вы можете хотя бы прибегнуть к Ctrl+F. На телефоне в приложении YouTube вообще нет функции поиска по странице, а панель стенограммы - это прокрутка большим пальцем без поиска.
Так что на мобильном телефоне процесс состоит из тех же трех шагов, и это экономит больше времени, а не меньше: откройте стенограмму в приложении, скопируйте ее, откройте эту страницу в браузере телефона, вставьте, ищите. Страница работает на ширине телефона, и поскольку поиск выполняется на устройстве, вы не передаете стенограмму по мобильной сети данных, чтобы найти одно слово.
Точное Совпадение, Намеренно
Это дословное сопоставление строк. Оно находит символы, которые вы напечатали, и ничего больше. Это намеренное ограничение, а не отсутствующая функция.
Точный поиск - это то, что вам нужно, когда вы знаете слово: название продукта, число, которое кто-то сказал, фамилия человека, фраза, которую вы цитируете. Он повторяем, и вы можете доверять количеству, вот почему журналисты и исследователи обращаются к нему.
Это неправильный инструмент, когда вы не знаете слово. Если задача состоит в том, чтобы “найти часть, где они говорят о текучке (churn)”, и никто не произнес слово “churn”, точное совпадение не вернет ничего, хотя момент находится прямо там. Это задача семантического поиска, и она относится к поисковику видео, который индексирует само видео и находит моменты по смыслу, а не по написанию. Два разных инструмента для двух разных вопросов, и стоит знать, какой из них у вас есть.
Поиск по слову целиком и учет регистра оправдывают себя
Оба переключателя кажутся придирчивыми, пока не спасут вас в первый раз.
Ищите «ИИ» без поиска по слову целиком, и вы получите «сказал», «снова», «устойчивый», «поддерживать» и любое другое слово, в котором зарыты эти две буквы. Включите поиск по слову целиком, и вы получите аббревиатуру только там, где она была фактически произнесена. Это самая частая причина, по которой поиск по стенограмме кажется неработающим.
Учет регистра выполняет противоположную задачу. Оставьте его выключенным по умолчанию, потому что в стенограммах часто бывает непоследовательное использование заглавных букв, и вы не хотите пропустить совпадение из-за того, что говорящий начал предложение с заглавной буквы. Включите его, когда важна заглавная буква: для разделения компании «Apple» от фрукта или аббревиатуры от обычного слова.
Кто на самом деле это делает
Журналисты, работающие с записью интервью, находящие точное предложение для цитаты и таймкод, чтобы видеоредактор мог вырезать клип. Таймкод - это половина результата.
Исследователи, кодирующие качественные интервью, подсчитывающие, сколько раз термин встречался за сессию, что является числом, которое можно обосновать, потому что совпадение является буквальным.
Службы поддержки и продуктовые команды, ищущие в записи демонстрации или вебинара, где была объяснена функция, чтобы они могли дать клиенту ссылку на минуту, а не на час.
И редакторы, ищущие полузабытую цитату, где поиск по слову целиком и короткая фраза всегда превосходят прокрутку.
Если у вас еще нет стенограммы
Это ищет текст, который у вас уже есть. Чтобы сначала создать стенограмму из записи, генератор стенограмм создает ее с метками дикторов. Если имеющаяся у вас стенограмма представляет собой беспорядок из таймштампов и заполнителей, очиститель стенограмм удаляет это в браузере. А чтобы превратить готовую стенограмму в файл субтитров, конвертер текста в SRT занимается таймингом.