找到那一行,以及它来自哪个时间码
粘贴一份文字稿,或拖放一个 SRT 或 VTT 文件,输入您要查找的单词,每个匹配项都会附带时间戳返回。不是“文件中的某个地方”,而是 12:04,在这一行,您的术语在上下文中被高亮显示。
它在浏览器中运行。文字稿在您的设备上解析和搜索,这对于未发布的采访或内部通话的文字稿尤其重要。
为什么不直接使用 Ctrl+F
因为 Ctrl+F 找到单词后会让你陷入困境。它会在一大段文字中高亮显示“定价”,而您仍然不知道它在录音的哪个位置。时间码才是您真正需要的东西。
字幕文件让情况变得更糟。打开一个 .srt 文件,它有一半是脚手架:一个序列号,一个带有箭头的计时行,然后是两行文本,如此反复。Ctrl+F 会在那个混乱中进行匹配,您需要倒数才能找到您所处的提示符。这会首先解析提示符,因此文本清晰易读,并且每个匹配项都已知道自己的开始时间。
它还会将折行的行重新连接起来。字幕文件会将一个句子分成三个提示符,因此像“usage based pricing”这样的短语可能会在文件中被拆分,Ctrl+F 根本找不到它。在这里,提示文本在搜索前会被拼接起来,因此短语会像您所说的那样匹配。
搜索 YouTube 字幕
YouTube 会向您显示文字稿,但之后却不提供任何搜索它的方法。打开一个视频,在描述下方点击“显示文字稿”,您会看到整个内容在一个带时间戳的滚动面板中,但没有任何搜索框。对于一个四十分钟的视频,如果您只想找一句话,那个面板几乎毫无用处。
解决办法分三步。在该面板中选择文字稿文本,复制,然后粘贴到此处。YouTube 的文字稿附带时间码,因此您获得的每个匹配项仍然指向视频的正确分钟。然后搜索单词。
它在自动生成的字幕上同样有效,这占了 YouTube 的大部分。这些才是值得搜索的,因为自动字幕正是您无法相信自己对措辞记忆的地方,而且它们带有您需要跳回该时刻的时间戳。
手机上没有 Ctrl+F
这是个没人能给出好答案的问题。在笔记本电脑上,您至少可以求助于 Ctrl+F。在手机上,YouTube 应用中根本没有页面查找功能,文字稿面板只能用拇指滚动,没有任何搜索功能。
因此在移动设备上,流程是相同的三个步骤,而且节省了更多时间,而不是更少:在应用中打开文字稿,复制,在手机浏览器中打开此页面,粘贴,搜索。该页面适应手机宽度,而且由于搜索在设备上运行,您无需通过移动数据传输文字稿来查找一个单词。
故意为之的精确匹配
这是字面字符串匹配。它只查找您输入的字符,别无其他。这是一个有意为之的限制,而不是一个缺失的功能。
当您知道要找的词时,精确搜索正是您需要的:一个产品名称、某人说的一个数字、一个人的姓氏、您引用的一个短语。它是可重复的,您可以相信其计数,这就是为什么记者和研究人员会选择它的原因。
当您不知道要找的词时,它是错误的工具。如果任务是“找到他们谈论流失的部分”,但没有人说过“流失”这个词,那么精确匹配将一无所获,尽管那个时刻就在那里。那是一个语义搜索任务,它属于视频查找器,视频查找器会对视频本身进行索引,并根据意义而非拼写来查找时刻。两个不同问题的两种不同工具,了解您拥有哪一个是很重要的。
全词匹配和区分大小写功能物有所值
这两个切换按钮看起来很繁琐,直到它们第一次派上用场时你才会发现它们的好处。
在不启用全词匹配的情况下搜索“AI”,你会得到“said”、“again”、“sustainable”、“maintain”以及其他所有包含这两个字母的词。启用全词匹配,你只会得到实际说到的缩写。这是转录文本搜索看起来出错的最常见原因。
区分大小写的功能则相反。默认情况下将其关闭,因为转录文本的大小写不一致,你不想因为说话者以大写字母开头而错过匹配项。当大小写是关键时才将其打开:例如区分公司“Apple”和水果“apple”,或者区分缩写词和普通词。
谁会使用这个功能
记者根据采访录音工作,找到引用的确切句子和时间码,以便视频编辑可以提取片段。时间码是交付成果的一半。
研究人员对定性访谈进行编码,计算一个术语在整个会话中出现了多少次,这是一个你可以根据字面匹配来确定的数字。
支持和产品团队搜索演示或网络研讨会录音,查找功能解释的位置,以便他们可以将客户链接到具体的分钟而不是小时。
以及编辑寻找他们半记得的引用,在这种情况下,全词匹配和短语搜索总是比滚动查找更高效。