Trouvez la ligne et l’horodatage d’origine
Collez une transcription ou déposez un fichier SRT ou VTT, tapez le mot que vous cherchez, et chaque correspondance sera renvoyée avec l’horodatage associé. Pas “quelque part dans le fichier”, mais 12:04, sur cette ligne, avec votre terme mis en évidence dans son contexte.
Il fonctionne dans le navigateur. La transcription est analysée et recherchée sur votre appareil, ce qui est important lorsque la transcription est une interview non publiée ou un appel interne.
Pourquoi ne pas simplement utiliser Ctrl+F
Parce que Ctrl+F trouve le mot et vous laisse ensuite bloqué. Il mettra en évidence “pricing” au milieu d’un mur de texte, et vous n’aurez toujours aucune idée de l’endroit où cela se trouvait dans l’enregistrement. L’horodatage est ce dont vous aviez réellement besoin.
Les fichiers de sous-titres aggravent les choses. Ouvrez un .srt et c’est à moitié un échafaudage : un numéro de séquence, une ligne de temps avec des flèches, puis deux lignes de texte, encore et encore. Ctrl+F trouve des correspondances dans ce désordre et vous comptez à rebours pour trouver dans quelle section vous avez atterri. Ceci analyse d’abord les sections, de sorte que le texte est propre à lire et chaque correspondance connaît déjà son propre temps de début.
Il rassemble également les lignes coupées. Les fichiers de sous-titres coupent une phrase sur trois sections, de sorte qu’une expression comme “usage based pricing” peut être divisée dans le fichier et Ctrl+F ne la trouvera tout simplement pas. Ici, le texte des sections est recousu avant la recherche, de sorte que la phrase correspond à la façon dont vous la prononceriez.
Rechercher une transcription YouTube
YouTube vous montrera une transcription, puis ne vous donnera aucun moyen de la rechercher. Ouvrez une vidéo, cliquez sur “Afficher la transcription” sous la description, et vous obtiendrez l’intégralité dans un panneau défilant avec des horodatages, et aucune boîte de recherche nulle part. Sur une vidéo de quarante minutes, ce panneau est presque inutile si vous cherchez une seule phrase.
Pour contourner le problème, il y a trois étapes. Sélectionnez le texte de la transcription dans ce panneau, copiez-le et collez-le ici. La transcription de YouTube est accompagnée de ses horodatages, de sorte que chaque correspondance que vous obtenez renvoie toujours à la bonne minute de la vidéo. Ensuite, cherchez le mot.
Cela fonctionne de la même manière sur les sous-titres générés automatiquement, ce qui représente la majeure partie de YouTube. Ce sont ceux qui méritent d’être recherchés, car les sous-titres automatiques sont précisément l’endroit où vous ne pouvez pas faire confiance à votre mémoire de la formulation, et ils contiennent les horodatages dont vous avez besoin pour revenir au moment.
Sur un téléphone, il n’y a pas de Ctrl+F
C’est la version du problème pour laquelle personne n’a de bonne réponse. Sur un ordinateur portable, vous pouvez au moins vous rabattre sur Ctrl+F. Sur un téléphone, il n’y a pas du tout de fonction de recherche dans la page de l’application YouTube, et le panneau de transcription est un défilement au pouce sans recherche.
Ainsi, sur mobile, le processus est le même en trois étapes et il permet d’économiser plus de temps, pas moins : ouvrez la transcription dans l’application, copiez-la, ouvrez cette page dans le navigateur de votre téléphone, collez, cherchez. La page fonctionne à la largeur du téléphone, et parce que la recherche s’exécute sur l’appareil, vous n’envoyez pas une transcription via les données mobiles pour trouver un mot.
Correspondance exacte, délibérément
Il s’agit d’une correspondance de chaîne littérale. Il trouve les caractères que vous avez tapés et rien d’autre. C’est une limite délibérée, pas une fonctionnalité manquante.
La recherche exacte est ce que vous voulez lorsque vous connaissez le mot : un nom de produit, un nombre prononcé par quelqu’un, un nom de famille, une phrase que vous citez. Elle est reproductible et vous pouvez faire confiance au décompte, c’est pourquoi les journalistes et les chercheurs l’utilisent.
C’est le mauvais outil lorsque vous ne connaissez pas le mot. Si le travail consiste à “trouver la partie où ils parlent de churn” et que personne n’a prononcé le mot “churn”, la correspondance exacte ne renvoie rien alors que le moment est juste là. C’est un travail de recherche sémantique, et il appartient au chercheur de vidéo, qui indexe la vidéo elle-même et trouve les moments par le sens plutôt que par l’orthographe. Deux outils différents pour deux questions différentes, et il est utile de savoir lequel vous avez.
La correspondance de mot entier et la sensibilité à la casse prouvent leur utilité
Ces deux options semblent compliquées jusqu’à la première fois qu’elles vous sauvent.
Recherchez “IA” sans la correspondance de mot entier et vous obtiendrez “disait”, “encore”, “durable”, “maintenir”, et tous les autres mots contenant ces deux lettres. Activez la correspondance de mot entier et vous obtiendrez l’acronyme, uniquement là où il a été réellement prononcé. C’est la raison la plus courante pour laquelle une recherche de transcription semble défectueuse.
La sensibilité à la casse fait le travail inverse. Laissez-la désactivée par défaut, car les transcriptions ne respectent pas toujours la capitalisation et vous ne voulez pas manquer une correspondance parce que l’orateur a commencé une phrase. Activez-la lorsque la capitalisation est importante : pour séparer l’entreprise “Apple” du fruit, ou un acronyme d’un mot ordinaire.
Qui utilise réellement cela
Les journalistes travaillant à partir d’un enregistrement d’interview, trouvant la phrase exacte pour une citation et le timecode afin que le monteur vidéo puisse extraire le clip. Le timecode représente la moitié du livrable.
Les chercheurs codant des entretiens qualitatifs, comptant le nombre de fois qu’un terme est apparu au cours d’une session, ce qui est un chiffre que vous pouvez défendre car la correspondance est littérale.
Les équipes de support et de produit recherchant dans un enregistrement de démo ou de webinaire l’endroit où une fonctionnalité a été expliquée, afin de pouvoir lier un client à la minute plutôt qu’à l’heure.
Et les rédacteurs à la recherche d’une citation qu’ils se souviennent à moitié, ce pour quoi la correspondance de mot entier et une courte phrase sont plus efficaces que de faire défiler à chaque fois.
Si vous n’avez pas encore de transcription
Ceci recherche du texte que vous avez déjà. Pour créer d’abord la transcription à partir d’un enregistrement, le générateur de transcriptions en produit une avec des étiquettes d’interlocuteur. Si la transcription que vous avez est un fouillis d’horodatages et de remplissage, le nettoyeur de transcriptions les supprime dans le navigateur. Et pour transformer une transcription terminée en fichier de sous-titres, le convertisseur texte en SRT gère le minutage.