Trova la riga e il codice temporale da cui proviene
Incolla una trascrizione o trascina un file SRT o VTT, digita la parola che stai cercando e ogni corrispondenza tornerà con il timestamp allegato. Non “da qualche parte nel file”, ma 12:04, su questa riga, con il tuo termine evidenziato nel contesto.
Funziona nel browser. La trascrizione viene analizzata ed elaborata sul tuo dispositivo, il che è importante quando la trascrizione è un’intervista inedita o una chiamata interna.
Perché non usare semplicemente Ctrl e F
Perché Ctrl+F trova la parola e poi ti lascia bloccato. Evidenzierà “pricing” nel mezzo di un muro di testo, e tu non avrai ancora idea di dove fosse nella registrazione. Il codice temporale è ciò di cui avevi effettivamente bisogno.
I file dei sottotitoli peggiorano le cose. Apri un .srt ed è metà impalcatura: un numero di sequenza, una riga temporale con frecce, poi due righe di testo, ripetute. Ctrl+F trova corrispondenze all’interno di quel caos e tu devi contare all’indietro per trovare a quale cue sei arrivato. Questo analizza i cue per primi, così il testo è pulito da leggere e ogni corrispondenza conosce già il proprio orario di inizio.
Unisce anche le righe interrotte. I file di didascalie spezzano una frase in tre cue, quindi una frase come “usage based pricing” può essere divisa nel file e Ctrl+F semplicemente non la troverà. Qui il testo del cue viene unito prima della ricerca, così la frase corrisponde al modo in cui la diresti.
Ricerca in una trascrizione di YouTube
YouTube ti mostrerà una trascrizione e poi non ti darà modo di cercarla. Apri un video, clicca su “Mostra trascrizione” sotto la descrizione, e otterrai l’intera cosa in un pannello scorrevole con i timestamp, e nessun campo di ricerca al suo interno. Su un video di quaranta minuti quel pannello è quasi inutile se stai cercando una frase.
Il modo per aggirare il problema consiste in tre passaggi. Seleziona il testo della trascrizione in quel pannello, copialo e incollalo qui. La trascrizione di YouTube include i suoi codici temporali, quindi ogni corrispondenza che ottieni punta ancora al minuto giusto del video. Quindi cerca la parola.
Funziona allo stesso modo per le didascalie generate automaticamente, che sono la maggior parte di YouTube. Sono quelle che vale la pena cercare, perché le didascalie automatiche sono esattamente il punto in cui non puoi fidarti della tua memoria della formulazione, e contengono i timestamp di cui hai bisogno per tornare al momento.
Su un telefono non esiste Ctrl e F
Questa è la versione del problema per cui nessuno ha una buona risposta. Su un laptop puoi almeno ricorrere a Ctrl+F. Su un telefono non c’è affatto la funzione di ricerca nella pagina nell’app di YouTube, e il pannello della trascrizione è uno scorrimento con il pollice senza alcuna ricerca.
Quindi su mobile il flusso è lo stesso in tre passaggi e fa risparmiare più tempo, non meno: apri la trascrizione nell’app, copiala, apri questa pagina nel browser del tuo telefono, incolla, cerca. La pagina funziona con la larghezza del telefono, e poiché la ricerca viene eseguita sul dispositivo non stai spingendo una trascrizione tramite dati mobili per trovare una parola.
Corrispondenza Esatta, di Proposito
Si tratta di una corrispondenza di stringa letterale. Trova i caratteri che hai digitato e nient’altro. Questo è un limite deliberato, non una funzionalità mancante.
La ricerca esatta è ciò che vuoi quando conosci la parola: un nome di prodotto, un numero detto da qualcuno, il cognome di una persona, una frase che stai citando. È ripetibile e puoi fidarti del conteggio, motivo per cui giornalisti e ricercatori la utilizzano.
È lo strumento sbagliato quando non conosci la parola. Se il compito è “trova la parte in cui parlano di churn” e nessuno ha detto la parola “churn”, la corrispondenza esatta non restituisce nulla mentre il momento è proprio lì. Questo è un lavoro di ricerca semantica e appartiene al cercatore di video, che indicizza il video stesso e trova i momenti per significato piuttosto che per ortografia. Due strumenti diversi per due domande diverse, ed è utile sapere quale hai.
Corrispondenza Parola Intera e Maiuscole/Minuscole Ripagano
Entrambi gli interruttori sembrano pignoli finché non ti salvano per la prima volta.
Cerca “AI” senza la corrispondenza di parola intera e otterrai “said”, “again”, “sustainable”, “maintain” e ogni altra parola con quelle due lettere nascoste all’interno. Attiva la corrispondenza di parola intera e otterrai l’acronimo, solo dove è stato effettivamente pronunciato. Questa è la ragione più comune per cui una ricerca nella trascrizione sembra rotta.
La corrispondenza maiuscole/minuscole fa il lavoro opposto. Lasciala disattivata di default, perché le trascrizioni capitalizzano in modo inconsistente e non vuoi perdere un riscontro perché l’oratore ha iniziato una frase. Attivala quando la capitalizzazione è il punto: separare l’azienda “Apple” dal frutto, o un acronimo da una parola ordinaria.
Chi lo Fa Davvero
Giornalisti che lavorano da una registrazione di intervista, trovando la frase esatta per una citazione e il codice temporale in modo che l’editor video possa estrarre la clip. Il codice temporale è metà del prodotto finale.
Ricercatori che codificano interviste qualitative, contando quante volte un termine è apparso durante una sessione, un numero che puoi difendere perché la corrispondenza è letterale.
Team di supporto e prodotto che cercano in una demo o in una registrazione di webinar dove una funzionalità è stata spiegata, in modo da poter collegare un cliente al minuto invece che all’ora.
E editor che cercano una citazione che ricordano a metà, dove la corrispondenza di parola intera e una frase breve battono lo scorrimento ogni volta.
Se Non Hai Ancora una Trascrizione
Questo cerca nel testo che hai già. Per creare la trascrizione da una registrazione prima, il generatore di trascrizioni ne produce una con etichette dei parlanti. Se la trascrizione che hai è un pasticcio di timestamp e riempitivi, il pulitore di trascrizioni li elimina nel browser. E per trasformare una trascrizione finita in un file di sottotitoli, il convertitore di testo in SRT gestisce la tempistica.