Trascrivi una registrazione con più speaker, etichettandoli tutti
Carica una registrazione con più persone che parlano, o incolla un link, e ScreenApp la trasforma in una trascrizione con ogni speaker etichettato e un timestamp su ogni riga. Registra la conversazione dal vivo con il registratore del browser o le App iOS e Android, oppure connetti il bot per riunioni per Zoom, Google Meet e Microsoft Teams per una chiamata, quindi carica il file quando lo hai.
Una trascrizione etichettata sostituisce il riascolto di una registrazione per capire chi ha detto cosa.
Cosa ottieni:
- Una trascrizione con identificazione del relatore, in 100+ lingue
- Chat AI con qualsiasi registrazione, così puoi chiedere cosa ha detto uno speaker specifico invece di scansionare l’intera trascrizione
- Note AI: elementi d'azione con un proprietario e una scadenza, e decisioni elencate separatamente
- Esporta come PDF, DOCX, TXT, SRT e VTT
- Piano gratuito: 2 trascrizioni di registrazioni fino a 45 minuti ciascuna, con chat AI inclusa
Come trascrivere più speaker
- Carica o incolla un link: Trascina il file audio o video (MP4, M4V, MOV, AVI, WEBM, MKV, FLV, TS, MTS, M2TS, 3GP, 3GPP, 3G2, WMV, ASF, VOB, OGV, RM, RMVB, MPG, MPEG, M2V, F4V, MXF), o incolla un link. Non è necessaria alcuna configurazione dell’account per iniziare.
- Lascia che trascriva: L’audio viene convertito in testo e ogni persona viene divisa nella propria etichetta speaker, con un timestamp su ogni frase.
- Rivedi ed esporta: Leggi la trascrizione nel browser, rinomina un’etichetta speaker se necessario ed esporta come PDF, DOCX, TXT, SRT e VTT.
L’accuratezza dipende dall’audio e dalla lingua parlata. 25 delle 100+ lingue supportate eseguono la diarizzazione dello speaker a livello di parola; le altre trascrivono in testo senza etichette per speaker. Un singolo microfono con i partecipanti vicini e un cross-talk limitato offre anche la divisione più chiara tra gli speaker. Vedi come misuriamo l’accuratezza.
Trascrizione multi-speaker vs altre app
| Funzionalità | ScreenApp | Otter.ai | Rev | Sonix |
|---|---|---|---|---|
| Piano gratuito | 2 trascrizioni, fino a 45 min ciascuna | 300 min/mese | 45 min/mese (AI) | Prova di 30 min |
| Identificazione dello speaker | Inclusa | Base | Inclusa | Inclusa |
| Rinomina speaker | clicca su un'etichetta del relatore per rinominarla, abbinarla a un membro del team o riassegnare un singolo segmento | Non dichiarato | Non dichiarato | Non dichiarato |
| Note AI | Incluse | Pro, $8.33/mese fatturato annualmente, o $16.99 mensile | Non dichiarato | Non dichiarato |
| Formati di esportazione | PDF, DOCX, TXT, SRT e VTT | mp3 e txt nel piano gratuito, più pdf, docx e srt da Pro, con esportazione in blocco da Business | Non dichiarato | DOCX, PDF, TXT, SRT, VTT |
| Lingue | 100+ | 6 | Non dichiarato | 54+ |
| Piano a pagamento | $19/mese annuale | $8.33/mese annuale | $25.49/mese annuale | $25/mese |
Sources, checked 2026-10-01: screenapp.io/accuracy#languages, ScreenApp pricing, screenapp.io/help/how-many-minutes-can-i-record, otter.ai/pricing, rev.com/pricing, sonix.ai/pricing, Editing speaker labels
- vs Otter.ai: Il piano gratuito di Otter ti limita a 300 minuti al mese, e il suo livello di identificazione dello speaker sul piano gratuito è Base. ScreenApp include le etichette speaker su ogni piano e ti permette di rinominare un’etichetta a posteriori.
- vs Rev: Il livello gratuito di Rev offre 45 minuti AI al mese, quindi addebita $25.49/mese (fatturato annualmente) al minuto per una trascrizione AI o $1.99 al minuto per una umana. Una serie ricorrente di registrazioni multi-speaker si accumula rapidamente a entrambe le tariffe.
- vs Sonix: Sonix offre una prova una tantum di 30 minuti, quindi un piano da $25 al mese. Il piano gratuito di ScreenApp si rinnova anziché essere una prova una tantum.
Chi usa la trascrizione multi-speaker
I giornalisti trascrivono interviste e discussioni di gruppo con diverse fonti, quindi citano direttamente ogni speaker con un timestamp per la verifica dei fatti.
I produttori di podcast trascrivono episodi con un conduttore e più ospiti, dividendo la conversazione per speaker per estrarre note e clip dello show.
I ricercatori trascrivono interviste di gruppo e focus group, quindi leggono la trascrizione per speaker per vedere come ha risposto ogni partecipante.
I team di recruiting e HR trascrivono interviste di gruppo con diversi intervistatori e un candidato, in modo che chiunque riveda il file in seguito possa vedere chi ha chiesto cosa.
I team legali e di conformità trascrivono deposizioni, chiamate multi-parte e dichiarazioni registrate in cui è importante sapere quale persona ha detto quale frase.
I team di documentari e video trascrivono filmati di interviste con più di un soggetto, utilizzando le etichette speaker per registrare chi è in camera in ogni momento.


