Transcrivez un enregistrement avec plusieurs intervenants, identifiez chacun d’eux
Téléchargez un enregistrement avec plusieurs personnes qui parlent, ou collez un lien, et ScreenApp le transforme en une transcription avec chaque intervenant identifié et un horodatage sur chaque ligne. Enregistrez la conversation en direct avec l’enregistreur de navigateur ou les Applications iOS et Android, ou connectez le bot de réunion pour Zoom, Google Meet et Microsoft Teams pour un appel, puis téléchargez le fichier lorsque vous l’avez.
Une transcription étiquetée remplace la réécoute d’un enregistrement pour savoir qui a dit quoi.
Ce que vous obtenez :
- Une transcription avec Identification des intervenants, en 100+ langues
- Chat IA avec n'importe quel enregistrement, pour que vous puissiez demander ce qu’un intervenant spécifique a dit au lieu de parcourir toute la transcription
- Notes IA : Éléments d'action avec un propriétaire et une date limite, et décisions listées séparément
- Exportation au format PDF, DOCX, TXT, SRT et VTT
- Plan gratuit : 2 transcriptions pour des enregistrements de 45 minutes maximum chacun, avec chat IA activé
Comment transcrire plusieurs intervenants
- Téléchargez ou collez un lien : Faites glisser le fichier audio ou vidéo (MP4, M4V, MOV, AVI, WEBM, MKV, FLV, TS, MTS, M2TS, 3GP, 3GPP, 3G2, WMV, ASF, VOB, OGV, RM, RMVB, MPG, MPEG, M2V, F4V, MXF), ou collez un lien. Aucune configuration de compte n’est nécessaire pour commencer.
- Laissez-le transcrire : L’audio est converti en texte et chaque personne est divisée en sa propre étiquette d’intervenant, avec un horodatage sur chaque phrase.
- Réviser et exporter : Lisez la transcription dans le navigateur, renommez une étiquette d’intervenant si nécessaire, et exportez au format PDF, DOCX, TXT, SRT et VTT.
La précision dépend de l’audio et de la langue parlée. 25 des 100+ langues prises en charge prennent en charge la diarisation des intervenants au niveau du mot ; les autres transcrivent en texte sans étiquettes par intervenant. Un seul microphone avec des participants proches et une diaphonie limitée donne également la séparation la plus claire entre les intervenants. Voir comment nous mesurons la précision.
Transcription multi-locuteurs vs autres applications
| Fonctionnalité | ScreenApp | Otter.ai | Rev | Sonix |
|---|---|---|---|---|
| Plan gratuit | 2 transcriptions, jusqu’à 45 min chacune | 300 min/mois | 45 min/mois (IA) | Essai de 30 min |
| Identification des intervenants | Incluse | Basique | Incluse | Incluse |
| Renommer l’intervenant | Cliquez sur une étiquette d'intervenant pour la renommer, l'associer à un membre de l'équipe ou réaffecter un seul segment | Non spécifié | Non spécifié | Non spécifié |
| Notes IA | Incluse | Pro, $8.33/mois facturé annuellement, ou $16.99 mensuel | Non spécifié | Non spécifié |
| Formats d’exportation | PDF, DOCX, TXT, SRT et VTT | mp3 et txt avec l'offre gratuite, plus pdf, docx et srt à partir de Pro, avec export groupé à partir de Business | Non spécifié | DOCX, PDF, TXT, SRT, VTT |
| Langues | 100+ | 6 | Non spécifié | 54+ |
| Plan payant | $19/mois annuel | $8.33/mois annuel | $25.49/mois annuel | $25/mois |
Sources, checked 2026-10-01: screenapp.io/accuracy#languages, ScreenApp pricing, screenapp.io/help/how-many-minutes-can-i-record, otter.ai/pricing, rev.com/pricing, sonix.ai/pricing, Editing speaker labels
- vs Otter.ai : Le plan gratuit d’Otter vous limite à 300 minutes par mois, et son niveau d’identification des intervenants sur le plan gratuit est Basique. ScreenApp inclut les étiquettes d’intervenants sur tous les plans et vous permet de renommer une étiquette après coup.
- vs Rev : Le niveau gratuit de Rev offre 45 minutes d’IA par mois, puis facture $25.49/mois (facturé annuellement) par minute pour une transcription IA ou $1.99 par minute pour une transcription humaine. Une série récurrente d’enregistrements multi-locuteurs s’accumule rapidement à l’un ou l’autre de ces tarifs.
- vs Sonix : Sonix offre un essai unique de 30 minutes, puis un plan à $25 par mois. Le plan gratuit de ScreenApp se renouvelle plutôt que d’être un essai unique.
Qui utilise la transcription multi-locuteurs
Les journalistes transcrivent des interviews et des tables rondes avec plusieurs sources, puis citent chaque intervenant directement avec un horodatage pour la vérification des faits.
Les producteurs de podcasts transcrivent des épisodes avec un animateur et plusieurs invités, en divisant la conversation par intervenant pour extraire les notes d’émission et les extraits.
Les chercheurs transcrivent des entretiens de groupe et des groupes de discussion, puis lisent la transcription par intervenant pour voir comment chaque participant a répondu.
Les équipes de recrutement et de RH transcrivent des entretiens de groupe avec plusieurs intervieweurs et un candidat, afin que toute personne révisant le fichier plus tard puisse voir qui a posé quelle question.
Les équipes juridiques et de conformité transcrivent des dépositions, des appels multipartites et des déclarations enregistrées où il est important de savoir quelle personne a dit quelle ligne.
Les équipes de documentaires et de vidéos transcrivent des séquences d’interview avec plus d’un sujet, en utilisant les étiquettes d’intervenants pour enregistrer qui est à l’écran à chaque instant.


