Transcription multi-locuteurs

Téléchargez un enregistrement avec plusieurs intervenants, ou enregistrez-le en direct, et obtenez une transcription avec chaque intervenant identifié et horodaté.

MP4, M4V, MOV, AVI, WEBM, MKV, FLV, TS, MTS, M2TS, 3GP, 3GPP, 3G2, WMV, ASF, VOB, OGV, RM, RMVB, MPG, MPEG, M2V, F4V, MXF. Essai gratuit, jusqu'à 45 minutes. Aucune installation.

MP4, MOV, WEBM, MKV, AVI, FLV, MTS, 3GP

Ou coller un lien vidéo

YouTube, TikTok, Instagram, Vimeo, Google Drive, Dropbox, liens directs

Les enregistrements sont chiffrés en transit et au repos et ne sont pas utilisés pour entraîner les modèles d'IA. Confidentialité · Sécurité

Identification des intervenants Notes et chat IA Plusieurs formats d'exportation

Transcrivez un enregistrement avec plusieurs intervenants, identifiez chacun d’eux

Téléchargez un enregistrement avec plusieurs personnes qui parlent, ou collez un lien, et ScreenApp le transforme en une transcription avec chaque intervenant identifié et un horodatage sur chaque ligne. Enregistrez la conversation en direct avec l’enregistreur de navigateur ou les Applications iOS et Android, ou connectez le bot de réunion pour Zoom, Google Meet et Microsoft Teams pour un appel, puis téléchargez le fichier lorsque vous l’avez.

Une transcription étiquetée remplace la réécoute d’un enregistrement pour savoir qui a dit quoi.

Ce que vous obtenez :

  • Une transcription avec Identification des intervenants, en 100+ langues
  • Chat IA avec n'importe quel enregistrement, pour que vous puissiez demander ce qu’un intervenant spécifique a dit au lieu de parcourir toute la transcription
  • Notes IA : Éléments d'action avec un propriétaire et une date limite, et décisions listées séparément
  • Exportation au format PDF, DOCX, TXT, SRT et VTT
  • Plan gratuit : 2 transcriptions pour des enregistrements de 45 minutes maximum chacun, avec chat IA activé

Comment transcrire plusieurs intervenants

  1. Téléchargez ou collez un lien : Faites glisser le fichier audio ou vidéo (MP4, M4V, MOV, AVI, WEBM, MKV, FLV, TS, MTS, M2TS, 3GP, 3GPP, 3G2, WMV, ASF, VOB, OGV, RM, RMVB, MPG, MPEG, M2V, F4V, MXF), ou collez un lien. Aucune configuration de compte n’est nécessaire pour commencer.
  2. Laissez-le transcrire : L’audio est converti en texte et chaque personne est divisée en sa propre étiquette d’intervenant, avec un horodatage sur chaque phrase.
  3. Réviser et exporter : Lisez la transcription dans le navigateur, renommez une étiquette d’intervenant si nécessaire, et exportez au format PDF, DOCX, TXT, SRT et VTT.

La précision dépend de l’audio et de la langue parlée. 25 des 100+ langues prises en charge prennent en charge la diarisation des intervenants au niveau du mot ; les autres transcrivent en texte sans étiquettes par intervenant. Un seul microphone avec des participants proches et une diaphonie limitée donne également la séparation la plus claire entre les intervenants. Voir comment nous mesurons la précision.

Transcription multi-locuteurs vs autres applications

FonctionnalitéScreenAppOtter.aiRevSonix
Plan gratuit2 transcriptions, jusqu’à 45 min chacune300 min/mois45 min/mois (IA)Essai de 30 min
Identification des intervenantsIncluseBasiqueIncluseIncluse
Renommer l’intervenantCliquez sur une étiquette d'intervenant pour la renommer, l'associer à un membre de l'équipe ou réaffecter un seul segmentNon spécifiéNon spécifiéNon spécifié
Notes IAInclusePro, $8.33/mois facturé annuellement, ou $16.99 mensuelNon spécifiéNon spécifié
Formats d’exportationPDF, DOCX, TXT, SRT et VTTmp3 et txt avec l'offre gratuite, plus pdf, docx et srt à partir de Pro, avec export groupé à partir de BusinessNon spécifiéDOCX, PDF, TXT, SRT, VTT
Langues100+6Non spécifié54+
Plan payant$19/mois annuel$8.33/mois annuel$25.49/mois annuel$25/mois

Sources, checked 2026-10-01: screenapp.io/accuracy#languages, ScreenApp pricing, screenapp.io/help/how-many-minutes-can-i-record, otter.ai/pricing, rev.com/pricing, sonix.ai/pricing, Editing speaker labels

  • vs Otter.ai : Le plan gratuit d’Otter vous limite à 300 minutes par mois, et son niveau d’identification des intervenants sur le plan gratuit est Basique. ScreenApp inclut les étiquettes d’intervenants sur tous les plans et vous permet de renommer une étiquette après coup.
  • vs Rev : Le niveau gratuit de Rev offre 45 minutes d’IA par mois, puis facture $25.49/mois (facturé annuellement) par minute pour une transcription IA ou $1.99 par minute pour une transcription humaine. Une série récurrente d’enregistrements multi-locuteurs s’accumule rapidement à l’un ou l’autre de ces tarifs.
  • vs Sonix : Sonix offre un essai unique de 30 minutes, puis un plan à $25 par mois. Le plan gratuit de ScreenApp se renouvelle plutôt que d’être un essai unique.

Qui utilise la transcription multi-locuteurs

Les journalistes transcrivent des interviews et des tables rondes avec plusieurs sources, puis citent chaque intervenant directement avec un horodatage pour la vérification des faits.

Les producteurs de podcasts transcrivent des épisodes avec un animateur et plusieurs invités, en divisant la conversation par intervenant pour extraire les notes d’émission et les extraits.

Les chercheurs transcrivent des entretiens de groupe et des groupes de discussion, puis lisent la transcription par intervenant pour voir comment chaque participant a répondu.

Les équipes de recrutement et de RH transcrivent des entretiens de groupe avec plusieurs intervieweurs et un candidat, afin que toute personne révisant le fichier plus tard puisse voir qui a posé quelle question.

Les équipes juridiques et de conformité transcrivent des dépositions, des appels multipartites et des déclarations enregistrées où il est important de savoir quelle personne a dit quelle ligne.

Les équipes de documentaires et de vidéos transcrivent des séquences d’interview avec plus d’un sujet, en utilisant les étiquettes d’intervenants pour enregistrer qui est à l’écran à chaque instant.

FAQ

Que signifie « identification des intervenants » dans une transcription ?

Cela signifie que la transcription indique qui parle à chaque instant, de sorte qu'au lieu d'un seul bloc de texte, vous obtenez des lignes séparées et étiquetées pour chaque personne.

Comment ScreenApp identifie-t-il les intervenants ?

Identification des intervenants divise l'audio en voix distinctes et étiquette chacune d'elles dans la transcription, en 100+ langues.

L'identification des intervenants fonctionne-t-elle dans toutes les langues ?

Non. La diarisation des intervenants au niveau du mot fonctionne sur 25 des 100+ langues prises en charge, marquées d'une dague sur la liste des langues. Les enregistrements dans les autres langues sont toujours transcrits en texte, sans étiquettes par intervenant.

Comment ScreenApp gère-t-il les personnes qui se parlent ?

Le chevauchement de la parole peut perturber le système de diarisation. Un seul microphone central avec une diaphonie limitée donne la séparation la plus claire entre les intervenants.

ScreenApp réduit-il le bruit de fond avant de transcrire ?

Non. ScreenApp n'applique pas de réduction de bruit. Un environnement d'enregistrement plus silencieux et un microphone placé près des intervenants produisent une transcription plus propre qu'une pièce bruyante.

Puis-je exporter une transcription multi-locuteurs ?

Oui, au format PDF, DOCX, TXT, SRT et VTT, avec les étiquettes d'intervenants et les horodatages conservés dans le fichier exporté.

Puis-je poser des questions sur ce qu'un intervenant spécifique a dit ?

Oui, Chat IA avec n'importe quel enregistrement vous permet de poser des questions sur la discussion et d'obtenir une réponse qui renvoie au moment de l'enregistrement, y compris qui l'a dit.

Un enregistrement multi-locuteurs est-il conservé en privé ?

Les enregistrements sont chiffré en transit et stockés avec AES-256, sur l'infrastructure SOC 2 Type 2, et ne sont Non utilisé pour entraîner les modèles d'IA. Les contrôles de sécurité sont publiés sur le centre de confiance.

First-party usage data

2,167,954

speakers identified

across all transcribed recordings to date. Pulled at build time from the ScreenApp production database. Methodology: see the accuracy page.

First-party production data

What ScreenApp users actually record

Top content types across 73,857 labelled recordings in the last 90 days. Pulled at build time from videometainfo.meetingType in production. Methodology: accuracy page.

14,348

training

19.4% of labelled

14,287

podcast

19.3% of labelled

13,377

call

18.1% of labelled

13,126

meeting

17.8% of labelled

11,010

lecture

14.9% of labelled

3,398

webinar

4.6% of labelled

3,020

presentation

4.1% of labelled

1,291

interview

1.7% of labelled

Prêt à transcrire votre contenu?

Téléchargez un enregistrement avec plusieurs intervenants, ou enregistrez-le en direct, et obtenez une transcription avec chaque intervenant identifié et horodaté.