Diarisation des locuteurs en ligne

Chargez un enregistrement avec plus d'un locuteur et obtenez une transcription qui identifie qui parle, avec des horodatages que vous pouvez rechercher et exporter.

Les fichiers sont traités dans le cloud. Un compte gratuit est nécessaire pour utiliser et enregistrer les résultats dans l'application. Le téléchargement des fichiers nécessite un abonnement payant.

MP3, WAV, M4A, AAC, OGG, FLAC, AMR, WMA

Ou coller un lien audio

YouTube, TikTok, Instagram, Vimeo, Google Drive, Dropbox, liens directs

Les enregistrements sont chiffrés en transit et au repos et ne sont pas utilisés pour entraîner les modèles d'IA. Confidentialité · Sécurité

Étiquetez les locuteurs dans une transcription, obtenez des horodatages

Chargez un fichier audio ou vidéo avec plus d’un locuteur, ou collez un lien vers celui-ci, et ScreenApp renvoie une transcription qui étiquette les interventions de chaque locuteur avec un horodatage. L’enregistrement n’a pas besoin d’être téléchargé depuis votre appareil : un lien depuis Dropbox, Google Drive ou un hébergeur de podcast fonctionne également.

Une transcription étiquetée signifie que vous pouvez trouver ce qu’une personne spécifique a dit sans réécouter tout l’enregistrement.

Ce que vous obtenez :

Le système attribue les locuteurs par la voix, et non en faisant correspondre les visages ou les noms, de sorte que chaque enregistrement commence par des étiquettes génériques (Locuteur 1, Locuteur 2) que vous renommez ensuite.

Comment identifier les locuteurs dans l’audio

  1. Téléchargez ou collez un lien : Faites glisser un fichier (MP3, M4A, MP4A, M4B, AAC, WAV, OGG, OPUS, FLAC, AIFF, WMA, WEBMA, MKA, AC3, EAC3, WV, AMR, DSF, DFF, jusqu’à 2 GB dans l’outil en ligne gratuit) ou collez un lien depuis Dropbox, Google Drive ou un hébergeur de podcast.
  2. La transcription sépare par locuteur : Chaque voix reçoit sa propre étiquette, avec un horodatage à chaque intervention.
  3. Renommez et exportez : Cliquez sur une étiquette d'intervenant pour la renommer, l'associer à un membre de l'équipe ou réaffecter un seul segment. Exportez la transcription finale au format PDF, DOCX, TXT, SRT et VTT.

Un audio clair avec des voix distinctes se sépare mieux, et Le chevauchement de la parole peut perturber le système de diarisation, alors évitez que les locuteurs ne se parlent en même temps lorsque vous le pouvez. Voir comment nous mesurons la précision.

Diarisation des locuteurs vs autres applications

FonctionnalitéScreenAppAssemblyAIOtter.aiNotta
Plan gratuit2 transcriptions, 45 min$50 en crédits300 min/mois, 30 min/conversation120 min/mois, 3 min/conversation
Étiquettes de locuteursInclus+0,02 $/heure en supplémentInclus à partir du plan BasiqueInclus
Langues100+Non spécifié658
Formats d’exportationPDF, DOCX, TXT, SRT et VTTNon spécifiémp3 et txt avec l'offre gratuite, plus pdf, docx et srt à partir de Pro, avec export groupé à partir de BusinessTXT, DOCX, PDF ou XLSX
Plan payant$19/mois annuel$0.15/heure$8.33/mois annuel$8.17/mois annuel

Sources, checked 2026-09-24: screenapp.io/accuracy#languages, ScreenApp pricing, screenapp.io/help/how-many-minutes-can-i-record, assemblyai.com/pricing, otter.ai/pricing, notta.ai/en/pricing, notta.ai/en, notta.ai/en/lecture-summarizer

  • vs AssemblyAI : AssemblyAI est une API pour développeurs, facturée $0.15 l’heure d’audio avec la diarisation des locuteurs comme supplément de +0,02 $/heure, et $50 en crédits gratuits pour un nouveau compte. ScreenApp est une application complète : téléchargez un fichier et obtenez la transcription étiquetée, aucune intégration requise.
  • vs Otter.ai : Le plan gratuit d’Otter est de 300 minutes par mois, plafonné à 30 minutes par conversation, avec identification des locuteurs à partir du plan Basique. Le plan gratuit de ScreenApp est de 2 transcriptions pour des enregistrements de 45 minutes maximum chacun, avec les étiquettes de locuteurs incluses dès le début.
  • vs Notta : Le plan gratuit de Notta offre 120 minutes par mois en clips de jusqu’à 3 minutes, avec identification des locuteurs incluse. Notta transcrit 58 langues ; ScreenApp transcrit 100+.

Qui utilise la diarisation des locuteurs

Les podcasteurs téléchargent l’épisode brut et obtiennent une transcription divisée par animateur et invité, prête à être collée dans les notes d’émission ou une page de transcription pour l’épisode.

Les notes de réunion et d’entretien sont améliorées lorsque l’audio seul indique toujours qui a dit quoi. Les intervieweurs utilisent la séparation des locuteurs pour distinguer leurs propres questions des réponses sans réécouter.

Les chercheurs menant des groupes de discussion ou des entretiens qualitatifs utilisent des étiquettes de locuteurs cohérentes pour suivre qui a contribué quoi, au lieu d’étiqueter les interventions à la main.

Les professionnels du droit et de la santé ont besoin de transcriptions avec étiquettes de locuteurs pour les dépositions, les appels clients et les consultations, avec un horodatage attaché à chaque intervention.

FAQ

Qu'est-ce que la diarisation des locuteurs ?

La diarisation des locuteurs est le processus qui consiste à déterminer qui a parlé et quand dans un enregistrement. Le système regroupe l'audio par voix et attribue à chaque segment une étiquette de locuteur, de sorte que la transcription se lit comme Locuteur 1, Locuteur 2, et ainsi de suite, chaque intervention étant horodatée.

Quelle est la précision de la diarisation des locuteurs ?

La précision dépend de l'enregistrement : un audio clair avec des voix distinctes se sépare mieux, et Le chevauchement de la parole peut perturber le système de diarisation. Voir comment la précision est mesurée.

Combien de locuteurs peut-elle identifier ?

La diarisation attribue une étiquette à chaque voix distincte qu'elle détecte dans l'enregistrement, de deux locuteurs jusqu'à une conversation de groupe complète. Plus il y a de locuteurs, surtout avec des voix similaires ou des chevauchements de parole, plus la séparation est difficile.

Fonctionne-t-elle pour les podcasts ?

Oui. Téléchargez le fichier de l'épisode ou collez un lien depuis votre hébergeur de podcast, et chaque animateur et invité reçoit une étiquette de locuteur distincte que vous pouvez renommer dans la transcription.

Fait-elle de la diarisation en temps réel ?

Non, c'est un outil de téléchargement : il traite un fichier ou un lien une fois l'enregistrement terminé, et non pendant qu'il se déroule. Pour les réunions en direct, utilisez l'enregistreur de réunions, qui enregistre et transcrit pendant l'appel.

Quels formats audio et vidéo fonctionnent ?

Peut-elle identifier des personnes spécifiques par leur nom ?

Pas automatiquement. Le système attribue des étiquettes génériques (Locuteur 1, Locuteur 2) uniquement à partir de la voix ; il ne fait pas correspondre une voix à une identité connue. Ensuite, Cliquez sur une étiquette d'intervenant pour la renommer, l'associer à un membre de l'équipe ou réaffecter un seul segment.

Existe-t-il un niveau gratuit ?

Oui. 2 transcriptions pour des enregistrements de 45 minutes maximum chacun, avec les étiquettes de locuteurs, les horodatages et l'exportation inclus. Le plan Pro à $19 par mois facturé annuellement supprime la limite d'enregistrement.

Résultats Réels d'Utilisateurs Réels

works like a charm, notes have been super helpful alongside chat function. loveeeee
KS
Katharine Suy
Chrome Web Store, October 17, 2024
nice app for important summary
S
SAHIL
Google Play, January 30, 2026

Prêt à augmenter votre productivité ?

Commencez Diarisation des locuteurs avec un compte gratuit. Des limites d'utilisation s'appliquent ; les téléchargements d'applications nécessitent un forfait payant.

Commencer Gratuitement →

Commencez à utiliser en 60 secondes