Ce que fait le traducteur vocal
Ce traducteur vocal convertit la parole entre 99 langues ; la qualité de la traduction suit le taux d’erreur de mots de la langue source. Téléchargez des enregistrements ou parlez en direct dans le navigateur. Pas de téléchargement, pas de compte, pas de limites de minutes.
Déposez un fichier audio, obtenez du texte traduit. Téléchargez des fichiers MP3, WAV, M4A, MP4, OGG ou FLAC. Le modèle transcrit la langue source, effectue la traduction dans la langue cible que vous choisissez et exporte le résultat sous forme de texte brut, SRT ou VTT pour le sous-titrage. Les fichiers jusqu’à 3 heures fonctionnent en un seul passage.
La traduction en direct s’exécute dans le même onglet du navigateur. Cliquez sur le microphone, parlez, et le texte traduit apparaît en moins de 1,5 seconde. Utile pour les appels de support internationaux, les réunions avec des fournisseurs et les entretiens bilingues où attendre la fin d’un enregistrement n’est pas une option (référence de latence d’avril 2026).
Fonctionnalités clés :
- Traduction vocale vers l’anglais depuis n’importe quelle langue source avec détection automatique
- Traduction vocale en direct avec un délai de moins de 1,5 seconde
- Téléchargement de fichiers audio jusqu’à 3 heures (MP3, WAV, M4A, MP4, OGG, FLAC)
- Traducteur vocal gratuit pour les réunions, les appels et les présentations
- Gère les accents, les dialectes et le bruit de fond ; WER par langue sur la page de précision
- Sortie vocale pour que les traductions soient lues sous forme d’audio parlé
- Basé sur navigateur, aucune installation
- Transcriptions horodatées pour la documentation et la recherche
L’outil est conçu pour les réunions enregistrées, les podcasts, les entretiens, les appels de support client et le contenu vidéo. Utilisez le mode en direct pour une conversation en temps réel ou téléchargez des fichiers pour un travail par lots avec des transcriptions consultables.
Matrice de qualité des paires de langues
La qualité de la traduction suit la qualité de la transcription. Les paires avec un faible taux d’erreur de mots (WER) sur la langue source produisent des traductions plus claires car il y a moins d’entrée brouillée à interpréter pour le passage de traduction. Les chiffres ci-dessous proviennent du retest WER d’avril 2026.
| Paire de langues | WER moyen (transcription) | Qualité de la traduction | Notes |
|---|---|---|---|
| en, es | 4-5% | Excellente | Paire à plus fort volume, la plus entraînée |
| en, pt | 5-6% | Excellente | Variantes brésilienne et européenne prises en charge |
| en, fr | 5-6% | Excellente | Français québécois couvert |
| en, de | 6-7% | Bonne | Mots composés gérés correctement |
| en, ja | 7-8% | Bonne | Ponctuation reconstruite |
| en, zh | 7-8% | Bonne | Simplifié et traditionnel |
| en, ko | 7-8% | Bonne | Niveaux d’honorifiques préservés |
| es, pt | 5-6% | Excellente | Forte inter-intelligibilité mutuelle |
| en, ar | 9-10% | Acceptable | Arabe standard moderne uniquement, couverture dialectale limitée |
| en, hi | 9-10% | Acceptable | Alternance codique avec l’anglais gérée |
Pour les paires non listées, recherchez le WER de la langue source dans le tableau de précision par langue et ajoutez environ un niveau de qualité entre la catégorie WER et la traduction finale. Les paires dans la plage de WER de 10 %+ produisent toujours des traductions utiles pour la compréhension générale, mais attendez-vous à plus de polissage des noms propres et des expressions idiomatiques.
Comment utiliser le traducteur vocal
L’outil fonctionne en trois étapes, que vous téléchargiez un enregistrement ou que vous parliez en direct.
- Téléchargez des fichiers audio (MP3, WAV, M4A, MP4, OGG, FLAC) ou cliquez sur le microphone pour parler en direct
- L’IA détecte automatiquement la langue source parmi plus de 100 options
- La parole est convertie dans votre langue cible avec des horodatages (jusqu’à 95.8% de précision de transcription sur un audio clair)
- Copiez le texte ou téléchargez la transcription traduite
Les langues prises en charge incluent l’espagnol, le français, l’allemand, le chinois, le japonais, le coréen, l’arabe, l’hindi, le portugais, le russe, l’italien et le néerlandais, ainsi que plus de 90 autres.
Le mode traducteur vocal en direct traite les conversations instantanément avec une latence inférieure à 1,5 seconde. Il est conçu pour les réunions d’affaires, les appels clients, les entretiens et les présentations internationales. Cliquez pour parler et traduire pendant un appel sans changer d’onglet.
L’entrée microphone capture votre parole directement dans le navigateur. Cliquez sur le bouton microphone, accordez la permission et parlez. L’IA détecte la langue, traduit le contenu et affiche le résultat. Fonctionne sur les navigateurs de bureau et mobiles.
Comparaison du traducteur vocal avec d’autres outils
| Fonctionnalité | ScreenApp | Maestra | Sonix | Notta | Speechmatics | Veed.io |
|---|---|---|---|---|---|---|
| Niveau gratuit | 2 transcriptions | Essai de 30 min | Essai de 30 min | 120 min/mois | 8 heures/mois |
Sources, checked 2026-09-29: ScreenApp pricing
- vs Maestra : Maestra clone la voix d’un locuteur pour une lecture doublée dans la langue cible, ce qui est utile pour la localisation vidéo. Il limite l’essai gratuit à 30 minutes. ScreenApp utilise des voix TTS génériques au lieu du clonage, mais l’utilisation gratuite n’a pas de limite de minutes et exporte directement les fichiers SRT/VTT.
- vs Speechmatics : Speechmatics est un moteur de transcription API facturé à 0,30 $ par heure audio avec 8 heures gratuites par mois. Il nécessite une intégration développeur pour traduire. ScreenApp fonctionne dans le navigateur sans code.
- vs Veed.io : Veed.io ajoute le clonage vocal IA et le style de sous-titres à l’écran pour les éditeurs vidéo, avec un niveau gratuit mensuel de 30 minutes. ScreenApp se concentre sur le chemin de traduction audio-vers-texte et ignore l’édition vidéo, mais gère des fichiers plus longs (3 heures vs 2 Go) sans frais.
Traduction avec sortie vocale
Le traducteur vocal renvoie des transcriptions textuelles et de l’audio parlé dans la langue cible. Après avoir converti la parole en texte, il diffuse un son naturel grâce à la synthèse vocale.
Fonctionnalités de sortie vocale :
- Prononciation naturelle dans plus de 100 voix de langues, y compris les accents régionaux
- Débit de parole réglable pour ralentir ou accélérer l’audio traduit
- Sélection du genre pour les options de voix masculine ou féminine dans la plupart des langues
- Lecture instantanée pendant les conversations en direct
- Fichiers audio téléchargeables de la parole traduite
Utilisez la sortie vocale pour l’apprentissage des langues, l’accessibilité ou tout contexte où la lecture de texte n’est pas pratique : appels téléphoniques, conduite ou réunions mains libres. La traduction parlée aide également à la prononciation et à l’intonation.
À qui s’adresse le traducteur vocal
Les équipes de localisation livrant du contenu multilingue transmettent les voix off, les spots publicitaires et les tutoriels produit en langue source via le traducteur pour produire des fichiers SRT pour chaque marché de lancement. La couverture de plus de 100 langues réduit le nombre de fournisseurs nécessaires pour une seule version.
Les journalistes couvrant des entretiens en langue étrangère téléchargent les enregistrements sur le terrain le jour même de leur capture. La transcription et la traduction sont renvoyées avec des horodatages, afin qu’un journaliste puisse citer une citation à 00:14:32 sans payer un assistant séparé.
Les professeurs de langues préparant des supports bilingues déposent un podcast ou un extrait d’actualité dans l’outil et obtiennent à la fois la transcription source et la traduction anglaise. Les étudiants comparent les deux côte à côte, et l’exportation SRT se connecte aux lecteurs vidéo en classe.
Les équipes de support gérant les tickets audio non anglophones traduisent les messages vocaux et les enregistrements Zoom de clients qui ne parlent pas la langue de l’équipe. L’agent lit la transcription traduite dans son système d’assistance et répond par écrit sans acheminer le ticket vers une file d’attente bilingue.
Ce qui se perd dans la traduction vocale
La traduction vocale automatique est bonne pour le sens, mais plus faible pour les éléments autour du sens. Les expressions idiomatiques, le sarcasme et les jeux de mots s’aplanissent ; une blague qui repose sur un calembour dans la langue source revient sous forme de phrase littérale et peu drôle. C’est une limite de la traduction elle-même, pas spécifiquement de cet outil, et il est bon de le savoir avant de vous fier au résultat pour quoi que ce soit de nuancé.
Les noms et les termes techniques sont l’autre point faible. Un nom de famille que le modèle interprète comme un mot courant est traduit au lieu d’être conservé, et un terme de niche peut revenir comme son équivalent quotidien le plus proche. Pour une conversation informelle, rien de tout cela n’a d’importance. Pour un enregistrement juridique ou médical, considérez la traduction automatique comme une première passe rapide et faites vérifier par un humain les parties qui ont un poids réel.