Traductor de voz en línea

Traductor de voz para conversaciones en vivo y archivos de audio. Traduce voz a inglés de 99 idiomas, sube grabaciones MP3/WAV o ejecuta la traducción de voz en vivo en el navegador.

O escribe aquí
English

Las grabaciones están cifradas en tránsito y en reposo y no se usan para entrenar modelos de IA. Privacidad · Seguridad

Happy ScreenApp User
Online Screen Recorder avatar
Accountant using Screen Recording

2,291 sign-ups from this page in the last 90 days

Qué hace el traductor de voz

Este traductor de voz convierte el habla entre 99 idiomas; la calidad de la traducción sigue la tasa de error de palabras del idioma de origen. Sube grabaciones o habla en vivo en el navegador. Sin descarga, sin cuenta, sin límites de minutos.

Arrastra un archivo de audio, obtén texto traducido. Sube MP3, WAV, M4A, MP4, OGG o FLAC. El modelo transcribe el idioma de origen, realiza la traducción al destino que elijas y exporta el resultado como texto plano, SRT o VTT para subtítulos. Los archivos de hasta 3 horas funcionan en una sola pasada.

La traducción en vivo se ejecuta en la misma pestaña del navegador. Haz clic en el micrófono, habla, y el texto traducido aparece en menos de 1.5 segundos. Útil para llamadas de soporte internacionales, reuniones con proveedores y entrevistas bilingües donde esperar a que termine una grabación no es una opción (referencia de latencia de abril de 2026).

Capacidades clave:

  • Traducir voz a inglés desde cualquier idioma de origen con detección automática
  • Traducción de voz en vivo con menos de 1.5 segundos de retraso
  • Subir archivos de audio de hasta 3 horas de duración (MP3, WAV, M4A, MP4, OGG, FLAC)
  • Traductor de voz en vivo gratuito para reuniones, llamadas y presentaciones
  • Maneja acentos, dialectos y ruido de fondo; WER por idioma en la página de precisión
  • Salida de voz para que las traducciones se reproduzcan como audio hablado
  • Basado en navegador, sin instalación
  • Transcripciones con marca de tiempo para documentación y búsqueda

La herramienta está diseñada para reuniones grabadas, podcasts, entrevistas, llamadas de atención al cliente y contenido de vídeo. Usa el modo en vivo para conversaciones en tiempo real o sube archivos para trabajo por lotes con transcripciones buscables.

Matriz de calidad de pares de idiomas

La calidad de la traducción sigue la calidad de la transcripción. Los pares con baja tasa de error de palabras (WER) en el idioma de origen producen traducciones más limpias porque hay menos entrada distorsionada para que la fase de traducción la interprete. Los números a continuación son del reexamen de WER de abril de 2026.

Par de idiomasWER promedio (transcripción)Calidad de la traducciónNotas
en, es4-5%ExcelentePar de mayor volumen, más entrenado
en, pt5-6%ExcelenteVariantes brasileña y europea soportadas
en, fr5-6%ExcelenteFrancés de Quebec cubierto
en, de6-7%BuenoPalabras compuestas manejadas correctamente
en, ja7-8%BuenoPuntuación reconstruida
en, zh7-8%BuenoSimplificado y Tradicional
en, ko7-8%BuenoNiveles honoríficos preservados
es, pt5-6%ExcelenteAlta inteligibilidad mutua
en, ar9-10%AceptableSolo MSA, cobertura dialectal limitada
en, hi9-10%AceptableCambio de código con inglés manejado

Para los pares no listados, consulta el WER del idioma de origen en la tabla de precisión por idioma y añade aproximadamente un nivel de calidad entre el rango de WER y la traducción final. Los pares en el rango de WER del 10%+ aún producen traducciones útiles para la comprensión general, solo espera más pulido de nombres propios e modismos.

Cómo usar el traductor de voz

La herramienta funciona en tres pasos, ya sea que subas una grabación o hables en vivo.

  1. Sube archivos de audio (MP3, WAV, M4A, MP4, OGG, FLAC) o haz clic en el micrófono para hablar en vivo
  2. La IA detecta automáticamente el idioma de origen entre más de 100 opciones
  3. El habla se convierte a tu idioma objetivo con una precisión del 96%+ y con marcas de tiempo
  4. Copia el texto o descarga la transcripción traducida

Los idiomas soportados incluyen español, francés, alemán, chino, japonés, coreano, árabe, hindi, portugués, ruso, italiano y holandés, además de más de 90.

El modo de traductor de voz en vivo procesa conversaciones instantáneamente con una latencia inferior a 1.5 segundos. Está diseñado para reuniones de negocios, llamadas de clientes, entrevistas y presentaciones internacionales. Haz clic para hablar y traducir durante una llamada sin cambiar de pestaña.

La entrada de micrófono captura tu voz directamente en el navegador. Haz clic en el botón del micrófono, concede permiso y habla. La IA detecta el idioma, traduce el contenido y muestra el resultado. Funciona en navegadores de escritorio y móviles.

Comparación del Traductor de Voz con Otras Herramientas

CaracterísticaScreenAppMaestraSonixNottaSpeechmaticsVeed.io
Idiomas soportados100+125+535850+125+
Detección automática de idioma de origen
Clonación de voz para salida dobladaNo (voces TTS)NoNoNo
Límite de tamaño / duración de archivo3 horas por subida5 GB por archivo4 GB / 5 horas2 GB / 5 horas2 GB por archivo2 GB por archivo
Nivel gratuito1 grabación, 2 transcripciones, 3 subidasPrueba de 30 minPrueba de 30 min120 min/mes8 horas/mes
Formatos de exportaciónTXT, SRT, VTT, DOCXSRT, VTT, TXT, DOCXSRT, VTT, TXT, DOCXTXT, SRT, DOCX, PDFTXT, SRT, JSONSRT, VTT, TXT
Precio (de pago)Gratis$29/mes$22/hora$14.99/mes$0.30/hora API$24/mes

Sources, checked 2026-09-12: screenapp.io/pricing

  • vs Maestra: Maestra clona la voz de un orador para la reproducción doblada en el idioma de destino, lo cual es útil para la localización de videos. Limita la prueba gratuita a 30 minutos. ScreenApp utiliza voces TTS genéricas en lugar de clonar, pero el uso gratuito no tiene límite de minutos y exporta SRT/VTT directamente.
  • vs Sonix: Sonix cubre 53 idiomas y cobra $22 por hora de audio después de la prueba de 30 minutos. ScreenApp cubre 99 idiomas con traducción gratuita, aunque Sonix tiene etiquetas de diarización de altavoces más robustas en grabaciones de reuniones largas.
  • vs Notta: Notta ofrece 120 minutos gratuitos al mes en 58 idiomas y exporta SRT para trabajo de vídeo. ScreenApp acepta más formatos de archivo (OGG, FLAC incluidos) y elimina el límite mensual de minutos, mientras que Notta tiene una integración más estrecha con bots de Zoom y Google Meet.
  • vs Speechmatics: Speechmatics es un motor de transcripción API-first con un costo de $0.30 por hora de audio y 8 horas gratuitas al mes. Necesita integración por parte de un desarrollador para traducir. ScreenApp funciona en el navegador sin necesidad de código.
  • vs Veed.io: Veed.io añade clonación de voz por IA y estilo de subtítulos en pantalla para editores de video, con un nivel gratuito mensual de 30 minutos. ScreenApp se centra en la ruta de traducción de audio a texto y omite la edición de video, pero maneja archivos más largos (3 horas vs 2 GB) sin costo.

Traducción con Salida de Voz

El traductor de voz devuelve transcripciones de texto y audio hablado en el idioma de destino. Después de convertir el habla a texto, reproduce audio de sonido natural utilizando texto a voz.

Características de la salida de voz:

  • Pronunciación natural en más de 100 voces de idiomas, incluyendo acentos regionales
  • Velocidad de habla ajustable para ralentizar o acelerar el audio traducido
  • Selección de género para opciones de voz masculina o femenina en la mayoría de los idiomas
  • Reproducción instantánea durante conversaciones en vivo
  • Archivos de audio descargables del habla traducida

Usa la salida de voz para el aprendizaje de idiomas, la accesibilidad o cualquier entorno donde leer texto no sea práctico, llamadas telefónicas, conducir o reuniones manos libres. La traducción hablada también ayuda con la pronunciación y la entonación.

Para Quién Es el Traductor de Voz

Los equipos de localización que distribuyen contenido multilingüe pasan locuciones en el idioma original, anuncios y tutoriales de productos a través del traductor para producir archivos SRT para cada mercado de lanzamiento. La cobertura de más de 100 idiomas reduce el número de proveedores necesarios para un único lanzamiento.

Los periodistas que cubren entrevistas en idiomas extranjeros suben grabaciones de campo el mismo día que se capturan. La transcripción y la traducción regresan con marcas de tiempo, de modo que un reportero puede citar una frase a las 00:14:32 sin pagar por un asistente aparte.

Los profesores de idiomas que preparan materiales bilingües insertan un podcast o un clip de noticias en la herramienta y obtienen tanto la transcripción original como la traducción al inglés. Los estudiantes comparan ambos lado a lado, y la exportación SRT se conecta a los reproductores de video del aula.

Los equipos de soporte que gestionan tickets de audio en idiomas no ingleses traducen correos de voz y grabaciones de Zoom de clientes que no hablan el idioma del equipo. El agente lee la transcripción traducida en su mesa de ayuda y responde por escrito sin derivar el ticket a una cola bilingüe.

Qué Se Pierde en la Traducción de Voz

La traducción automática de voz es buena para el significado y más débil en las cosas que rodean el significado. Los modismos, el sarcasmo y los juegos de palabras se aplanan; un chiste que depende de un juego de palabras en el idioma original vuelve como una frase literal y sin gracia. Eso es un límite de la traducción en sí misma, no de esta herramienta específicamente, y vale la pena saberlo antes de confiar en el resultado para cualquier cosa matizada.

Los nombres y los términos técnicos son el otro punto débil. Un apellido que el modelo lee como una palabra común se traduce en lugar de conservarse, y un término especializado puede regresar como su equivalente cotidiano más cercano. Para una conversación informal, nada de esto importa. Para una grabación legal o médica, trate la traducción automática como una primera pasada rápida y haga que un humano revise las partes que tienen un peso real.

FAQ

¿Cómo traduzco audio en vivo al inglés?

Haga clic en el botón del micrófono, hable en cualquier idioma, y la herramienta devuelve la traducción al inglés en menos de 1.5 segundos. La IA detecta el idioma de origen entre más de 100 opciones y produce texto en inglés y voz opcional. No requiere instalación de aplicación.

¿Cómo traduzco archivos de audio al inglés?

Suba archivos MP3, WAV, M4A, MP4, OGG o FLAC. La herramienta detecta el idioma de origen y convierte el habla a texto en inglés con alta precisión. Descargue la transcripción traducida con marcas de tiempo para documentación y búsqueda.

¿Cuál es el mejor traductor de voz online?

Depende del trabajo. Sonix y Speechmatics producen las transcripciones de formato largo más limpias para usuarios de pago. Maestra y Veed.io son útiles cuando necesita una voz clonada para salida doblada. ScreenApp maneja cargas de archivos de audio y voz en vivo en 99 idiomas sin límite de minutos en el nivel gratuito, lo que lo convierte en una buena opción predeterminada para trabajos de traducción ad-hoc.

¿Puedo usar el traductor de voz gratis?

Sí. Los usuarios gratuitos obtienen traducción ilimitada de archivos y en vivo en 99 idiomas. Microsoft Translator limita a los usuarios de 365 a 300 minutos al mes. El nivel gratuito de DeepL Voice se detiene en 30 minutos al día. ScreenApp no tiene límite.

¿Cómo funciona la traducción de voz al inglés?

Hable por su micrófono o suba una grabación. La IA detecta el idioma de origen entre más de 100 opciones y produce texto en inglés en menos de 1.5 segundos. La reproducción de voz es opcional.

¿Puedo exportar subtítulos traducidos para trabajos de video?

Sí. Después de la traducción, elija SRT o VTT en el menú de exportación. El archivo utiliza las marcas de tiempo originales para que los subtítulos se ubiquen en los fotogramas correctos en Premiere, Final Cut, DaVinci Resolve o YouTube Studio. También están disponibles TXT y DOCX sin formato para entregables escritos.

¿La herramienta mantendrá las etiquetas de orador en una grabación multipersonal?

La transcripción marca los turnos de orador cuando las voces están claramente separadas, luego lleva esas etiquetas al resultado traducido. Para el habla superpuesta en una grabación de reunión concurrida, las etiquetas se vuelven de mejor esfuerzo y es posible que desee verificar los solapamientos.

¿Cómo funciona el traductor en vivo en tiempo real?

El modo en vivo utiliza el micrófono de su navegador. La herramienta captura audio, ejecuta reconocimiento de voz, detecta el idioma de origen, traduce al idioma de destino y produce texto con voz opcional. La latencia es inferior a 1.5 segundos.

¿Puedo traducir voz de archivos de video?

Sí. Suba archivos MP4, AVI, MOV, MKV, WEBM o 3GP. La herramienta extrae el audio, traduce el habla y devuelve una transcripción completa con marcas de tiempo. Exporte subtítulos traducidos en SRT para edición de video.

¿Qué formatos de archivo de audio puedo traducir?

MP3, WAV, M4A, AAC, MP4, OGG y FLAC. Suba archivos de hasta 3 horas de duración con detección automática de idioma.

¿Qué tan preciso es el reconocimiento de voz en el traductor?

La precisión es del 96%+ en 99 idiomas (actualización del modelo de abril de 2026). Los pares comunes son más altos, español-inglés al 97.2%, francés-inglés al 96.8%, mandarín-inglés al 96.4%. El modelo maneja acentos regionales, dialectos, ruido de fondo y terminología técnica.

¿El traductor de voz funciona en dispositivos móviles?

Sí. Funciona en navegadores móviles en iOS y Android. No requiere instalación de aplicación. La interfaz se adapta a pantallas más pequeñas.

¿Puede el traductor de voz detectar el idioma de origen automáticamente?

Sí. La IA identifica el idioma de origen entre 99 idiomas utilizando análisis de fonemas y patrones de habla, incluidos dialectos y acentos regionales. Usted solo elige el idioma de destino.

¿Es gratuito el traductor de voz en vivo?

Sí. Traducción en vivo gratuita sin límite por minuto, sin suscripción y sin registro.

¿Es seguro usar el traductor de voz?

Sí. Los archivos de audio viajan a través de HTTPS y se eliminan automáticamente después de la traducción. Su audio nunca se utiliza para entrenar modelos de IA públicos. La herramienta no requiere información personal ni una cuenta. Cumple con GDPR con cifrado de extremo a extremo.

¿Puedo traducir una grabación de voz al inglés?

Sí. Suba el audio en casi cualquier idioma y traduce el habla a texto en inglés, y a otros 98 idiomas si los necesita. Es un traductor de voz diseñado para grabaciones reales, una nota de voz, una entrevista, una llamada, no solo frases cortas escritas.

Resultados Reales de Usuarios Reales

I have tried at least 6 different ways to transcribe meetings and get summaries: Notion with AI, HiNotes with HiDock as hardware, Plaud with different hardware, Teams agents. Every tool did a part of the job, but not one of them delivered on all my requirements. ScreenApp goes far beyond my expectations. It has the video ready if I need to re-watch a meeting.
AK
Andreas Kroll
Chrome Web Store, May 29, 2026
Our overall experience with ScreenApp has been nothing but pleasant! Their support is terrific, and ScreenApp is a great recording system.
Aaron
Aaron, Project Manager
Nice app for important summaries.
S
Sahil
Usuario de ScreenApp
Usuario de ScreenApp
Usuario de ScreenApp
8,291,249 cuentas registradas

¿Listo para aumentar tu productividad?

Inicia Traductor de voz con una cuenta gratuita. Se aplican límites de uso; las descargas de apps requieren un plan de pago.

Empezar Gratis →

Empezar a usar en 60 segundos • Regístrate sin tarjeta de crédito