Transcribe una grabación con varios oradores, y obtén cada uno etiquetado
Sube una grabación con varias personas hablando, o pega un enlace, y ScreenApp la convierte en una transcripción con cada orador etiquetado y una marca de tiempo en cada línea. Graba la conversación en vivo con el grabador del navegador o las Aplicaciones para iOS y Android, o conecta el bot de reuniones para Zoom, Google Meet y Microsoft Teams para una llamada, luego sube el archivo cuando lo tengas.
Una transcripción etiquetada reemplaza la necesidad de volver a escuchar una grabación para saber quién dijo qué.
Lo que obtienes:
- Una transcripción con identificación de oradores, en 100+ idiomas
- Chat de IA con cualquier grabación, para que puedas preguntar qué dijo un orador específico en lugar de escanear toda la transcripción
- Notas de IA: elementos de acción con un propietario y fecha límite, y decisiones listadas por separado
- Exportar como PDF, DOCX, TXT, SRT y VTT
- Plan gratuito: 2 transcripciones de grabaciones de hasta 45 minutos cada una, con chat de IA incluido
Cómo transcribir a varios oradores
- Sube o pega un enlace: Arrastra el archivo de audio o video (MP4, M4V, MOV, AVI, WEBM, MKV, FLV, TS, MTS, M2TS, 3GP, 3GPP, 3G2, WMV, ASF, VOB, OGV, RM, RMVB, MPG, MPEG, M2V, F4V, MXF), o pega un enlace. No se necesita configurar una cuenta para empezar.
- Deja que transcriba: El audio se convierte a texto y cada persona se divide en su propia etiqueta de orador, con una marca de tiempo en cada oración.
- Revisa y exporta: Lee la transcripción en el navegador, cambia el nombre de una etiqueta de orador si es necesario y exporta como PDF, DOCX, TXT, SRT y VTT.
La precisión depende del audio y del idioma hablado. 25 de los 100+ idiomas compatibles realizan la diarización de oradores a nivel de palabra; el resto transcriben a texto sin etiquetas por orador. Un solo micrófono con los participantes cerca y una diafonía limitada también proporciona la división más clara entre los oradores. Consulta cómo medimos la precisión.
Transcripción de múltiples oradores vs. otras aplicaciones
| Característica | ScreenApp | Otter.ai | Rev | Sonix |
|---|---|---|---|---|
| Plan gratuito | 2 transcripciones, hasta 45 min cada una | 300 min/mes | 45 min/mes (IA) | Prueba de 30 min |
| Identificación de orador | Incluido | Básico | Incluido | Incluido |
| Renombrar orador | haga clic en la etiqueta de un orador para cambiarle el nombre, asociarlo con un miembro del equipo o reasignar un solo segmento | No especificado | No especificado | No especificado |
| Notas de IA | Incluido | Pro, $8.33/mes facturado anualmente, o $16.99 mensualmente | No especificado | No especificado |
| Formatos de exportación | PDF, DOCX, TXT, SRT y VTT | mp3 y txt en el plan gratuito, además de pdf, docx y srt desde Pro, con exportación masiva desde Business | No especificado | DOCX, PDF, TXT, SRT, VTT |
| Idiomas | 100+ | 6 | No especificado | 54+ |
| Plan de pago | $19/mes anual | $8.33/mes anual | $25.49/mes anual | $25/mes |
Sources, checked 2026-10-01: screenapp.io/accuracy#languages, ScreenApp pricing, screenapp.io/help/how-many-minutes-can-i-record, otter.ai/pricing, rev.com/pricing, sonix.ai/pricing, Editing speaker labels
- vs Otter.ai: El plan gratuito de Otter te limita a 300 minutos al mes, y su nivel de identificación de orador en el plan gratuito es Básico. ScreenApp incluye etiquetas de orador en todos los planes y te permite cambiar el nombre de una etiqueta después.
- vs Rev: El nivel gratuito de Rev ofrece 45 minutos de IA al mes, luego cobra $25.49/mes (facturado anualmente) por minuto para una transcripción de IA o $1.99 por minuto para una humana. Una serie recurrente de grabaciones de múltiples oradores se acumula rápidamente a cualquiera de las tarifas.
- vs Sonix: Sonix ofrece una prueba única de 30 minutos, luego un plan de $25 al mes. El plan gratuito de ScreenApp se renueva en lugar de ser una prueba única.
Quién usa la transcripción de múltiples oradores
Los periodistas transcriben entrevistas y paneles de discusión con varias fuentes, luego citan a cada orador directamente con una marca de tiempo para verificar los hechos.
Los productores de podcasts transcriben episodios con un presentador y varios invitados, dividiendo la conversación por orador para extraer notas y clips del programa.
Los investigadores transcriben entrevistas grupales y grupos focales, luego leen la transcripción por orador para ver cómo respondió cada participante.
Los equipos de reclutamiento y RRHH transcriben entrevistas de panel con varios entrevistadores y un candidato, para que cualquiera que revise el archivo más tarde pueda ver quién preguntó qué.
Los equipos legales y de cumplimiento transcriben declaraciones, llamadas multipartitas y declaraciones grabadas donde es importante saber qué persona dijo qué línea.
Los equipos de documentales y videos transcriben material de entrevistas con más de un sujeto, utilizando las etiquetas de orador para registrar quién está en cámara en cada momento.


