O Que o Tradutor de Voz Faz
Este tradutor de voz converte fala entre 99 idiomas; a qualidade da tradução acompanha a taxa de erro de palavra do idioma de origem. Carregue gravações ou fale ao vivo no navegador. Sem download, sem conta, sem limites de minutos.
Solte um arquivo de áudio, obtenha texto traduzido. Carregue MP3, WAV, M4A, MP4, OGG ou FLAC. O modelo transcreve o idioma de origem, executa a tradução para o idioma de destino escolhido e exporta o resultado como texto simples, SRT ou VTT para legendagem. Arquivos de até 3 horas funcionam em uma única passagem.
A tradução ao vivo é executada na mesma guia do navegador. Clique no microfone, fale e o texto traduzido aparece em menos de 1,5 segundos. Útil para chamadas de suporte internacionais, reuniões com fornecedores e entrevistas bilíngues onde esperar o término de uma gravação não é uma opção (referência de latência de abril de 2026).
Principais recursos:
- Tradução de voz para o inglês a partir de qualquer idioma de origem com detecção automática
- Tradução de voz ao vivo com atraso de menos de 1,5 segundo
- Carregar arquivos de áudio de até 3 horas (MP3, WAV, M4A, MP4, OGG, FLAC)
- Tradutor de voz ao vivo gratuito para reuniões, chamadas e apresentações
- Lida com sotaques, dialetos e ruído de fundo; WER por idioma na página de precisão
- Saída de voz para que as traduções sejam reproduzidas como áudio falado
- Baseado em navegador, sem instalação
- Transcrições com carimbo de data/hora para documentação e pesquisa
A ferramenta é construída para reuniões gravadas, podcasts, entrevistas, chamadas de suporte ao cliente e conteúdo de vídeo. Use o modo ao vivo para conversas em tempo real ou carregue arquivos para trabalho em lote com transcrições pesquisáveis.
Matriz de qualidade do par de idiomas
A qualidade da tradução acompanha a qualidade da transcrição. Pares com baixa Taxa de Erro de Palavra (WER) no idioma de origem produzem traduções mais limpas porque há menos entrada confusa para a passagem de tradução interpretar. Os números abaixo são do reteste de WER de abril de 2026.
| Par de idiomas | WER Médio (transcrição) | Qualidade da tradução | Notas |
|---|---|---|---|
| en, es | 4-5% | Excelente | Par de maior volume, mais treinado |
| en, pt | 5-6% | Excelente | Variantes brasileira e europeia suportadas |
| en, fr | 5-6% | Excelente | Francês do Quebec incluído |
| en, de | 6-7% | Bom | Palavras compostas tratadas corretamente |
| en, ja | 7-8% | Bom | Pontuação reconstruída |
| en, zh | 7-8% | Bom | Simplificado e Tradicional |
| en, ko | 7-8% | Bom | Níveis honoríficos preservados |
| es, pt | 5-6% | Excelente | Alta inteligibilidade mútua |
| en, ar | 9-10% | Aceitável | Apenas MSA, cobertura de dialeto limitada |
| en, hi | 9-10% | Aceitável | Troca de código com inglês tratada |
Para pares não listados, consulte o WER do idioma de origem na tabela de precisão por idioma e adicione aproximadamente um nível de qualidade entre a faixa de WER e a tradução final. Pares na faixa de WER de 10%+ ainda produzem traduções úteis para a compreensão geral, apenas espere mais polimento de nomes próprios e expressões idiomáticas.
Como Usar o Tradutor de Voz
A ferramenta funciona em três etapas, seja você carregando uma gravação ou falando ao vivo.
- Carregue arquivos de áudio (MP3, WAV, M4A, MP4, OGG, FLAC) ou clique no microfone para falar ao vivo
- A IA detecta o idioma de origem entre mais de 100 opções automaticamente
- A fala é convertida para o seu idioma de destino com carimbos de data/hora
- Copie o texto ou baixe a transcrição traduzida
Os idiomas suportados incluem espanhol, francês, alemão, chinês, japonês, coreano, árabe, hindi, português, russo, italiano e holandês, além de mais de 90 outros.
O modo de tradutor de voz ao vivo processa conversas instantaneamente com latência inferior a 1,5 segundo. Ele é construído para reuniões de negócios, chamadas de clientes, entrevistas e apresentações internacionais. Clique para falar e traduzir durante uma chamada sem trocar de guia.
A entrada de microfone captura sua fala diretamente no navegador. Clique no botão do microfone, conceda permissão e fale. A IA detecta o idioma, traduz o conteúdo e mostra o resultado. Funciona em navegadores de desktop e mobile.
Tradutor de Voz vs Outras Ferramentas
| Recurso | ScreenApp | Maestra | Sonix | Notta | Speechmatics | Veed.io |
|---|---|---|---|---|---|---|
| Nível gratuito | Uma gravação, até 45 min | Teste de 30 min | Teste de 30 min | 120 min/mês | 8 horas/mês |
Sources, checked 2026-09-23: screenapp.io/help/how-many-minutes-can-i-record
- vs Maestra: Maestra clona a voz de um falante para reprodução dublada no idioma de destino, o que é útil para localização de vídeo. Limita o teste gratuito a 30 minutos. O ScreenApp usa vozes TTS genéricas em vez de clonagem, mas o uso gratuito não tem limite de minutos e exporta SRT/VTT diretamente.
- vs Veed.io: Veed.io adiciona clonagem de voz por IA e estilização de legendas na tela para editores de vídeo, com um nível gratuito mensal de 30 minutos. O ScreenApp foca no caminho de tradução de áudio para texto e dispensa a edição de vídeo, mas lida com arquivos mais longos (3 horas vs 2 GB) sem custo.
Tradução com Saída de Voz
O tradutor de voz retorna transcrições de texto e áudio falado no idioma de destino. Após converter a fala em texto, ele reproduz áudio com som natural usando texto-para-voz.
Recursos de saída de voz:
- Pronúncia natural em mais de 100 vozes de idiomas, incluindo sotaques regionais
- Taxa de fala ajustável para desacelerar ou acelerar o áudio traduzido
- Seleção de gênero para opções de voz masculina ou feminina na maioria dos idiomas
- Reprodução instantânea durante conversas ao vivo
- Arquivos de áudio para download da fala traduzida
Use a saída de voz para aprendizado de idiomas, acessibilidade ou qualquer configuração onde a leitura de texto não seja prática, como chamadas telefônicas, dirigir ou reuniões com as mãos livres. A tradução falada também ajuda com a pronúncia e entonação.
Para Quem é o Tradutor de Voz
Equipes de localização que distribuem conteúdo multilíngue enviam narrações em idioma de origem, anúncios e tutoriais de produtos através do tradutor para produzir arquivos SRT para cada mercado de lançamento. A cobertura de mais de 100 idiomas reduz o número de fornecedores necessários para um único lançamento.
Jornalistas cobrindo entrevistas em língua estrangeira carregam gravações de campo no mesmo dia em que são capturadas. A transcrição e a tradução retornam com carimbos de data/hora, para que um repórter possa citar uma citação em 00:14:32 sem pagar por um mediador separado.
Professores de idiomas preparando materiais bilíngues inserem um podcast ou clipe de notícias na ferramenta e extraem tanto a transcrição original quanto a tradução para o inglês. Os alunos comparam os dois lado a lado, e a exportação SRT se conecta a reprodutores de vídeo em sala de aula.
Equipes de suporte que lidam com tickets de áudio não em inglês traduzem mensagens de voz e gravações do Zoom de clientes que não falam o idioma da equipe. O agente lê a transcrição traduzida em seu sistema de suporte e responde por escrito sem encaminhar o ticket para uma fila bilíngue.
O Que Se Perde na Tradução de Voz
A tradução de voz automática é boa em significado e mais fraca nas coisas ao redor do significado. Expressões idiomáticas, sarcasmo e jogos de palavras perdem a graça, uma piada que depende de um trocadilho no idioma de origem retorna como uma frase literal e sem graça. Esse é um limite da própria tradução, não especificamente desta ferramenta, e vale a pena saber antes de você confiar na saída para algo mais sutil.
Nomes e termos técnicos são o outro ponto fraco. Um sobrenome que o modelo lê como uma palavra comum é traduzido em vez de mantido, e um termo de nicho pode retornar como seu equivalente diário mais próximo. Para uma conversa casual, nada disso importa. Para uma gravação legal ou médica, trate a tradução automática como uma primeira passagem rápida e peça a um humano para verificar as partes que carregam peso real.