Modo de voz de Claude Code: Cómo el desarrollo con prioridad de voz está cambiando la programación en 2026
On this page
Claude Code lanzó hoy el modo de voz nativo. El 3 de marzo de 2026 marca el día en que la CLI oficial de Anthropic adoptó la voz como prioridad, uniéndose a Codex (que lanzó la voz el 26 de febrero) en la carrera por hacer la codificación manos libres.
Thariq Shihipar, ingeniero de Anthropic, anunció el lanzamiento en Twitter/X esta mañana. El tuit obtuvo 707.000 vistas, 7.000 me gusta y 1.000 repeticiones en horas. Los desarrolladores están entusiasmados. La codificación por voz no es una tendencia futura. Está ocurriendo ahora.
La función se está implementando gradualmente. Aproximadamente el 5% de los usuarios tiene acceso hoy. El resto lo obtendrá en las próximas semanas. Si tienes acceso, verás una nota en la pantalla de bienvenida de Claude Code. Escribe /voice para activarla.
Esto ya no se trata solo de accesibilidad. Se trata de velocidad, claridad y de repensar cómo se construye el software.
No esperes el lanzamiento de voz - Usa el dictado de ScreenApp ahora
El modo de voz de Claude Code se está implementando para solo el 5% de los usuarios. El software de dictado de ScreenApp funciona en todo el sistema hoy mismo - en Claude Code, VS Code, Slack, Google Docs y todas las aplicaciones de tu máquina:
- ✅ Transcripción impulsada por IA entrenada en vocabulario técnico
- ✅ Funciona en Mac, Windows y Linux
- ✅ Pulsa una tecla de acceso rápido, habla, y escribe por ti - en todas partes
- ✅ Nivel gratuito disponible
Puntos clave
- Claude Code lanzó el modo de voz nativo el 3 de marzo de 2026 a través del comando de barra
/voice - Anunciado por el ingeniero de Anthropic Thariq Shihipar en Twitter/X (707K vistas en horas)
- Lanzamiento para el 5% de los usuarios hoy, aumentando en las próximas semanas
- Codex lanzó la entrada de voz el 26 de febrero de 2026 (mantener pulsada la barra espaciadora para hablar)
- Ambos asistentes de codificación de IA importantes priorizaron la voz en la misma semana
- ScreenApp ofrece software de dictado para todo el sistema que funciona en TODAS las aplicaciones (terminales de codificación, reuniones, notas, correos electrónicos, documentos)
- Herramientas externas como Wispr Flow, dictado de macOS y Agent Bar también funcionan para usuarios sin acceso nativo
Modo de Voz Nativo de Claude Code
A partir del 3 de marzo de 2026, Claude Code admite la entrada de voz de forma nativa. Sin herramientas externas. Sin soluciones alternativas. Simplemente escribe /voice en la CLI y empieza a hablar.
Cómo funciona:
- Abre Claude Code
- Escribe
/voicepara activar el modo de voz - Di tu comando
- Claude Code transcribe y ejecuta
El lanzamiento es gradual. Anthropic está implementando para el 5% de los usuarios hoy y aumentará en las próximas semanas. Si tienes acceso, la pantalla de bienvenida mostrará una nota sobre la nueva función.
Thariq Shihipar, ingeniero de Anthropic, anunció el lanzamiento en Twitter/X:
“Claude Code ahora tiene modo de voz nativo. Escribe
/voicepara activarlo. Se está implementando para aproximadamente el 5% de los usuarios hoy, aumentando en las próximas semanas.”
El tuit explotó. 707.000 vistas. 7.000 me gusta. 1.000 repeticiones. La comunidad de desarrolladores ha estado pidiendo esto desde que Codex lanzó la voz el 26 de febrero.
Fuente: https://x.com/trq212/status/2028628570692890800
Por qué esta semana cambió la codificación
Dos importantes asistentes de codificación de IA lanzaron la voz en la misma semana:
26 de febrero de 2026: Codex 0.105.0 lanzó la entrada de voz nativa. Mantén pulsada la barra espaciadora, habla y suelta. El motor Wispr Flow convierte la voz a texto al instante. Compatible con macOS y Windows (Linux llegará más tarde).
3 de marzo de 2026: Claude Code lanzó el modo de voz nativo. Escribe /voice para activarlo. Implementación gradual para todos los usuarios.
Esto no es una coincidencia. Esto es una tendencia. El desarrollo priorizando la voz se está convirtiendo en el predeterminado, no en la excepción.
La incidencia #29399 de GitHub solicitaba entrada de voz para Claude Code y tenía cientos de votos a favor. Anthropic escuchó la demanda y lanzó rápidamente. Una semana después de que Codex demostrara que funcionaba, Claude Code le siguió.
¿Qué significa esto para los desarrolladores?
- La voz es un método de entrada de primera clase (no una característica experimental)
- Las herramientas de codificación con IA compiten en calidad de voz (velocidad, precisión, soporte de idiomas)
- La escritura y la voz coexistirán (los desarrolladores cambiarán según la tarea)
La codificación por voz ya no es “solo para accesibilidad”. Es para productividad, velocidad y reducción de la tensión.
Cómo funciona el modo de voz
Si tienes acceso a la función, aquí te explicamos cómo usarla:
1. Habilitar el modo de voz
Abre Claude Code en tu terminal y escribe:
/voice
Esto activa el modo de voz. La CLI confirmará la activación.
2. Di tu comando
Una vez habilitado, di tu comando con claridad. Claude Code escucha, transcribe tu voz y procesa la solicitud.
Comandos de ejemplo:
- “Refactoriza esta función para usar async/await”
- “Añade manejo de errores a esta llamada a la API”
- “Escribe un componente de React que muestre una lista de usuarios”
3. Desactivar cuando sea necesario
Vuelve a escribir /voice para desactivar el modo de voz y volver a escribir.
¿Qué hay de la precisión?
Anthropic no ha revelado qué modelo de voz a texto impulsa la función. Los primeros usuarios informan de una alta precisión para términos técnicos (como “async/await”, “React hook”, “SQL join”).
Codex utiliza el motor Wispr Flow. Claude Code puede usar un enfoque similar o el modelo propio de Anthropic. Surgirán más detalles a medida que se expanda el despliegue.
Voz de código de Codex vs Claude
Ambas herramientas admiten voz, pero la implementación difiere:
| Característica | Codex (26 de feb. de 2026) | Claude Code (3 de mar. de 2026) |
|---|---|---|
| Activación | Mantener la barra espaciadora | Escribir comando /voice |
| Motor | Wispr Flow | Desconocido (probablemente propietario) |
| Plataformas | macOS, Windows | Todas las plataformas (basado en CLI) |
| Lanzamiento | Inmediato (todos los usuarios) | Gradual (5% hoy) |
| Alternar | Mantener/soltar barra espaciadora | /voice activar/desactivar |
Codex hace que la voz se sienta instantánea. Mantén la barra espaciadora, habla, suelta. La transcripción aparece a medida que hablas.
Claude Code usa un comando de barra. Escribe /voice para habilitar, luego habla. Este enfoque funciona en todas las plataformas (Linux incluido) porque está basado en CLI.
Ambos enfoques funcionan. Los desarrolladores elegirán según sus preferencias:
- ¿Prefieres disparadores físicos (barra espaciadora)? Usa Codex.
- ¿Prefieres alternar comandos (
/voice)? Usa Claude Code.
¿Aún sin acceso? Usa estas opciones
El modo de voz de Claude Code se está implementando gradualmente. Si aún no ves la función, tienes opciones. Algunas funcionan solo en la terminal. Otras funcionan en todas partes.
1. Dictado ScreenApp (Mac, Windows, Linux)
Si deseas una entrada de voz que funcione en todo tu flujo de trabajo, no solo en Claude Code, el software de dictado de ScreenApp es la opción más versátil.
ScreenApp se ejecuta en todo el sistema. Presiona una tecla de acceso rápido, habla, y escribe por ti. Funciona en Claude Code, Codex, VS Code, Slack, Google Docs, correo electrónico y cualquier otra aplicación en tu máquina.
Para usarlo con Claude Code:
- Instala el dictado de ScreenApp
- Abre Claude Code en tu terminal
- Presiona la tecla de acceso rápido de ScreenApp
- Di tu comando
- ScreenApp lo transcribe y lo escribe por ti
Ventajas clave:
- Transcripción con IA entrenada en vocabulario técnico
- Funciona en todas las aplicaciones, no solo en terminales de codificación
- Multiplataforma (Mac, Windows, Linux)
- Nivel gratuito disponible
- También maneja la transcripción de reuniones, el dictado de audio y la toma de notas
La mayoría de las herramientas de voz te encierran en un solo entorno. ScreenApp te ofrece voz en todas partes. Codifica en Claude Code, escribe documentos en Notion, envía mensajes a tu equipo en Slack, todo por voz. Una herramienta, todas las aplicaciones.
2. Wispr Flow (macOS + Windows)
Wispr Flow es otra aplicación de voz a texto con IA que funciona en varias aplicaciones. Se ejecuta en segundo plano y convierte la voz en texto dondequiera que esté tu cursor.
Wispr Flow utiliza modelos de IA entrenados en vocabulario técnico. Entiende bien “async/await”, “React hook” y “SQL join”.
El nivel gratuito admite transcripción diaria limitada. Los planes de pago desbloquean el uso ilimitado. Actualmente solo para macOS y Windows.
3. Dictado integrado de macOS (gratuito)
macOS tiene dictado nativo accesible a través de la tecla Fn (presionar dos veces) o atajo de teclado. Funciona en todo el sistema, incluidas las aplicaciones de terminal.
El dictado integrado es gratuito pero menos preciso para términos técnicos. Tiene dificultades con la sintaxis de código y la jerga de desarrolladores. Bueno para un inicio rápido sin configuración.
4. Agent Bar (App para la barra de menú de macOS)
Agent Bar es una aplicación de macOS destacada en Product Hunt que envuelve Claude Code en una interfaz de barra de menú con dictado por voz incorporado. Empaqueta Claude Code con entrada de voz en una interfaz de usuario pulida. La aplicación cuesta $15/mes después de una prueba gratuita.
5. Whisper (Código Abierto, Local)
Whisper de OpenAI se ejecuta localmente en tu máquina y proporciona transcripción de alta precisión de forma gratuita. Admite más de 50 idiomas y maneja bien el vocabulario técnico. Más lento que el dictado en tiempo real, pero muy preciso y completamente privado.
6. Puente de API Gemini Live (Código Abierto)
Un proyecto de código abierto en Reddit r/ClaudeAI utiliza la API Gemini Live de Google como una capa intermedia de voz a texto y texto a voz para Claude Code. Tú hablas, Claude Code responde y tú escuchas la respuesta. Totalmente manos libres. Experimental, pero impresionante.
Por qué la codificación por voz está creciendo
La codificación por voz no se trata solo de accesibilidad. Se trata de velocidad, claridad y pensar de manera diferente.
1. Más rápido que escribir (para algunas tareas)
Escribir “refactor this function to use async/await and handle errors with try/catch” lleva tiempo. Hablarlo lleva 3 segundos. Para comandos y descripciones de alto nivel, la voz gana.
La voz es más lenta para la sintaxis precisa (“import React comma useState from React”). Pero la mayoría de las herramientas de codificación con IA manejan la sintaxis automáticamente. Tú describes lo que quieres, y la IA escribe el código.
2. Reduce la Tensión Repetitiva
Los desarrolladores que codifican más de 8 horas al día corren el riesgo de sufrir lesiones por esfuerzo repetitivo (RSI). La voz reduce el tiempo de teclado y da un descanso a tus manos.
Algunos desarrolladores alternan entre escribir y usar la voz a lo largo del día. Este enfoque híbrido reduce la fatiga sin sacrificar la velocidad.
3. Cambia Tu Forma de Pensar en el Código
La voz te obliga a describir lo que quieres en lenguaje sencillo. Esta claridad ayuda a la IA a comprender mejor tu intención.
En lugar de pensar en sintaxis (“const result = await fetch…”), piensas en resultados (“obtener datos de la API y almacenarlos en el estado”). La IA se encarga de los detalles de implementación.
Este cambio mejora la calidad de la codificación asistida por IA. Instrucciones más claras producen un mejor código.
4. Accesibilidad para Desarrolladores con Discapacidades
El desarrollo voz-primero abre la codificación a personas con discapacidades de movilidad, visuales o dolor crónico. Si escribir es difícil, la voz es un cambio radical.
El artículo de la Comunidad DEV “Scared of Coding? You Can Build Apps Just by Talking” destaca esta tendencia. Los principiantes sin velocidad de escritura pueden codificar describiendo lo que quieren.
Voz Más Allá de la Terminal
Claude Code y Codex demuestran que la voz funciona para codificar. Pero los desarrolladores no pasan todo el día en la terminal. Escriben documentos, redactan correos electrónicos, envían mensajes a sus compañeros y toman notas de reuniones.
El verdadero desbloqueo de la productividad es la voz en todas partes, no solo la voz en una herramienta. El software de dictado de ScreenApp cierra esta brecha. El mismo flujo de trabajo voz-primero que usas en Claude Code se extiende a cada aplicación en tu máquina:
- Dicta descripciones de pull requests en GitHub
- Escribe mensajes de Slack a tu equipo con la voz
- Toma notas de reuniones durante las llamadas de Zoom con la aplicación de dictado de ScreenApp
- Escribe documentación en Notion o Google Docs
- Transcribe audio grabado con la función de dictáfono
Los desarrolladores que adoptan la codificación por voz en la terminal y luego vuelven a escribir todo lo demás están dejando la velocidad sobre la mesa. La voz-primero no es solo para codificar. Es para todo.
Comparativa de Herramientas de Codificación por Voz
| Característica | Voz de Claude Code | Voz de Codex | Dictado de ScreenApp |
|---|---|---|---|
| Precio | Incluido con Claude Code | Incluido con Codex | Nivel gratuito disponible |
| Disponibilidad | Lanzamiento del 5% (Marzo 2026) | Todos los usuarios (Febrero 2026) | Disponible ahora |
| Funciona en | Solo terminal de Claude Code | Solo terminal de Codex | Todas las aplicaciones del sistema |
| Plataformas | Todas (basado en CLI) | macOS, Windows | Mac, Windows, Linux |
| Notas de Reunión | ❌ | ❌ | ✅ Transcripción de reuniones |
| Dictado de Documentos | ❌ | ❌ | ✅ Funciona en Docs, correo, Slack |
Los modos de voz de Claude Code y Codex son solo para terminal. El dictado de ScreenApp funciona en todas partes: codifica en tu terminal, luego escribe correos electrónicos, mensajes de Slack y documentación con la voz sin cambiar de herramienta. También prueba la aplicación de dictado para móvil.
Las limitaciones de la codificación por voz
La voz es poderosa, pero no es perfecta. Esto es lo que no funciona bien (todavía).
1. La sintaxis precisa es lenta
Decir “const user equals curly brace name colon John comma age colon 30 curly brace” es doloroso. Escribirlo es más rápido.
La voz funciona mejor para descripciones de alto nivel (“crear un objeto de usuario con propiedades de nombre y edad”). La IA escribe la sintaxis.
2. Entornos ruidosos
La entrada de voz falla en espacios ruidosos. Las cafeterías, las oficinas abiertas y los hogares ruidosos hacen que la transcripción sea poco fiable.
Los auriculares con micrófonos con cancelación de ruido ayudan. Pero los entornos tranquilos funcionan mejor.
3. Preocupaciones por la privacidad
Pronunciar comandos en voz alta revela en qué estás trabajando. Si estás codificando funciones sensibles, escribir mantiene la privacidad.
Algunos desarrolladores usan la voz solo para trabajos no confidenciales. Otros trabajan en espacios privados donde hablar es seguro.
4. Curva de aprendizaje
La codificación por voz requiere nuevos hábitos. Necesitas aprender a enunciar los comandos claramente. Necesitas confiar en la IA para que maneje los detalles.
Los desarrolladores experimentados pueden encontrar esto frustrante. Los principiantes a menudo se adaptan más rápido porque están aprendiendo todo desde cero.
Primeros Pasos
Si quieres probar el desarrollo de voz primero con Claude Code, aquí te explicamos cómo:
1. Comprueba si tienes acceso
Abre Claude Code y busca la nota en la pantalla de bienvenida. Si la ves, escribe /voice para activarlo.
Si aún no tienes acceso, espera el lanzamiento o usa herramientas externas (Wispr Flow, dictado de macOS, Whisper).
2. Empieza con comandos de alto nivel
Prueba estos:
- “Refactoriza esta función para usar TypeScript”
- “Añade manejo de errores a esta llamada a la API”
- “Escribe un componente React que muestre una lista de usuarios”
Evita dictar la sintaxis exacta. Deja que la IA maneje los detalles.
3. Crea el hábito
- Usa la voz para el 10-20% de tu tiempo de codificación al principio
- Aumenta gradualmente a medida que te sientas cómodo
- Alterna entre escribir y la voz para reducir la tensión
4. Extiende la voz más allá de la codificación
Si la voz funciona para codificar, pruébala para:
- Escribir documentación
- Redactar mensajes de commit
- Redactar correos electrónicos
- Tomar notas de reuniones
El software de dictado de ScreenApp facilita esto.
Qué Viene Después
La tendencia es clara. La voz se está convirtiendo en un método de entrada estándar para las herramientas de codificación.
Qué esperar en 2026 y más allá:
- Más asistentes de codificación incluirán entrada de voz nativa (siguiendo el liderazgo de Codex y Claude Code)
- Los modelos de IA mejorarán en la comprensión de la intención del desarrollador (mejor transcripción de términos técnicos)
- La voz se expandirá más allá del dictado a la codificación conversacional (tendrás un diálogo de ida y vuelta con la IA sobre tu código)
- La voz y la escritura coexistirán (los desarrolladores usarán ambos sin problemas, cambiando según la tarea)
Codex y Claude Code demostraron que la voz funciona. Otras herramientas seguirán. GitHub Copilot, Cursor, Replit y Windsurf probablemente están observando.
La carrera está en marcha. El desarrollo “voice-first” no es una artimaña. Es el futuro. Y el futuro llegó esta semana.
Preguntas frecuentes
¿Claude Code tiene entrada de voz nativa?
Sí. Claude Code lanzó el modo de voz nativo el 3 de marzo de 2026. Escribe /voice en la CLI para activarlo. La función se está implementando gradualmente (5% de los usuarios hoy, aumentando en las próximas semanas). Anunciado por el ingeniero de Anthropic, Thariq Shihipar, en Twitter/X.
¿Cómo habilito el modo de voz en Claude Code?
Escribe /voice en la terminal de Claude Code. Esto activa el modo de voz. Pronuncia tu comando y Claude Code lo transcribe y ejecuta. Vuelve a escribir /voice para desactivarlo.
¿Cuándo implementó Codex la entrada de voz?
Codex 0.105.0 incluyó la entrada de voz nativa el 26 de febrero de 2026. Mantén presionada la barra espaciadora, di tu comando y suelta. Codex utiliza el motor Wispr Flow para transcribir el habla en tiempo real. Compatible con macOS y Windows. El soporte para Linux aún no está disponible.
¿Cuál es la diferencia entre la entrada de voz de Codex y Claude Code?
Codex utiliza un disparador físico (mantener presionada la barra espaciadora). Claude Code utiliza un comando de barra (/voice). Codex utiliza el motor Wispr Flow. Se desconoce el motor de Claude Code. Ambos admiten vocabulario técnico y transcripción en tiempo real.
¿Qué pasa si aún no tengo acceso al modo de voz de Claude Code?
Usa herramientas externas: Wispr Flow (macOS/Windows), dictado integrado de macOS (gratis), Whisper (código abierto), Agent Bar (aplicación de barra de menú), o un puente de API de Gemini Live. Estas herramientas añaden soporte de voz a Claude Code sin esperar el lanzamiento oficial.
¿Es Wispr Flow gratuito?
Wispr Flow ofrece un nivel gratuito con transcripción diaria limitada. Los planes de pago comienzan en $10/mes para uso ilimitado. Funciona en todo el sistema en macOS y Windows.
¿Puedo usar el dictado de macOS con Claude Code?
Sí. Pulsa Fn dos veces (o tu atajo personalizado) para activar el dictado de macOS. Di tu comando, y macOS lo escribirá en Claude Code. El dictado integrado es gratuito, pero menos preciso para términos técnicos que Wispr Flow o Whisper.
¿Funciona ScreenApp con terminales de codificación?
Sí. El software de dictado de ScreenApp funciona en todo el sistema, incluidas las aplicaciones de terminal. Pulsa la tecla de acceso rápido, habla, y ScreenApp escribirá por ti. Funciona en Claude Code, Codex, VS Code y cualquier otra aplicación en tu máquina Mac, Windows o Linux.
¿Es la codificación por voz más rápida que la escritura?
Para comandos y descripciones de alto nivel, sí. Decir “refactoriza esta función para usar async/await” es más rápido que escribirlo. Para sintaxis precisa, la escritura es más rápida. La mayoría de los desarrolladores usan un enfoque híbrido, alternando entre voz y escritura según la tarea.
¿Qué anunció Thariq Shihipar sobre el modo de voz de Claude Code?
Thariq Shihipar, un ingeniero en Anthropic, anunció el modo de voz nativo de Claude Code en Twitter/X el 3 de marzo de 2026. El tuit obtuvo 707.000 vistas, 7.000 me gusta y 1.000 retuits en horas. La función se está implementando para el 5% de los usuarios hoy, aumentando progresivamente en las próximas semanas.