¿Puede ChatGPT crear videos? ¿Qué funciona ahora que Sora ya no está?
On this page
La mayoría de los artículos que responden a esta pregunta describen un producto que ya no existe.
ChatGPT no puede renderizar un video terminado para ti. En realidad, nunca pudo hacerlo por sí solo: lo que hacía eso era Sora, y OpenAI cerró la aplicación y el sitio web de Sora el 26 de abril de 2026. La API detrás de esto se desactivará el 24 de septiembre. Si todavía tienes generaciones allí, esa segunda fecha es una fecha límite, no una trivialidad.
Así que la respuesta honesta es que ChatGPT no es un generador de videos y, a partir de este año, OpenAI no vende uno a los consumidores en absoluto.
En lo que es muy bueno es en todo lo que rodea la renderización: el concepto, el guion, la lista de tomas, las indicaciones que alimentas a un generador real, el texto de la voz en off, los subtítulos y el plan de edición. Eso es la mayor parte del trabajo. Simplemente no es la parte que produce un MP4.
Respuesta Rápida
ChatGPT escribe el guion, el guion gráfico, las indicaciones, los subtítulos y la voz en off, y puede generar imágenes fijas. No renderiza video. Dado que Sora cerró en abril de 2026, producir el clip real significa usar un generador separado, y ChatGPT es lo que hace que esos clips valgan la pena generar.
- Puede: guionizar, crear guiones gráficos, generar indicaciones, subtítulos y hacer imágenes fijas
- No puede: renderizar un clip, editar una línea de tiempo o exportar un archivo de video
- Sora: aplicación inactiva desde el 26 de abril de 2026, la API finaliza el 24 de septiembre
- Ruta real más barata: reutilizar material que ya tienes
La Respuesta Breve
No, no en el sentido que quieres decir.
Escribe “hazme un video sobre X” en ChatGPT y obtendrás un guion, o una descripción de un video, o un conjunto de ideas de escenas. No obtendrás un archivo que puedas subir a ningún sitio. No hay botón de renderizado, ni línea de tiempo, ni exportación.
Lo que confunde a la gente es que esto solía ser casi cierto. Sora era el modelo de video de OpenAI, era genuinamente impresionante, y durante un tiempo hubo una ruta plausible desde un prompt de chat hasta un clip terminado dentro de los propios productos de OpenAI. Esa ruta se cerró en abril.
Qué Pasó con Sora
OpenAI anunció el cierre el 24 de marzo de 2026 y cerró las experiencias web y de aplicación el 26 de abril. La API le seguirá el 24 de septiembre de 2026.
La razón fue el dinero, y las cifras son inusualmente contundentes para un análisis post-mortem de un producto. Sora costaba aproximadamente un millón de dólares al día y había generado alrededor de 2.1 millones de dólares en ingresos totales a lo largo de su vida. Agrega un acuerdo de licencia colapsado con Disney, constantes dolores de cabeza por derechos de autor y deepfakes, y una compañía que está ajustando sus márgenes, y la decisión más o menos se toma sola. The Decoder tiene la línea de tiempo completa si la quieres.
Si generaste algo en Sora y no lo has exportado, la API se cierra el 24 de septiembre de 2026 y el contenido restante se eliminará después de esa fecha. Exporta desde sora.chatgpt.com/sunset mientras aún esté activo.
Dos consecuencias prácticas. Cualquier tutorial que encuentres que te guíe para generar video dentro de ChatGPT está describiendo un producto muerto, independientemente de cuán recientemente se haya publicado. Y OpenAI actualmente no tiene un generador de video para consumidores, por lo que “generador de video de ChatGPT” como producto no existe, solo flujos de trabajo que se enrutan a través del modelo de otra persona.
Lo que ChatGPT Realmente Hace
Divide el trabajo en etapas y la imagen se vuelve más clara. ChatGPT cubre la mayoría de ellas.
| Etapa | ChatGPT | Lo que obtienes |
|---|---|---|
| Concepto y enfoque | Sí | Temas, ganchos, estructura |
| Guion y narración | Sí | Diálogo, texto de voz en off |
| Guion gráfico y tomas | Sí | Tabla de escenas con tiempos |
| Prompts de generación | Sí | Prompts detallados para otra herramienta |
| Imágenes fijas | Sí | Miniaturas, fotogramas, referencias |
| Subtítulos y títulos | Sí | Texto de subtítulos, descripciones |
| Renderizar el clip | No | Necesita un generador de video |
| Edición de línea de tiempo | No | Necesita un editor |
| Exportar un archivo | No | Nada que exportar |
Seis sí, tres no. Pero las tres cosas que no puede hacer son las que producen lo que realmente querías, por eso el planteamiento honesto es “ChatGPT hace la preproducción” en lugar de “ChatGPT crea videos”.
Texto a Video, de Forma Realista
“ChatGPT texto a video” significa dos cosas diferentes y la gente que lo busca suele querer la segunda.
La primera es convertir la escritura en un plan de video. Pega una entrada de blog y pide un guion de 60 segundos, un desglose de escenas y un prompt por escena. ChatGPT es excelente en esto, y es la parte que la mayoría de la gente se salta porque parece tarea.
La segunda es convertir la escritura en un clip renderizado. Eso necesita un generador. ChatGPT pasa el relevo; no hace la renderización.
Dale las restricciones, no el tema
"Un video sobre productividad" te dará algo vago. Plataforma, duración, audiencia y un mensaje específico te darán algo utilizable. El brief está haciendo más trabajo que el modelo aquí.
Obtén el guion, luego recórtalo en un tercio
Los primeros borradores siempre son largos, y la narración se lee más lentamente de lo que parece en la página. Pide un recuento de palabras objetivo en lugar de una duración, porque el recuento de palabras es algo que realmente puede alcanzar.
Divídelo en escenas con una tabla
Marca de tiempo, narración, lo que aparece en pantalla, nota de cámara. Una tabla lo obliga a comprometerse con detalles específicos en lugar de escribir atmósfera, y se convierte en tu lista de tomas.
Convierte cada fila en un prompt de generación
Un prompt por escena, luego llévalos al generador que uses. Este es el punto de traspaso, y es donde termina la contribución de ChatGPT.
Si no te has decidido por un generador, el resumen de generadores de video con IA gratuitos cubre los límites de exportación y las marcas de agua, y hay una comparación específica para YouTube si ese es el destino.
Creando videos a partir de fotos
ChatGPT puede ver una foto y describirla, sugerir cómo podría moverse y escribir el prompt para animarla. No puede animarla.
Eso suena como una pequeña distinción y no lo es. Un prompt de imagen a video tiene que decir qué permanece fijo y qué se mueve, y aquí es donde la mayoría de los intentos fracasan: la gente describe el movimiento que quiere y no dice nada sobre preservar el sujeto, por lo que la cara se desplaza por el clip.
Un prompt que valga la pena reutilizar cubre el sujeto y lo que no debe cambiar de él, el movimiento específico que deseas, lo que hace la cámara, cómo se comporta el fondo, la iluminación, la duración y la relación de aspecto. Pídele a ChatGPT que escriba eso a partir de tu foto y hará un buen trabajo, porque puede ver la imagen y describir lo que hay en ella.
Escribiendo un prompt de video
Esto es lo más transferible de la página, porque un buen prompt funciona en cualquier generador que sobreviva el año.
La fórmula: sujeto, acción, entorno, estilo visual, tipo de plano, movimiento de cámara, iluminación, estado de ánimo, duración, relación de aspecto y qué evitar. Si te olvidas del último, gastarás créditos en regenerar.
"[Sujeto] [acción] en [entorno]. Apariencia de [estilo visual], [tipo de plano], [movimiento de cámara]. [Iluminación], el estado de ánimo es [estado de ánimo]. [Duración], [relación de aspecto]. Mantén [lo que debe permanecer consistente] sin cambios. Evita [lo que no quieres]."
"Una mujer con un abrigo gris camina por una calle mojada de la ciudad por la noche. Cinematográfico, plano medio de seguimiento moviéndose con ella, reflejos de neón en el pavimento, luz principal azul fría. El ambiente es tranquilo y un poco solitario. 8 segundos, 16:9. Mantén su abrigo y cabello consistentes en todo momento. Evita texto, logotipos y otros peatones."
"Una botella de agua negra mate gira lentamente sobre una superficie de hormigón pálido. Aspecto comercial limpio, primer plano, órbita lenta alrededor del sujeto, luz difusa suave desde la parte superior izquierda. 6 segundos, 1:1. Mantén la forma de la botella y la posición de la etiqueta fijas. Evita los reflejos que distorsionen la etiqueta y no incluyas manos en el encuadre."
"Un par de manos abre un cuaderno y comienza a escribir en un escritorio de madera. Estilo natural cálido, toma aérea, zoom lento. Luz de ventana matutina. 5 segundos, 9:16, con la acción centrada en los dos tercios superiores para que los subtítulos puedan ubicarse debajo. Evita texto legible en la página."
El detalle que la gente omite es el último en cada uno: qué evitar y dónde dejar espacio para los subtítulos. Ambos ahorran regeneraciones.
Video animado y explicativo
La misma división que todo lo demás. ChatGPT lo escribe, otra cosa lo dibuja.
Donde realmente ayuda con la animación es en la consistencia del personaje, que es lo que arruina la mayoría de las secuencias animadas generadas por IA. Pídele que escriba una descripción detallada del personaje, bloquéala y pega ese bloque idéntico en el prompt de cada escena. No un resumen, el mismo texto. En el momento en que parafraseas entre escenas, el personaje comienza a desviarse.
Para el video explicativo específicamente, el truco útil es pedir el guion y el texto en pantalla como dos columnas separadas. La narración y los subtítulos haciendo el mismo trabajo palabra por palabra es el error más común en los videos explicativos, y separarlos temprano lo evita.
¿Puede ChatGPT editar videos?
No el video. El plan para editarlo, sí, y eso resulta ser la mayor parte del trabajo.
Dale una transcripción y encontrará la repetición, te dirá dónde el intro se alarga, sugerirá cortes con marcas de tiempo, reescribirá una sección torpe de la narración y generará marcadores de capítulo. Lo que no puede hacer es tocar tu línea de tiempo. Tomas sus notas en un editor y haces los cortes tú mismo.
Esa transcripción es la dependencia. Hay un tratamiento más completo de lo que ChatGPT puede y no puede hacer con un video existente en la guía sobre si ChatGPT puede ver y analizar videos, y la mecánica de cómo subir un archivo se cubre en subir video a ChatGPT. La versión corta es que necesita texto, así que primero procesa el metraje a través de un convertidor de video a texto y trabaja a partir de eso.
Esta es también, discretamente, la forma más barata de hacer videos con IA. No generando metraje nuevo en absoluto, sino tomando algo que ya grabaste, obteniendo una transcripción y haciendo que ChatGPT corte tres clips cortos de ello. Sin créditos, sin cola de renderizado, y el metraje es real.
Lo que cuesta
“Gratis” se aplica a las etapas de planificación y ahí termina.
| Etapa | Gratis con ChatGPT | Dónde aparece el costo |
|---|---|---|
| Guion y storyboard | Sí | Límites de mensajes en el nivel gratuito |
| Prompts | Sí | Ninguno |
| Imágenes estáticas | Limitado | Límites diarios en cuentas gratuitas |
| Renderizado de clips | No | Créditos por generación en otros lugares |
| Audio de voz en off | No | Suscripción de texto a voz |
| Edición y exportación | No | Editor, o una marca de agua |
Así que “puede ChatGPT crear videos gratis” tiene una respuesta incómoda: la mitad que puede hacer es gratis, y la mitad que cuesta dinero es la mitad que hace el video. Para lo que cubre una suscripción a ChatGPT en sí, tenemos un desglose de los precios de ChatGPT.
ChatGPT vs. un generador de video
No son competidores. Tratarlos como alternativas es la razón por la que la gente termina decepcionada con ambos.
Un generador de video toma una indicación y devuelve píxeles. No tiene opinión sobre si tu gancho funciona, no tiene memoria del último video que hiciste, y no te dirá si el guion es treinta segundos demasiado largo. Dale una indicación vaga y renderizará un clip vago, bellamente.
ChatGPT es lo opuesto: fuerte en estructura, juicio y lenguaje, incapaz de producir un solo fotograma. Con gusto te dirá si tu concepto es confuso, lo cual vale más que otro render.
La combinación funciona porque la principal debilidad del generador es la calidad de la indicación, y para eso es precisamente ChatGPT. La mayoría de los videos de IA malos no son un fallo del modelo. Es alguien escribiendo once palabras en un generador y esperando.
Donde esto deja a ChatGPT realmente inigualable es en la reutilización. Apúntalo a una transcripción existente y reestructurará una grabación en un guion corto, un esquema de blog y cinco variantes de subtítulos en una sola pasada. Ningún generador hace eso, y es el uso de mayor rendimiento en un flujo de trabajo de video. Un resumidor de IA o un observador de videos de IA te lleva al material bruto más rápido, pero la reestructuración es de ChatGPT.
Dónde falla esto
Seis cosas salen mal repetidamente, y ninguna son fallos del modelo.
| Qué sucede | Por qué | Solución |
|---|---|---|
| El clip ignora la indicación | Demasiadas instrucciones a la vez | Una acción por clip, luego unir |
| El personaje cambia de cara | Descripción reformulada por escena | Pegar el bloque idéntico cada vez |
| El guion se alarga | Se pidió una duración, no palabras | Dar un recuento de palabras, aproximadamente 150 por minuto |
| La narración suena robótica | No se especificó la voz ni la audiencia | Nombrar al orador y a quién se dirige |
| Los subtítulos no coinciden con el audio | Construido a partir del borrador del guion | Subtitular la grabación final, no el guion |
| El texto en el fotograma está distorsionado | Los generadores renderizan mal el texto | Prohibir el texto en la indicación, añadirlo en la edición |
Ese último vale la pena interiorizarlo. No le pidas a un modelo de video texto en pantalla. Genera el clip limpio y pon las palabras después, donde controlas la fuente y son realmente legibles.
Qué haría yo realmente
Si ya tienes metraje, empieza por ahí. Transcríbelo, entrega la transcripción a ChatGPT y saca tres videos cortos de una sola grabación. No cuesta nada, el metraje es real y supera cualquier cosa que pudieras generar esta semana.
Si realmente necesitas metraje nuevo, usa ChatGPT para el guion y las indicaciones por escena, luego llévalos a un generador. Las indicaciones son de donde proviene la calidad, y las indicaciones son gratuitas.
Lo que no haría es esperar a que OpenAI lance un reemplazo. Sora perdió alrededor de un millón de dólares al día y ganó 2.1 millones de dólares en total durante su vida útil. Ese no es un producto que regrese rápidamente.
Preguntas frecuentes
¿Puede ChatGPT crear videos?
No. Escribe guiones, storyboards, indicaciones, subtítulos y genera imágenes fijas, pero no renderiza video ni exporta un archivo. Producir el clip significa usar un generador separado.
¿ChatGPT tiene un generador de video?
Ya no. Sora fue el producto de video de OpenAI y la aplicación y el sitio web cerraron el 26 de abril de 2026, y la API finalizará el 24 de septiembre de 2026. Actualmente no hay un generador de video para consumidores de OpenAI.
¿Puede ChatGPT hacer videos gratis?
Las partes que puede hacer son gratuitas en un plan de pago y mayormente gratuitas en el nivel gratuito, con límites en la generación de imágenes. La renderización, la locución y la edición ocurren en otro lugar y ahí es donde reside el costo.
¿Puede ChatGPT convertir texto en un video?
Convierte texto en un plan de video: guion, escenas y una indicación por escena. Convertir eso en metraje en movimiento necesita un generador. Ambos se llaman texto a video, que es donde comienza la confusión.
¿Puede ChatGPT hacer un video a partir de fotos?
Puede analizar una foto y escribir una potente indicación de imagen a video a partir de ella, incluyendo lo que debe permanecer fijo. La animación en sí ocurre en una herramienta de imagen a video.
¿Puede ChatGPT crear videos animados?
Escribe el guion, las descripciones de los personajes y las indicaciones de escena. Para mantener la coherencia, reutiliza una descripción de personaje idéntica en cada escena en lugar de reformularla, que es lo que hace que los personajes se desvíen.
¿Puede ChatGPT editar un video existente?
Puede planificar la edición a partir de una transcripción: cortes con marcas de tiempo, notas de ritmo, narración reescrita, marcadores de capítulo. No puede tocar tu línea de tiempo, por lo que aplicas los cambios en un editor.
¿Qué pasó con OpenAI Sora?
OpenAI anunció el cierre el 24 de marzo de 2026, cerró la aplicación y el sitio web el 26 de abril, y finalizará la API el 24 de septiembre. Costaba alrededor de $1M al día operarlo contra aproximadamente $2.1M en ingresos de por vida.
¿Todavía puedo exportar mis videos de Sora?
Sí, hasta que la API se cierre el 24 de septiembre de 2026. El contenido que quede después de esa fecha se eliminará permanentemente, así que exporta ahora todo lo que quieras conservar.
¿Es ChatGPT mejor que un generador de videos de IA dedicado?
Hacen trabajos diferentes. ChatGPT maneja la estructura, el guion y las instrucciones. Un generador renderiza los fotogramas. La mayoría de los videos de IA decepcionantes provienen de una instrucción débil, que es exactamente el vacío que llena ChatGPT.
¿Cómo convierto un guion de ChatGPT en un video?
Divide el guion en una tabla de escenas, escribe una instrucción de generación por escena, renderiza los clips, luego ensámblalos con narración y subtítulos en un editor.
¿Por qué mi video de IA ignora la instrucción?
Generalmente, demasiadas instrucciones en un solo clip. Los generadores manejan bien una acción clara y varias de forma deficiente. Divídelo en clips cortos separados y únelos.
¿Puede ChatGPT añadir texto en pantalla?
Escribe el texto. No pidas a un generador de vídeo que lo renderice, porque el texto en el metraje generado suele salir distorsionado. Genera el clip limpio y añade las palabras en la edición.
¿Cuál es la forma más barata de hacer vídeo con IA?
Reutiliza lo que ya tienes. Transcribe una grabación existente, haz que ChatGPT la reestructure en guiones cortos y recorta clips del metraje real. Sin créditos de generación en absoluto.