Kann ChatGPT Videos erstellen? Was funktioniert jetzt, da Sora eingestellt wurde?
On this page
Die meisten Artikel, die diese Frage beantworten, beschreiben ein Produkt, das nicht mehr existiert.
ChatGPT kann kein fertiges Video für Sie rendern. Es konnte das nie wirklich alleine: Das, was das tat, war Sora, und OpenAI hat die Sora-App und -Website am 26. April 2026 abgeschaltet. Die dahinterliegende API wird am 24. September eingestellt. Wenn Sie noch Generierungen darin haben, ist dieses zweite Datum eine Frist, keine Trivia.
Die ehrliche Antwort ist also, dass ChatGPT kein Videogenerator ist und OpenAI ab diesem Jahr überhaupt keinen an Verbraucher verkauft.
Woran es aber sehr gut ist, ist alles rund um das Rendern: das Konzept, das Skript, die Shot-Liste, die Prompts, die Sie in einen echten Generator einspeisen, der Voice-Over-Text, die Untertitel und der Schnittplan. Das ist der Großteil der Arbeit. Es ist nur nicht der Teil, der eine MP4-Datei produziert.
Kurze Antwort
ChatGPT schreibt das Skript, Storyboard, Prompts, Untertitel und Voice-over und kann Standbilder generieren. Es rendert keine Videos. Da Sora im April 2026 geschlossen wurde, bedeutet die Produktion des eigentlichen Clips die Verwendung eines separaten Generators, und ChatGPT ist das, was diese Clips generierenswert macht.
- Es kann: Skripte schreiben, Storyboards erstellen, Prompts geben, untertiteln und Standbilder erstellen
- Es kann nicht: einen Clip rendern, eine Timeline bearbeiten oder eine Videodatei exportieren
- Sora: App seit 26. April 2026 tot, API endet am 24. September
- Günstigster echter Weg: vorhandenes Material wiederverwenden
Die kurze Antwort
Nein, nicht in dem Sinne, wie Sie es meinen.
Tippen Sie “erstelle mir ein Video über X” in ChatGPT ein und Sie erhalten ein Skript, oder eine Videobeschreibung, oder eine Reihe von Szenenideen. Sie erhalten keine Datei, die Sie irgendwo hochladen können. Es gibt keinen Render-Button, keine Timeline, keinen Export.
Was die Leute verwirrt, ist, dass dies früher fast wahr war. Sora war OpenAI’s Videomodell, es war wirklich beeindruckend, und für eine Weile gab es einen plausiblen Weg von einer Chat-Eingabeaufforderung zu einem fertigen Clip innerhalb von OpenAI’s eigenen Produkten. Dieser Weg wurde im April geschlossen.
Was mit Sora geschah
OpenAI kündigte die Abschaltung am 24. März 2026 an und schloss die Web- und App-Erfahrungen am 26. April. Die API folgt am 24. September 2026.
Der Grund war Geld, und die Zahlen sind für eine Produkt-Post-Mortem ungewöhnlich deutlich. Sora kostete etwa eine Million Dollar pro Tag im Betrieb und hatte in seiner gesamten Lebensdauer etwa 2,1 Millionen Dollar an Gesamteinnahmen erzielt. Fügt man einen gescheiterten Lizenzvertrag mit Disney, anhaltende Urheberrechts- und Deepfake-Probleme sowie ein Unternehmen, das seine Margen schärft, hinzu, so trifft sich die Entscheidung mehr oder weniger von selbst. The Decoder hat die vollständige Zeitachse, falls Sie diese wünschen.
Wenn Sie etwas in Sora generiert und nicht exportiert haben, wird die API am 24. September 2026 abgeschaltet und der verbleibende Inhalt danach gelöscht. Exportieren Sie von sora.chatgpt.com/sunset, solange es noch verfügbar ist.
Zwei praktische Konsequenzen. Jedes Tutorial, das Sie finden, das Ihnen zeigt, wie man Videos in ChatGPT generiert, beschreibt ein totes Produkt, unabhängig davon, wie kürzlich es veröffentlicht wurde. Und OpenAI hat derzeit keinen Videogenerator für Endverbraucher, daher existiert “ChatGPT Videogenerator” als Produkt nicht, sondern nur Workflows, die über das Modell eines anderen Anbieters laufen.
Was ChatGPT tatsächlich leistet
Teilen Sie die Aufgabe in Phasen auf, und das Bild wird klarer. ChatGPT deckt die meisten davon ab.
| Phase | ChatGPT | Was Sie erhalten |
|---|---|---|
| Konzept und Blickwinkel | Ja | Themen, Aufhänger, Struktur |
| Skript und Narration | Ja | Dialog, Voice-over-Text |
| Storyboard und Aufnahmen | Ja | Szenentabelle mit Zeitangaben |
| Generierungs-Prompts | Ja | Detaillierte Prompts für ein anderes Tool |
| Standbilder | Ja | Vorschaubilder, Frames, Referenzen |
| Untertitel und Titel | Ja | Untertiteltext, Beschreibungen |
| Den Clip rendern | Nein | Benötigt einen Videogenerator |
| Timeline-Bearbeitung | Nein | Benötigt einen Editor |
| Eine Datei exportieren | Nein | Nichts zu exportieren |
Sechs Ja, drei Nein. Aber die drei Dinge, die es nicht kann, sind diejenigen, die das produzieren, was Sie eigentlich wollten, weshalb die ehrliche Formulierung lautet: “ChatGPT macht die Vorproduktion” und nicht “ChatGPT erstellt Videos.”
Text zu Video, Realistisch betrachtet
„ChatGPT Text zu Video“ bedeutet zwei verschiedene Dinge, und Leute, die danach suchen, wollen normalerweise das zweite.
Das erste ist, das Schreiben in einen Videoplan umzuwandeln. Fügen Sie einen Blog-Beitrag ein und bitten Sie um ein 60-Sekunden-Skript, eine Szenenaufschlüsselung und einen Prompt pro Szene. ChatGPT ist darin hervorragend, und es ist der Teil, den die meisten Leute überspringen, weil es sich wie Hausaufgaben anfühlt.
Das zweite ist, das Schreiben in einen gerenderten Clip umzuwandeln. Das benötigt einen Generator. ChatGPT übergibt die Aufgabe; es rendert nicht selbst.
Geben Sie die Einschränkungen vor, nicht das Thema
„Ein Video über Produktivität“ liefert Ihnen Brei. Plattform, Länge, Zielgruppe und eine spezifische Botschaft liefern Ihnen etwas Brauchbares. Das Briefing leistet hier mehr Arbeit als das Modell.
Holen Sie sich das Skript, und kürzen Sie es dann um ein Drittel
Erste Entwürfe sind immer zu lang, und die Narration liest sich langsamer, als sie auf der Seite aussieht. Fragen Sie nach einer Zielwortzahl statt nach einer Dauer, denn die Wortzahl ist etwas, das es tatsächlich erreichen kann.
Teilen Sie es mit einer Tabelle in Szenen auf
Zeitstempel, Narration, was auf dem Bildschirm ist, Kamera-Notiz. Eine Tabelle zwingt es, sich auf Spezifisches festzulegen, anstatt Atmosphäre zu schreiben, und sie wird zu Ihrer Shot-Liste.
Wandeln Sie jede Zeile in einen Generierungs-Prompt um
Ein Prompt pro Szene, dann bringen Sie diese zu dem Generator, den Sie verwenden. Dies ist der Übergabepunkt, und hier endet der Beitrag von ChatGPT.
Wenn Sie sich noch nicht für einen Generator entschieden haben, deckt die Zusammenfassung der kostenlosen KI-Videogeneratoren Exportbeschränkungen und Wasserzeichen ab, und es gibt einen YouTube-spezifischen Vergleich, falls dies das Ziel ist.
Videos aus Fotos erstellen
ChatGPT kann ein Foto betrachten und beschreiben, vorschlagen, wie es sich bewegen könnte, und den Prompt für die Animation schreiben. Es kann es nicht animieren.
Das klingt nach einem kleinen Unterschied und ist es nicht. Ein Bild-zu-Video-Prompt muss sagen, was fest bleibt und was sich bewegt, und hier scheitern die meisten Versuche: Die Leute beschreiben die gewünschte Bewegung und sagen nichts über die Erhaltung des Motivs, so dass das Gesicht im Clip herumwandert.
Ein wiederverwendbarer Prompt umfasst das Motiv und was daran unverändert bleiben muss, die eine spezifische Bewegung, die Sie wünschen, was die Kamera tut, wie sich der Hintergrund verhält, die Beleuchtung, die Dauer und das Seitenverhältnis. Bitten Sie ChatGPT, dies anhand Ihres Fotos zu schreiben, und es macht einen guten Job, weil es das Bild sehen und beschreiben kann, was darin ist.
Einen Video-Prompt schreiben
Dies ist das übertragbarste Element auf dieser Seite, denn ein guter Prompt funktioniert in jedem Generator, der das Jahr überlebt.
Die Formel: Motiv, Aktion, Umgebung, visueller Stil, Aufnahmetyp, Kamerabewegung, Beleuchtung, Stimmung, Dauer, Seitenverhältnis und was zu vermeiden ist. Wenn Sie den letzten Punkt vergessen, werden Sie Credits für die Neuerstellung ausgeben.
"[Motiv] [Aktion] in [Umgebung]. [Visueller Stil] Look, [Aufnahmetyp], [Kamerabewegung]. [Beleuchtung], Stimmung ist [Stimmung]. [Dauer], [Seitenverhältnis]. Halten Sie [was konsistent bleiben muss] unverändert. Vermeiden Sie [was Sie nicht wollen]."
"Eine Frau in einem grauen Mantel geht nachts eine nasse Stadtstraße entlang. Filmisch, mittlerer Verfolgungsschuss, der sich mit ihr bewegt, Neonreflexionen auf dem Bürgersteig, kühles blaues Hauptlicht. Die Stimmung ist ruhig und ein wenig einsam. 8 Sekunden, 16:9. Halten Sie ihren Mantel und ihre Haare durchgehend konsistent. Vermeiden Sie Text, Logos und andere Fußgänger."
"Eine matt-schwarze Wasserflasche dreht sich langsam auf einer hellen Betonoberfläche. Sauberer kommerzieller Look, Nahaufnahme, langsamer Orbit um das Motiv, weiches, diffuses Licht von oben links. 6 Sekunden, 1:1. Halten Sie die Flaschenform und die Etikettenposition fest. Vermeiden Sie Reflexionen, die das Etikett verzerren, und keine Hände im Bild."
"Ein Paar Hände öffnet ein Notizbuch und beginnt an einem Holzschreibtisch zu schreiben. Warmer natürlicher Stil, Overhead-Aufnahme, langsames Hineinfahren. Morgenfensterlicht. 5 Sekunden, 9:16, wobei die Aktion in den oberen zwei Dritteln zentriert ist, damit Untertitel darunter platziert werden können. Vermeiden Sie lesbaren Text auf der Seite."
Das Detail, das die Leute weglassen, ist jeweils das letzte: was zu vermeiden ist und wo Platz für Bildunterschriften gelassen werden soll. Beides spart Neuerstellungen.
Animiertes und Erklärvideo
Die gleiche Aufteilung wie bei allem anderen. ChatGPT schreibt es, etwas anderes zeichnet es.
Wo es bei der Animation wirklich hilft, ist die Charakterkonsistenz, die die meisten KI-generierten Animationssequenzen ruiniert. Lassen Sie es eine detaillierte Charakterbeschreibung schreiben, fixieren Sie sie und fügen Sie diesen identischen Block in jeden Szenen-Prompt ein. Keine Zusammenfassung davon, sondern den gleichen Text. Sobald Sie zwischen den Szenen paraphrasieren, beginnt der Charakter zu driften.
Speziell für Erklärvideos ist der nützliche Trick, das Skript und den Bildschirmtext als zwei separate Spalten anzufordern. Narration und Bildunterschriften, die Wort für Wort die gleiche Aufgabe erfüllen, sind der häufigste Fehler bei Erklärvideos, und eine frühzeitige Trennung verhindert dies.
Kann ChatGPT Videos bearbeiten?
Nicht das Video. Der Plan für die Bearbeitung, ja, und das stellt sich als der größte Teil der Arbeit heraus.
Geben Sie ihm ein Transkript und es wird Wiederholungen finden, Ihnen sagen, wo die Einleitung schleppt, Schnitte mit Zeitstempeln vorschlagen, einen ungeschickten Abschnitt der Narration umschreiben und Kapitelmarkierungen generieren. Was es nicht kann, ist Ihre Timeline zu berühren. Sie übernehmen seine Notizen in einen Editor und machen die Schnitte selbst.
Dieses Transkript ist die Abhängigkeit. Eine ausführlichere Darstellung dessen, was ChatGPT mit einem vorhandenen Video tun kann und was nicht, finden Sie im Leitfaden ob ChatGPT Videos ansehen und analysieren kann, und die Mechanismen zum Einbinden einer Datei werden im Bereich Video auf ChatGPT hochladen behandelt. Die Kurzversion ist, dass es Text benötigt, also führen Sie das Material zuerst durch einen Video-zu-Text-Konverter und arbeiten Sie damit.
Dies ist auch, stillschweigend, der günstigste Weg, Videos mit KI zu erstellen. Überhaupt kein neues Material zu generieren, sondern etwas bereits Aufgenommenes zu nehmen, ein Transkript zu erstellen und ChatGPT drei kurze Clips daraus schneiden zu lassen. Keine Credits, keine Renderwarteschlange, und das Material ist echt.
Was es kostet
“Kostenlos” bezieht sich auf die Planungsphasen und endet dort.
| Phase | Kostenlos mit ChatGPT | Wo Kosten entstehen |
|---|---|---|
| Skript und Storyboard | Ja | Nachrichtenlimits im kostenlosen Tarif |
| Prompts | Ja | Keine |
| Standbilder | Begrenzt | Tägliche Limits bei kostenlosen Konten |
| Clips rendern | Nein | Credits pro Generation an anderer Stelle |
| Voice-over Audio | Nein | Text-to-Speech-Abonnement |
| Bearbeitung und Export | Nein | Editor oder ein Wasserzeichen |
Die Frage “Kann ChatGPT kostenlos Videos erstellen” hat also eine unbequeme Antwort: Die Hälfte, die es kann, ist kostenlos, und die Hälfte, die Geld kostet, ist die Hälfte, die das Video erstellt. Eine Aufschlüsselung der ChatGPT-Preise finden Sie in unserem Blog.
ChatGPT vs. ein Video-Generator
Sie sind keine Konkurrenten. Sie als Alternativen zu behandeln, ist der Grund, warum Menschen am Ende von beiden enttäuscht sind.
Ein Video-Generator nimmt einen Prompt entgegen und liefert Pixel zurück. Er hat keine Meinung darüber, ob Ihr Hook funktioniert, keine Erinnerung an das letzte Video, das Sie gemacht haben, und er wird Ihnen nicht sagen, dass das Skript dreißig Sekunden zu lang ist. Füttern Sie ihn mit einem vagen Prompt und er rendert einen vagen Clip, wunderschön.
ChatGPT ist das Gegenteil: stark in Struktur, Urteilsvermögen und Sprache, aber unfähig, einen einzigen Frame zu produzieren. Es wird Ihnen gerne sagen, dass Ihr Konzept durcheinander ist, was mehr wert ist als ein weiterer Render.
Die Paarung funktioniert, weil die Hauptschwäche des Generators die Prompt-Qualität ist und genau dafür ist ChatGPT da. Die meisten schlechten KI-Videos sind kein Modellfehler. Es ist jemand, der elf Wörter in einen Generator tippt und hofft.
Wo ChatGPT wirklich unübertroffen ist, ist die Wiederverwertung. Richten Sie es auf ein bestehendes Transkript und es wird eine Aufnahme in ein kurzes Skript, eine Blog-Gliederung und fünf Untertitelvarianten in einem einzigen Durchgang umstrukturieren. Kein Generator macht das, und es ist die ertragsreichste Nutzung in einem Video-Workflow. Ein KI-Zusammenfasser oder ein KI-Video-Beobachter bringt Sie schneller zum Rohmaterial, aber die Umstrukturierung ist Sache von ChatGPT.
Wo dies scheitert
Sechs Dinge gehen immer wieder schief, und keine davon sind Modellfehler.
| Was passiert | Warum | Lösung |
|---|---|---|
| Clip ignoriert den Prompt | Zu viele Anweisungen auf einmal | Eine Aktion pro Clip, dann zusammenfügen |
| Figur ändert das Gesicht | Beschreibung pro Szene neu formuliert | Den identischen Block jedes Mal einfügen |
| Skript ist zu lang | Nach Dauer gefragt, nicht nach Wörtern | Eine Wortanzahl angeben, ungefähr 150 pro Minute |
| Erzählung klingt robotisch | Keine Stimme oder Zielgruppe angegeben | Sprecher und Adressaten nennen |
| Untertitel stimmen nicht mit dem Audio überein | Aus dem Entwurfsskript erstellt | Die finale Aufnahme untertiteln, nicht das Skript |
| Text im Bild ist unverständlich | Generatoren rendern Text schlecht | Text im Prompt verbieten, im Schnitt hinzufügen |
Der letzte Punkt ist es wert, verinnerlicht zu werden. Fragen Sie ein Videomodell nicht nach Text auf dem Bildschirm. Generieren Sie den Clip sauber und fügen Sie die Wörter danach hinzu, wo Sie die Schriftart kontrollieren und sie tatsächlich lesbar sind.
Was ich tatsächlich tun würde
Wenn Sie bereits Filmmaterial haben, fangen Sie dort an. Transkribieren Sie es, geben Sie das Transkript an ChatGPT und schneiden Sie drei kurze Videos aus einer einzigen Aufnahme. Kostet nichts, das Filmmaterial ist echt und es schlägt alles, was Sie diese Woche generieren würden.
Wenn Sie wirklich neues Filmmaterial benötigen, verwenden Sie ChatGPT für das Skript und die Prompts pro Szene, dann nutzen Sie diese für einen Generator. Die Qualität kommt von den Prompts, und die Prompts sind kostenlos.
Was ich nicht tun würde, ist auf eine Ersatzlieferung von OpenAI zu warten. Sora verlor etwa eine Million Dollar pro Tag und erzielte über seine Lebensdauer insgesamt 2,1 Millionen Dollar. Das ist kein Produkt, das schnell zurückkehrt.
FAQ
Kann ChatGPT Videos erstellen?
Nein. Es schreibt Skripte, Storyboards, Prompts, Untertitel und generiert Standbilder, aber es rendert keine Videos und exportiert keine Dateien. Das Produzieren des Clips bedeutet die Verwendung eines separaten Generators.
Hat ChatGPT einen Video-Generator?
Nicht mehr. Sora war das Videoprodukt von OpenAI, und die App und Website wurden am 26. April 2026 geschlossen, wobei die API am 24. September 2026 eingestellt wird. Es gibt derzeit keinen Video-Generator für Endverbraucher von OpenAI.
Kann ChatGPT kostenlos Videos erstellen?
Die Teile, die es erledigen kann, sind bei einem kostenpflichtigen Plan kostenlos und bei der kostenlosen Stufe größtenteils kostenlos, mit Einschränkungen bei der Bildgenerierung. Rendering, Voice-over und Bearbeitung finden alle woanders statt, und dort entstehen die Kosten.
Kann ChatGPT Text in ein Video umwandeln?
Es wandelt Text in einen Videoplan um: Skript, Szenen und ein Prompt pro Szene. Um daraus bewegtes Filmmaterial zu machen, ist ein Generator erforderlich. Beides wird als Text zu Video bezeichnet, und hier beginnt die Verwirrung.
Kann ChatGPT ein Video aus Fotos erstellen?
Es kann ein Foto analysieren und daraus einen aussagekräftigen Bild-zu-Video-Prompt erstellen, einschließlich dessen, was unverändert bleiben soll. Die Animation selbst erfolgt in einem Bild-zu-Video-Tool.
Kann ChatGPT animierte Videos erstellen?
Es schreibt das Skript, Charakterbeschreibungen und Szenenprompts. Zur Konsistenz sollte eine identische Charakterbeschreibung über jede Szene hinweg wiederverwendet werden, anstatt sie neu zu formulieren, was dazu führt, dass Charaktere abweichen.
Kann ChatGPT ein vorhandenes Video bearbeiten?
Es kann die Bearbeitung anhand eines Transkripts planen: Schnitte mit Zeitstempeln, Pacing-Notizen, umgeschriebene Erzählung, Kapitelmarkierungen. Es kann Ihre Timeline nicht berühren, daher wenden Sie die Änderungen in einem Editor an.
Was ist mit OpenAI Sora passiert?
OpenAI kündigte die Abschaltung am 24. März 2026 an, schloss die App und Website am 26. April und wird die API am 24. September einstellen. Der Betrieb kostete rund 1 Million US-Dollar pro Tag bei etwa 2,1 Millionen US-Dollar Lebenseinnahmen.
Kann ich meine Sora-Videos noch exportieren?
Ja, bis die API am 24. September 2026 abgeschaltet wird. Danach verbleibender Inhalt wird dauerhaft gelöscht, exportieren Sie also alles, was Sie behalten möchten, jetzt.
Ist ChatGPT besser als ein dedizierter KI-Videogenerator?
Sie erfüllen unterschiedliche Aufgaben. ChatGPT kümmert sich um Struktur, Skript und Prompts. Ein Generator rendert Frames. Die meisten enttäuschenden KI-Videos entstehen durch einen schwachen Prompt, was genau die Lücke ist, die ChatGPT füllt.
Wie verwandle ich ein ChatGPT-Skript in ein Video?
Teilen Sie das Skript in eine Szenentabelle auf, schreiben Sie einen Generierungs-Prompt pro Szene, rendern Sie die Clips und fügen Sie sie dann mit Narration und Untertiteln in einem Editor zusammen.
Warum ignoriert mein KI-Video den Prompt?
Meistens zu viele Anweisungen in einem Clip. Generatoren verarbeiten eine klare Aktion gut und mehrere schlecht. Teilen Sie es in separate kurze Clips auf und fügen Sie diese zusammen.
Kann ChatGPT Text auf dem Bildschirm hinzufügen?
Es schreibt den Text. Fragen Sie keinen Videogenerator, dies zu rendern, da Text in generiertem Filmmaterial normalerweise verunstaltet herauskommt. Generieren Sie den Clip sauber und fügen Sie Wörter in der Bearbeitung hinzu.
Was ist der günstigste Weg, Videos mit KI zu erstellen?
Verwenden Sie wieder, was Sie bereits haben. Transkribieren Sie eine bestehende Aufnahme, lassen Sie ChatGPT sie in kurze Skripte umstrukturieren und schneiden Sie Clips aus dem echten Filmmaterial. Keine Generierungsguthaben überhaupt.