ChatGPTは動画を作成できますか? Soraがなくなった今、何ができるのか
On this page
この質問に答えるほとんどの記事は、もはや存在しない製品について説明しています。
ChatGPTはあなたのために完成した動画をレンダリングすることはできません。それは元々単独ではできませんでした。それを行っていたのはSoraであり、OpenAIは2026年4月26日にSoraアプリとウェブサイトを閉鎖しました。その背後にあるAPIは9月24日に停止します。もしそこにまだ生成物が残っているなら、その2番目の日付は締め切りであり、単なる豆知識ではありません。
したがって、正直な答えは、ChatGPTは動画生成ツールではなく、今年からOpenAIは消費者に動画生成ツールを一切販売していないということです。
しかし、レンダリングを取り巻くあらゆること、つまりコンセプト、スクリプト、ショットリスト、実際の生成ツールに入力するプロンプト、ナレーションの原稿、キャプション、編集プランには非常に優れています。それが作業の大部分です。MP4を生成する部分ではない、というだけです。
簡易回答
ChatGPTは、スクリプト、絵コンテ、プロンプト、キャプション、ナレーションを作成し、静止画を生成できます。動画をレンダリングすることはできません。Soraが2026年4月に終了して以来、実際のクリップを作成するには別の生成ツールを使用する必要があり、ChatGPTはそれらのクリップを生成する価値のあるものにするツールです。
- できること: スクリプト、絵コンテ、プロンプト、キャプション、静止画の作成
- できないこと: クリップのレンダリング、タイムラインの編集、動画ファイルのエクスポート
- Sora: アプリは2026年4月26日に終了、APIは9月24日に終了
- 最も安価な現実的な方法: 既にある映像を再利用する
簡潔な回答
いいえ、あなたが意図する意味では違います。
ChatGPTに「Xについての動画を作成して」と入力しても、スクリプト、動画の説明、またはシーンのアイデアのセットが得られるだけです。どこにアップロードできるようなファイルは得られません。レンダリングボタンも、タイムラインも、エクスポートもありません。
人々を混乱させているのは、これがかつてはほぼ真実だったということです。SoraはOpenAIの動画モデルであり、それは本当に印象的で、しばらくの間、チャットプロンプトからOpenAI自身の製品内で完成したクリップを作成するもっともらしいルートがありました。そのルートは4月に閉鎖されました。
Soraに何が起こったのか
OpenAIは2026年3月24日にシャットダウンを発表し、4月26日にウェブとアプリの体験を終了しました。APIは2026年9月24日に続きます。
理由は金銭であり、その数字は製品の事後分析としては異例なほど率直なものです。Soraの運営には1日あたり約100万ドルかかり、その寿命全体で総収益は210万ドル程度でした。ディズニーとのライセンス契約が破綻し、著作権やディープフェイクの問題が継続し、企業が利益率を上げる中、この決定は多かれ少なかれ必然的でした。The Decoderにはより詳しいタイムラインがあります。
Soraで何かを生成し、まだエクスポートしていない場合、APIは2026年9月24日に停止し、残りのコンテンツはその後に削除されます。sora.chatgpt.com/sunsetがまだ稼働しているうちにエクスポートしてください。
実用的な結果は2つあります。ChatGPT内で動画を生成する方法を説明しているチュートリアルは、発行時期に関わらず、すべて死んだ製品について説明しています。そして、OpenAIは現在、消費者向けの動画生成ツールを持っておらず、「ChatGPT動画生成ツール」という製品は存在せず、他社のモデルを経由するワークフローのみが存在します。
ChatGPTが実際にすること
作業を段階に分けると、状況がより明確になります。ChatGPTはそのほとんどをカバーします。
| 段階 | ChatGPT | 得られるもの |
|---|---|---|
| コンセプトとアングル | はい | トピック、フック、構成 |
| スクリプトとナレーション | はい | ダイアログ、ナレーション原稿 |
| 絵コンテとショット | はい | タイミング付きのシーン表 |
| 生成プロンプト | はい | 別のツール用の詳細なプロンプト |
| 静止画 | はい | サムネイル、フレーム、参考画像 |
| キャプションとタイトル | はい | キャプションテキスト、説明 |
| クリップのレンダリング | いいえ | 動画生成ツールが必要 |
| タイムライン編集 | いいえ | エディターが必要 |
| ファイルのエクスポート | いいえ | エクスポートするものがない |
「はい」が6つ、「いいえ」が3つ。しかし、「いいえ」の3つは、あなたが実際に欲しかったものを生成する部分であり、そのため正直な表現は「ChatGPTは前制作を行う」であって、「ChatGPTは動画を作成する」ではありません。
テキストから動画へ、現実的に
「ChatGPT テキストから動画へ」は2つの異なる意味を持ち、検索している人は通常2番目の意味を求めています。
1つ目は、文章を動画プランにすることです。ブログ記事を貼り付けて、60秒のスクリプト、シーンの内訳、シーンごとのプロンプトを依頼します。ChatGPTはこれに非常に優れており、ほとんどの人が宿題のように感じるためスキップする部分です。
2つ目は、文章をレンダリングされたクリップにすることです。これには生成ツールが必要です。ChatGPTは引き継ぎ役であり、レンダリングは行いません。
トピックではなく、制約を与える
「生産性に関する動画」では、あいまいなものしか得られません。プラットフォーム、長さ、視聴者、そして一つの具体的なメッセージを与えることで、使用可能なものが得られます。ここでは、モデルよりもブリーフの方が多くの作業をしています。
スクリプトを入手し、その後3分の1に短縮する
最初の草稿は常に長くなりがちで、ナレーションはページ上で見るよりも読むのが遅くなります。期間ではなく目標単語数を尋ねてください。なぜなら、単語数は実際に達成できるものだからです。
表を使ってシーンに分割する
タイムスタンプ、ナレーション、画面上のもの、カメラのメモ。表を使うことで、雰囲気を書くのではなく具体的な内容にコミットせざるを得なくなり、それがショットリストになります。
各行を生成プロンプトに変換する
シーンごとに1つのプロンプトを作成し、それをあなたが使用するどの生成ツールにも持っていきます。これが引き継ぎ点であり、ChatGPTの貢献はここで終わります。
まだ生成ツールを決めていない場合、無料のAI動画生成ツールのまとめにはエクスポート制限とウォーターマークが記載されており、目的地がYouTubeの場合はYouTubeに特化した比較もあります。
写真から動画を作成する
ChatGPTは写真を見て説明し、それがどのように動くかを提案し、アニメーション化するためのプロンプトを作成できます。ただし、アニメーション化はできません。
それは小さな区別のように聞こえますが、そうではありません。画像から動画へのプロンプトは、何が固定されるか、何が動くかを伝える必要があります。そして、ほとんどの試みがここで失敗します。人々は望む動きを記述し、被写体を保持することについては何も言わないため、顔がクリップ全体に漂ってしまいます。
再利用する価値のあるプロンプトは、被写体とその変更してはならない点、希望する特定の動き、カメラの動き、背景の挙動、ライティング、デュレーション、アスペクト比を網羅します。ChatGPTにあなたの写真からそれを書くように頼むと、画像を見て何が写っているかを説明できるため、良い仕事をしてくれます。
動画プロンプトの作成
これはこのページで最も応用が利くものであり、優れたプロンプトはその年を生き残るどのジェネレーターでも機能するからです。
その式:被写体、アクション、環境、ビジュアルスタイル、ショットタイプ、カメラの動き、ライティング、ムード、デュレーション、アスペクト比、そして避けるべきこと。最後のものを逃すと、再生成にクレジットを費やすことになります。
「[被写体]が[環境]で[アクション]を行う。[ビジュアルスタイル]の見た目、[ショットタイプ]、[カメラの動き]。[ライティング]、ムードは[ムード]。[デュレーション]、[アスペクト比]。[一貫性を保つべきもの]は変更しない。 [望まないもの]は避ける。」
「夜の濡れた都会の通りを灰色のコートを着た女性が歩く。シネマティックな、彼女と一緒に動くミディアムトラッキングショット、舗道に映るネオンの反射、クールな青いキーライト。ムードは穏やかで少し寂しい。8秒、16:9。彼女のコートと髪型は全体を通して一貫させる。テキスト、ロゴ、他の歩行者は避ける。」
「マットブラックの水筒が、薄いコンクリートの表面でゆっくりと回転する。クリーンなコマーシャルルック、クローズアップ、被写体の周りをゆっくりと周回する、左上からの柔らかい拡散光。6秒、1:1。ボトルとラベルの位置は固定する。ラベルを歪ませる反射は避け、フレーム内に手は入れない。」
「一組の手がノートを開き、木製の机で書き始める。暖かく自然なスタイル、オーバーヘッドショット、ゆっくりとプッシュイン。朝の窓からの光。5秒、9:16、アクションは上2/3に中央揃えし、キャプションが下に配置できるようにする。ページ上の判読可能なテキストは避ける。」
人々が省きがちな詳細は、それぞれの最後にある「避けるべきこと」と「キャプションのための余白をどこに残すか」です。どちらも再生成の手間を省きます。
アニメーションと解説動画
他のすべてと同じ分割。ChatGPTが書き、別のものが描画する。
アニメーションにおいて本当に役立つのは、キャラクターの一貫性です。これは、ほとんどのAI生成アニメーションシーケンスを台無しにするものです。詳細なキャラクター説明を1つ書かせ、それを固定し、その全く同じブロックを各シーンのプロンプトに貼り付けてください。要約ではなく、同じテキストです。シーン間で言い換えをすると、キャラクターがずれ始めます。
特に解説動画では、スクリプトと画面上のテキストを2つの別々の列として要求することが役立つテクニックです。ナレーションとキャプションが逐語的に同じ役割を果たすのは解説動画で最もよくある間違いであり、早い段階でそれらを分離することでそれを防ぎます。
ChatGPTは動画を編集できますか?
動画自体はできません。編集計画はできますし、それが作業のほとんどを占めることがわかっています。
トランスクリプトを与えれば、繰り返しを見つけ、イントロがだらだらしている箇所を教え、タイムスタンプ付きのカットを提案し、ぎこちないナレーションの部分を書き換え、チャプターマーカーを生成します。できないのは、あなたのタイムラインを操作することです。そのメモをエディターに持ち込み、自分でカットを行います。
そのトランスクリプトが依存関係です。既存の動画でChatGPTができること、できないことについては、ChatGPTは動画を視聴・分析できるかのガイドで詳しく扱われており、ファイルの取り込み方法はChatGPTに動画をアップロードする方法で説明されています。手短に言えば、テキストが必要なので、まずフッテージを動画からテキストへの変換ツールに通してから作業してください。
これはまた、ひっそりと、AIを使って動画を作成する最も安価な方法でもあります。全く新しいフッテージを生成するのではなく、すでに録画済みのものを取り込み、トランスクリプトを抽出し、ChatGPTにそこから3つの短いクリップを切り出させるのです。クレジットも、レンダーキューも不要で、フッテージは本物です。
費用
「無料」は計画段階にのみ適用され、そこで終わります。
| 段階 | ChatGPTで無料 | 費用が発生する場所 |
|---|---|---|
| スクリプトと絵コンテ | はい | 無料枠のメッセージ制限 |
| プロンプト | はい | なし |
| 静止画 | 制限あり | 無料アカウントのデイリーキャップ |
| クリップのレンダリング | いいえ | 他の場所での生成ごとのクレジット |
| ナレーション音声 | いいえ | テキスト読み上げサービス購読 |
| 編集とエクスポート | いいえ | エディター、またはウォーターマーク |
したがって、「ChatGPTは無料で動画を作成できますか」という質問には、厄介な答えがあります。できる半分は無料ですが、費用がかかる半分は動画を作成する半分です。ChatGPTサブスクリプション自体がカバーする内容については、ChatGPTの料金内訳をご覧ください。
ChatGPTとビデオジェネレーター
これらは競合ではありません。これらを代替品として扱うことが、人々が両方に失望する原因です。
ビデオジェネレーターはプロンプトを受け取り、ピクセルを返します。あなたのフックが機能するかどうかについて意見を持たず、前回作成したビデオの記憶もなく、スクリプトが30秒長すぎると教えてくれることもありません。曖昧なプロンプトを与えると、曖昧なクリップを美しくレンダリングします。
ChatGPTは逆です。構造、判断、言語に優れ、単一のフレームを生成することはできません。あなたのコンセプトが混乱していることを喜んで教えてくれるでしょう。これは、別のレンダリングよりも価値があります。
この組み合わせが機能するのは、ジェネレーターの主な弱点がプロンプトの品質であり、それこそがChatGPTの役割だからです。ほとんどの質の悪いAIビデオはモデルの失敗ではありません。それは、誰かがジェネレーターに11の単語を入力して期待しているだけです。
この点でChatGPTが真に比類ないのは、コンテンツの再利用です。既存のトランスクリプトをChatGPTに渡し、1つの録画からショートスクリプト、ブログの概要、5つのキャプションバリアントを一度に再構成させることができます。これを実行できるジェネレーターはなく、ビデオワークフローにおける最も高いリターンをもたらす使用方法です。AIサマライザーやAIビデオウォッチャーは、生の素材に早く到達するのに役立ちますが、再構成はChatGPTの仕事です。
失敗するケース
6つのことが繰り返し失敗しますが、そのどれもモデルの失敗ではありません。
| 何が起こるか | 理由 | 解決策 |
|---|---|---|
| クリップがプロンプトを無視する | 一度に指示が多すぎる | クリップごとに1つのアクション、その後結合 |
| キャラクターの顔が変わる | シーンごとに描写が書き換えられる | 常に同じブロックを貼り付ける |
| スクリプトが長すぎる | 単語ではなく尺を要求した | 文字数を指定する(1分あたり約150語) |
| ナレーションが機械的 | 声や視聴者が指定されていない | 話し手と対象を指定する |
| キャプションが音声と一致しない | 下書きスクリプトから作成された | スクリプトではなく最終的な録音にキャプションを付ける |
| フレーム内のテキストが文字化けする | ジェネレーターはテキストのレンダリングが苦手 | プロンプトでテキストを禁止し、編集で追加する |
最後の項目は心に留めておく価値があります。ビデオモデルに画面上のテキストを要求してはいけません。クリップをクリーンに生成し、後からテキストを追加することで、フォントを制御し、実際に読みやすくすることができます。
私が実際にやること
もし既に映像があるなら、そこから始めましょう。それを書き起こし、トランスクリプトをChatGPTに渡し、1つの録画から3つの短いビデオを作成します。費用はかからず、映像は本物であり、今週あなたが生成するどんなものよりも優れています。
本当に新しい映像が必要な場合は、スクリプトとシーンごとのプロンプトにChatGPTを使用し、それらをジェネレーターに持ち込みます。品質はプロンプトから生まれるものであり、プロンプトは無料です。
私がしないのは、OpenAIが代替品を出すのを待つことです。Soraは1日あたり約100万ドルを失い、その寿命全体で合計210万ドルを稼ぎました。これはすぐに復活するような製品ではありません。
よくある質問
ChatGPTはビデオを作成できますか?
いいえ。スクリプト、絵コンテ、プロンプト、キャプションを作成し、静止画像を生成することはできますが、ビデオをレンダリングしたりファイルをエクスポートしたりはしません。クリップを作成するには、別のジェネレーターを使用する必要があります。
ChatGPTにはビデオジェネレーターがありますか?
もうありません。SoraはOpenAIのビデオ製品でしたが、アプリとウェブサイトは2026年4月26日に終了し、APIは2026年9月24日に終了します。現在、OpenAIから消費者向けのビデオジェネレーターは提供されていません。
ChatGPTは無料で動画を作成できますか?
ChatGPTができる部分は、有料プランでは無料で利用でき、無料プランでも画像生成に制限はあるものの、ほとんど無料で利用できます。レンダリング、ナレーション、編集はすべて別の場所で行われるため、そこに費用がかかります。
ChatGPTはテキストを動画に変換できますか?
テキストを動画の企画(スクリプト、シーン、シーンごとのプロンプト)に変換します。それを動く映像にするにはジェネレーターが必要です。どちらも「テキストから動画へ」と呼ばれているため、ここに混乱が生じます。
ChatGPTは写真から動画を作成できますか?
写真を分析し、固定すべき要素を含めて、強力な画像から動画へのプロンプトを作成できます。アニメーション自体は画像から動画へのツールで行われます。
ChatGPTはアニメーション動画を作成できますか?
スクリプト、キャラクターの説明、シーンのプロンプトを作成します。一貫性を保つため、キャラクターがぶれる原因となる言い換えではなく、すべてのシーンで同じキャラクターの説明を再利用してください。
ChatGPTは既存の動画を編集できますか?
文字起こしから編集を計画できます。タイムスタンプ付きのカット、ペース配分のメモ、書き直されたナレーション、チャプターマーカーなどです。タイムラインには触れないため、エディターで変更を適用する必要があります。
OpenAI Soraはどうなったのか?
OpenAIは2026年3月24日にシャットダウンを発表し、4月26日にアプリとウェブサイトを閉鎖し、9月24日にAPIを終了する予定です。日々の運用には約100万ドルかかり、累計収益は約210万ドルでした。
Soraの動画はまだエクスポートできますか?
はい、2026年9月24日にAPIがシャットダウンするまでは可能です。それ以降に残されたコンテンツは完全に削除されますので、残しておきたいものは今すぐエクスポートしてください。
ChatGPTは専用のAI動画生成ツールより優れていますか?
それぞれ異なる役割を担っています。ChatGPTは構成、スクリプト、プロンプトを扱います。生成ツールはフレームをレンダリングします。最も期待外れなAI動画は弱いプロンプトから生まれることが多く、それこそがChatGPTが埋めるギャップです。
ChatGPTのスクリプトを動画にするにはどうすればいいですか?
スクリプトをシーンごとの表に分け、シーンごとに1つの生成プロンプトを作成し、クリップをレンダリングした後、エディターでナレーションとキャプションとともにそれらを組み立てます。
AI動画がプロンプトを無視するのはなぜですか?
通常、1つのクリップに指示が多すぎるためです。生成ツールは1つの明確なアクションはうまく処理しますが、複数のアクションは苦手です。それを別々の短いクリップに分割し、つなぎ合わせてください。
ChatGPTは画面にテキストを追加できますか?
テキストは書きます。ビデオジェネレーターにレンダリングを依頼しないでください。生成された映像のテキストは通常、文字化けします。クリップをきれいに生成し、編集で単語を追加してください。
AIで動画を作る最も安価な方法は?
すでにあるものを再利用してください。既存の録音を文字起こしし、ChatGPTに短いスクリプトに再構築させ、実際の映像からクリップを切り出します。生成クレジットは一切不要です。