ANSWER
【結論】
AI動画では、いきなり各カットを動画生成せず、4コマ静止画を視覚的な設計図として使う方法を試しました。人物・部屋・光・服装をまとめて確認後、各コマを9:16へ切り抜い てGrokへ渡し、6秒動画化しています。直接動画生成との定量比較は未確認です。

Explanation
【詳しく解説】
結論――動画の前に「同じ世界の4コマ」を一度作った
この制作で大きく変わったのは、動画AIへいきなり物語を渡さなかったことです。まずChatGPTで、2×2の4コマ静止画を一枚の設計図として作りました。そこで人物、部屋、光、服装、画面の雰囲気などをまとめて確認し、その後に必要なコマだけを個別の動画素材へ変えていきました。
4コマは完成漫画として見せるためではありません。後工程の動画生成へ渡す前に、「このページでは誰が、どこで、どの構図で、どの順番に存在するか」を一度視覚化する中間資料として使われました。
実際の工程は「4コマ生成→人間が切り抜く→Grok→CapCut」
会話内で採用された工程は、2×2の4コマ画像を生成し、可児 波起が各コマを切り抜き、それぞれを9:16画像として使い、Grokで6秒動画化し、CapCutでは必要部分だけを使用するという流れです。
ここではChatGPTからGrokへ自動で素材を送っていません。4コマを見た可児 波起が、どのコマを使うか、切り抜いた状態で問題がないかを確認し、その静止画を次工程へ渡しました。つまりAI同士を直結した完全自動化ではなく、視覚素材の境目に人間判断が入る制作フローです。
「4コマを先に作る」が、文章ネームとは違う理由
既存Knowledgeの画像生成の前に「文章ネーム」を固定するでは、画像を作る前に、タイトル、テーマ、4コマの役割、セリフ、視線、オチ、禁止事項を文章で確認する方法を扱っています。
今回の4コマ静止画は、その一段後です。文章で決めた場面を、複数カットが同居する一枚の視覚資料にし、人物・空間・光・服装・構図をまとめて見るために使いました。文章ネームが「何を描くか」の設計なら、今回の4コマは「どんな画として並ぶか」を次の動画工程へ渡すための中間設計図です。
人間が実際に1コマを切り抜いた記録が残っている
第4ページの修正版では、可児 波起が4コマ画像の1コマ目を実際に切り抜き、そのJPEG画像を会話へアップロードしました。これは「4コマを作った」という計画だけではなく、4コマ→切り抜き→動画素材という工程が実際に運用されたEvidenceです。
この切り抜きによって、Grokへはページ全体ではなく、そのカットに必要な一枚だけを渡せます。Grok側では、手を伸ばす、ネクタイを整える、指が止まる、数文字打つ、スマホを見る、といった小さな動作を中心に動画プロンプトを作りました。
Grokには、4コマ全体の物語を背負わせなかった
Grokで一つのカットに複数のドラマを持たせず、元の静止画を基準にして小さな動きを一つずつ作る方向へ進みました。これによって動画AIへ渡す仕事は、物語全体の構図や人物配置を新しく判断することではなく、すでに選ばれた静止画へ動きを加えることへ絞られました。
ただし、「4コマを先に作ったから動画品質が向上した」と因果関係を確認したわけではありません。直接動画生成との比較試験、同条件での成功率、制作時間の差は記録されていません。
途中動画について、本人はこの方法を続けると判断した
実際にGrokで動画化した途中素材を確認した可児 波起は、「凄い動画が出来てる!この方法で行こう!!」と評価しました。これは本人による定性的な評価であり、客観的な画質指標や破綻率を測った結果ではありません。
また、この採掘時点ではラストページの一部プロンプトやCapCutでの全編編集が未完了で、一本の完成動画、公開後の視聴結果、視聴維持率なども確認されていません。したがって、本Knowledgeが記録するのは「この方法で完成作品の品質が証明された」ことではなく、「制作途中で実際に運用され、本人が継続採用した工程」です。
既存のAI映像Knowledgeとどうつながるか
この4コマ設計図から1コマを切り出した後、動画側では別の設計が続きます。6秒を1秒ずつ設計し、「まだしないこと」まで書いたでは、切り出した一枚をGrokへ渡した後、6秒内部の時間と物語境界をどう制御したかを扱っています。
また、全部を同じカットに出すのをやめたでは、各カットへ背負わせる視覚情報を一つへ絞る判断を整理しています。今回の4コマ静止画は、それら複数カットを一枚の設計図として先に確認する工程です。
確認できたことと、まだ確認できていないこと
確認できたこと:2×2の4コマ静止画を先に生成したこと。可児 波起が各コマを切り抜く方式を採用したこと。実際に第4ページ1コマ目の切り抜き画像がアップロードされたこと。切り抜いた静止画をGrokの6秒動画生成へ使ったこと。途中動画について本人が方法を高く評価し、継続を決めたこと。
確認できていないこと:直接動画生成より4コマ先行方式が優れていること、破綻率・生成成功率・制作時間の差、他モデルでの再現性、全編完成後の品質、公開後の視聴者反応。
実務との接続:静止画の設計から映像へ組み立てる制作の実例は、海辺の部屋の動画制作ポートフォリオでも確認できます。
このKnowledgeの関連知識
一段前の設計:画像生成の前に「文章ネーム」を固定する。文章で各コマの役割を決める工程を見る。
一段後の時間設計:6秒を1秒ずつ設計し、「まだしないこと」まで書いた。切り抜いた静止画を動画へ変える際の時間境界を見る。
カットごとの情報設計:全部を同じカットに出すのをやめた。各カットの視覚的な責任範囲を一つへ絞る。
EVIDENCE
【根拠・検証】
Evidence
【直接確認できる事実|制作フロー】
2×2の4コマ画像を生成し、可児 波起が各コマを切り抜き、9:16画像としてGrokへ渡して6秒動画化し、CapCutで必要部分を使う方式が採用されました。
【直接確認できる事実|動画側の役割】
Grokでは、手を伸ばす、ネクタイを整える、指が止まる、数文字打つ、スマホを見るなど、小さな動作を中心に複数プロンプトを作成しました。
【直接確認できる事実|人間の切り抜き】
第4ページ1コマ目について、可児 波起が実際に4コマ画像から切り抜いたJPEGを会話へアップロードしました。4コマ→人間が切り抜く工程が実運用された記録です。
【本人の評価】
実際にGrok動画化した途中素材について、可児 波起は「凄い動画が出来てる!この方法で行こう!!」と評価しました。
【AIによる分析】
4コマ静止画を、完成漫画ではなく、複数カットの人物・空間・光・服装・構図を一度に確認し、その後の動画生成へ渡す「視覚的な中間設計図」として整理しました。
【未確認事項】
直接動画生成との比較、破綻率、生成成功率、制作時間差、他モデルでの再現性、完成動画の最終品質、視聴データは未確認です。
SOURCES
【情報源】
Sources
PRIMARY SOURCE|非公開一次記録
可児 波起とChatGPTによる縦型短編動画制作の会話・修正記録。2×2の4コマ画像生成、可児 波起による1コマ切り抜き、Grok向け6秒動画プロンプト、CapCut編集方針、途中動画に対する本人評価を確認しています。
PRIMARY SOURCE|非公開一次記録|制作画像
第4ページ1コマ目として、可児 波起が4コマ画像から実際に切り抜いてアップロードしたJPEGが会話内に残っています。ほかにも第1〜6ページの制作途中画像・4コマ画像が一次資料として記録されています。
確認範囲
このKnowledgeではGrok、CapCut、創作大賞2026の公式仕様・募集要項を根拠としていません。各サービス名は当時の制作工程に登場した名称として扱い、方式の評価は会話内の実地記録に限定しています。
Author
【著者】
可児波起
マーケティングデザイナー / DXコンサルタント / 音楽家
次に読む
文章段階の設計を見る
画像生成の前に「文章ネーム」を固定する――コマ割りと画像プロンプトを先に書く理由
4コマ静止画を作る前に、各コマの役割・視線・オチ・禁止事項を文章で決める工程へ戻る。
切り抜いた後の動画設計を見る
6秒を1秒ずつ設計し、「まだしないこと」まで書いた――AI動画に物語を先回りさせないプロンプト
一枚の静止画をGrokへ渡した後、6秒内部をどう制御したかを見る。
ショットの情報量を減らす
全部を同じカットに出すのをやめた――AI短編を「1カット1主役」へ変えた実例
このテーマをもっと見る
AI映像の生成尺、時間軸、ショット単位の情報設計を扱う。
上位カテゴリ
人間とAIの役割分担、漫画・映像・物語制作、作品のContinuityを、実制作のEvidenceから整理する。
すべてのテーマから探したい場合は、Knowledge一覧へ戻る。
