実写真は「見た目の見本」じゃない|猫が人の手を包むポーズをAIへ伝えた方法

これは、画像生成AIに実写真を見せるとき、顔や毛色の見本としてではなく、「身体同士がどう関わっているか」を伝える資料として使った話です。
僕が実在の保護猫・日向との体験をもとに漫画を作ったとき、再現したかったのは、日向が僕の手を包む珍しい仕草でした。
ところが文章で「猫が人間の手を優しく包む」と書くだけでは、よくある「人間が猫を抱く」構図へ変わってしまうことがあります。
この場面では、誰が抱く側で、誰が受け身なのかが逆になると、物語の意味まで変わります。
そこで僕たちは、実際の日向の写真を「見た目の見本」ではなく、「ポーズと関係性の辞書」として使いました。
大事だったのは、猫の顔より「手の位置」だった
追加した実写真には、日向が僕の手を前足で抱え、胸やお腹へ引き寄せる様子が写っていました。
指を口元へ寄せる動きもあります。
この写真から欲しかった情報は、毛色や顔だけではありません。
前足が手のどこへ乗っているか。
人間の手がどの角度で置かれているか。
胸やお腹がどこまで接触しているか。
誰が力をかけ、誰が力を抜いているか。
身体関係そのものを読み取る必要がありました。
「猫が人間の手を包む」という力の向きを固定する
この場面の核は、人間が保護猫を抱いて安心させることではありません。
警戒していた日向の方が先に無防備になり、僕の手を包んだことです。
だからプロンプトでも、「人間が猫を抱く」ではなく、
猫が人間の手を包む。人間側は受け身。前足で抱え込む。
という関係を明示しました。
この「力の向き」が変わると、同じ猫と同じ手が描かれていても、物語は別物になります。
実写真を、そのままコピーする必要はない
写真を参照すると聞くと、背景や服、光、画角まで再現するイメージがあります。
でも今回の目的は、写真のコピーではありませんでした。
必要なのは、前足、手、胸、お腹、口元の位置関係。
背景は漫画の世界へ変えていい。服も同じでなくていい。
実写真から関係だけを抽出し、作品側のトーンへ移します。
だから僕は、実写真を「完成見本」より「辞書」に近いものとして考えています。
写真はポーズ資料であり、Evidenceでもある
この実写真には、もう一つ役割がありました。
日向が本当に人間の手を包んでいた、という一次的な制作Evidenceです。
もちろん、写真一枚だけでそのときの日向の心理や、出来事の因果まで証明できるわけではありません。
でも、少なくとも「この身体関係は創作上の架空ポーズではない」と確認できます。
ノンフィクション漫画では、この違いはかなり大きいです。
最後のコマで離れたとき、関係性を戻した
実際の制作では、ページ17の最後のコマだけ、僕と日向が離れた画像になったことがありました。
僕はそこで、「最後の僕の手を包んでいる、日向の絵に変えてください」と修正しました。
同じ猫が描かれていればいいわけではありません。
そのページで維持したい「関係」が続いていることが重要でした。
改善率は測っていない
文章だけの指示と、実写真を追加した場合で、成功率や再生成回数を定量比較したわけではありません。
「写真を入れれば必ずポーズが正確になる」と一般化もできません。
確認できるのは、実写真を追加したあと、身体関係を具体的に分解してプロンプトへ戻す方法を実際に採用したことです。
まとめ
実写真は、AIへ「この顔にして」と伝えるだけの資料ではありません。
前足はどこにあるか。
手はどちらを向いているか。
誰が主体で、誰が受け身なのか。
珍しい仕草ほど、見た目より関係性を分解する。
僕らの漫画制作では、実写真がその身体関係を読み取る辞書になりました。




コメント