本文へ移動
BenriWorks Lab

ガイド公開日

画像生成AIで、同じキャラクターを記事ごとに描き続ける方法

この記事で分かること

画像生成AIでキャラクターを描くと、毎回少しずつ顔や服が変わります。BenriWorksが案内役の2人を39枚の場面画で描き続けてきたやり方を、設定表、参照画像、共通のスタイル指定、構図の決まり、生成後の確認に分けてまとめます

淡い色のキャラクターのスケッチを貼ったボードの前で、ペンタブレットを使いながらこちらを向いてほほえむ女性のイラストレーター
目次 読みたいところから

画像生成AIでキャラクターを描くと、1枚目はうまくいきます。困るのは2枚目からで、髪の長さや服の色、眼鏡の形が少しずつ変わり、並べると別人に見えてきます。BenriWorksのブログには、記事の途中に案内役のキャラクターが登場するバナーがあり、女性と男性の2人を、これまでに39枚の場面画で描いてきました。同じ人物に見えるように続けてきたやり方を、準備するものの順にまとめます。

顔が変わる理由

文章で「肩までの濃い茶色の髪、細いフレームの眼鏡」と指定しても、その説明に当てはまる顔は無数にあります。画像生成AIは、そのたびに説明に合う1つを選び直すので、説明が同じでも毎回違う顔になります。説明をいくら細かくしても、言葉で絞れる範囲には限りがあります。

そこで、言葉だけで描かせるのをやめ、見た目そのものを画像で渡すことにしました。

1. 設定を表にする

最初に、キャラクターの見た目を表にしました。

女性エンジニア男性エンジニア
年齢の印象20代後半30代前半
肩までの濃い茶色、前髪は自然に流す短く整えた黒髪、サイドに流す前髪
眼鏡かける(細いフレーム)かけない
服装ライトブルーの作業シャツ(袖まくり)、白Tシャツ、ネックストラップのIDカードチャコールグレーの作業ジャケット、白シャツ、IDカード、黄色のヘルメット
担当分野の目安子育て、生活、ビジネス資料、学習電気工事、通信、建設安全、受変電設備

見分けの手がかりになる違いは、はっきり書き分けています。2人の場合は眼鏡の有無で、男性の欄にも「かけない」と明記しました。担当分野を決めておくと、記事ごとにどちらを出すかで迷いません。1記事に登場するのは1人だけで、途中で入れ替えないことも決めています。

2. 設定画と参照画像を作り、毎回渡す

表をもとに、正面の全身、説明するポーズ、顔の近くの3つを並べた設定画を作りました。

案内役の女性エンジニアの設定画。肩までの濃い茶色の髪に細いフレームの眼鏡をかけ、袖をまくったライトブルーの作業シャツと白いTシャツ、首から下げたIDカードという服装で、正面の全身、指をさして説明するポーズ、顔の近くの3つを並べている
女性の案内役の設定画。正面の全身、説明するポーズ、顔の近くを並べた

この設定画から説明のポーズと顔の2つを切り出したものが、参照画像です。新しい場面を描くときは、場面の説明といっしょに、必ずこの参照画像を渡します。BenriWorksの生成スクリプトは、GoogleのGemini APIの画像生成モデル(既定は gemini-2.5-flash-image)を呼び、--ref で指定した画像を文章の前に添えて送ります。設定を記録した文書には、参照画像を渡さないと顔と服装が変わる、と書いてあります。

3. 画風と背景を、固定の文で指定する

見た目が同じでも、画風が変わると別の絵に見えます。そこで、場面の説明の後ろに、毎回まったく同じ英文を付けています。内容は次のとおりです。

  • 参照画像の顔、髪型、服装、画風に正確に合わせる
  • 清潔感のある現代的な日本のアニメ調、柔らかいセルシェーディング、細めの線
  • 背景はごく淡いグレーブルーの無地
  • キャラクターと小物はすべて画面の右半分に置き、左半分は何もない背景にする
  • 小物には文字、数字、ラベル、ブランドのロゴを描かない
  • 吹き出し、文字、ロゴ、透かしを入れない

左半分を空けるのは、あとでバナーのコピーを重ねるためです。この英文は、設定を記録した文書に原文のまま残してあり、どの記事でも書き換えずに使います。

場面画を1枚描くときに毎回そろえて渡すものを示した図。設定表(髪、目、眼鏡の有無、服装、担当分野)、参照画像(設定画から切り出した2ポーズ)、共通のスタイル指定(画風、背景色、構図、文字とロゴの禁止)、場面の説明の4つを画像生成モデルに渡し、出てきた場面画を目で確かめてから使う。記事ごとに変えるのは場面の説明だけ
記事ごとに変えるのは、場面の説明だけ

記事ごとに変えるのは、場面の説明だけです。「仕様書を手に持って立っている」「カレンダーを指さしている」のように、持ち物とポーズを書きます。こうして描いた場面画を4枚並べると、次のようになります。

同じ女性の案内役を4つの場面で描いた場面画を2列2段に並べた画像。紙を両手で持って立つ場面、ペンを持って書類を見る場面、カレンダーを指さす場面、ホワイトボードを指し棒で示す場面で、どれも眼鏡、髪型、ライトブルーの作業シャツ、IDカードが同じで、画面の左半分は空いている
別々の記事のために描いた4枚。顔、髪型、服装、左半分の余白がそろっている

参照画像の指定が、実装されていなかった

このやり方の文書と道具が、1日だけ食い違っていたことがあります。設定表と参照画像、共通の英文をまとめた文書を作ったのは8月21日です。その文書は、生成スクリプトに参照画像を渡すことを前提に書かれていました。ところが翌日、開発記事11本の画像を作る作業でスクリプトを確かめると、参照画像を受け付ける引数がそもそも実装されていませんでした。その日のうちに --ref を実装し、文書の手順が道具の上でも通るようにしました。

手順の文書と道具の実装が食い違っていると、文書どおりに作業したつもりでも、参照画像が渡っていない可能性が残ります。文書を書いたら、その手順を道具で一度通してみるところまでが準備だと考えています。

生成後に見るところ

参照画像を渡しても、毎回思いどおりに描けるわけではありません。生成したら、次の点を目で確かめています。

  • 顔、髪型、眼鏡の有無、服装が設定表と合っているか
  • 指の本数や手の形が自然か
  • 小物に文字やロゴが描かれていないか
  • キャラクターと小物が右半分に収まり、左半分が空いているか

バナーにしてから気づくこともあります。コピーを重ねたところ、見出しの2行目がキャラクターの手元に重なっていたため、見出しを1行10文字前後に短くしたことがありました。文字の重ね方は「画像生成AIに日本語を描かせない。文字は後から重ねる」にまとめています。

案内役の女性が白紙のスケッチブックを開いて見せているバナー。「毎回、同じ顔で描けている?」「設定表と参照画像で描き続ける」というコピーが入っている

1枚目の前に決めておくこと

同じキャラクターを描き続けられるかどうかは、1枚目を描く前にほぼ決まります。見た目を表にし、設定画から参照画像を作り、画風と構図を固定の文にしておく。記事ごとに変えるものを場面の説明だけに絞れば、あとは毎回同じものを渡すだけです。これから描き始めるなら、まず設定表の「眼鏡」のような、2人を見分ける1行から書いてみてください。

READ NEXT

次はこれを読む

この記事とあわせて読みたい記録

画像生成AIに日本語を描かせない。文字は後から重ねる

画像生成AIに日本語を描かせると、崩れた字や存在しない字が混ざります。BenriWorksは生成する画像に文字を一切描かせず、ロゴ、見出し、バナーのコピーを後から重ねています。指定の書き方、重ねる3か所、生成後に作り直した画像の数をまとめます

続きを読む →
大きなモニターに余白の多いレイアウトを映し、スタイラスを持ってこちらを向く男性のデザイナー

よくある質問

画像生成AIで、キャラクターの顔が毎回変わるのを防ぐには
文章の説明だけで描かせず、設定画から切り出した参照画像を毎回いっしょに渡します。BenriWorksでは、設定表と参照画像と共通のスタイル指定を固定し、記事ごとに変えるのは場面の説明だけにしています。
キャラクターの設定表には何を書けばよいですか
髪型と髪色、目、眼鏡の有無、服装、持ち物、担当する分野などです。見分けの手がかりになる違い(BenriWorksでは眼鏡の有無)は、はっきり書き分けます。
参照画像を渡せば、それで十分ですか
十分ではありません。生成後に目で確かめ、指の本数、写り込んだ文字やロゴ、顔と服装が設定と合っているかを見ます。