画像生成AIで同じ人物を出せるのはどれか|3モデルを同じ条件で比べました

読了目安 5分

「同じ人物を、違う場面でもう一度出したい」。画像生成AIを仕事で使おうとすると、ほぼ必ずここで詰まります。1枚目はうまくいくのに、2枚目で別人が出てくる。この記事では、参照画像を1枚だけ渡すという同じ条件で主要3モデルを実行し、どれが人物の造作を保てるのかを記録しました。

計測日は2026年8月28日、すべてOpenRouter経由です。以下の数値は提供元のカタログを引き写したものではなく、実際に実行して記録した値です。

結論:参照1枚で人物を保てたのは GPT Image 2 だけだった

モデル所要時間1枚あたり原価参照人物の同一性出力形式
GPT Image 2 (OpenAI)約24秒約 $0.019保てたPNG
Nano Banana 2 (Google)約11秒$0.068条件つきで保てたJPEG
Seedream 5.0 Lite (ByteDance Seed)約41秒$0.035(固定)保てなかったJPEG
2026-08-28実測。参照画像1枚、同一プロンプト、OpenRouter経由。

GPT Image 2 は、参照画像1枚から、角度・表情・服装を変えてもほくろの位置まで保持しました。所要時間は3回の実行で22.1秒・25.0秒・25.7秒、原価は $0.0174〜0.0229 の範囲です。3モデルの中で唯一、人物を指名する用途に耐えました。

Seedream 5.0 Lite は、参照画像を渡しても別人が出てきました。作風や雰囲気の再現はできるので、人物を伴わない題材には向きます。ただし「この人を出したい」という用途では選択肢になりません。

ユイ

参照って、たくさん渡したほうが似るんじゃないんですか?

サキ

増やすと特徴が平均化されていきます。顔がはっきり写った1枚のほうが安定しました。

速いモデルは1回に1枚しか出せない

Nano Banana 2 は約11秒で返ります。GPT Image 2 の半分以下です。何度も作り直して詰めていく作業では、この差がそのまま作業時間の差になります。

ただし1回の実行で出せるのは1枚だけです。GPT Image 2 は1〜10枚を一度に出せるので、「5枚出して一番いいものを選ぶ」という進め方ができます。同じ試行回数をこなすなら、実時間の差は見た目ほど開きません。

GPT Image 2Nano Banana 2Seedream 5.0 Lite
1回の生成枚数1〜10枚1枚のみ1〜4枚
参照画像の上限16枚14枚14枚
解像度の指定非対応512 / 1K / 2K / 4K2K / 4K
アスペクト比9種10種18種
品質の指定auto / low / medium / high非対応非対応
2026-08-28実測。提供元が実際に受け付けたパラメータ。

角度を指定したいなら Nano Banana 2

「30度から」「60度から」という角度の指定は、Nano Banana 2 では実際にその角度で出ました。GPT Image 2 は角度の細かい指定が効きにくく、指定しても正面寄りに寄っていきます。

逆に、複数コマに分割したレイアウトや、画像内に文字を入れる指図は Nano Banana 2 では崩れます。ここは GPT Image 2 のほうが素直に従いました。得意分野が逆なので、用途で選び分けるのが正解です。

同じ人物を出すためにやったこと

  • 参照画像は、顔がはっきり写っていて、明暗差の少ない1枚を選ぶ
  • 参照を増やすより、良い1枚を渡すほうが結果が安定した
  • 変えたい要素(服装・場所・時間帯)だけを文章で指定し、顔の描写は書かない
  • 顔を文章で描写すると、参照画像より文章が優先されて別人に寄っていく
  • 枚数を出せるモデルでは、1回1枚ではなく複数枚出して選ぶ

特に4番目が効きました。「切れ長の目で」「鼻筋の通った」といった顔の描写を足すほど、参照画像から離れていきます。参照画像を渡しているなら、顔については何も書かないほうが保ちます。

ブラック先輩

顔の描写を消すだけでかなり変わる。参照を渡したなら顔のことは書くな。

どれを選ぶか

  • 同じ人物を別の場面に出したい → GPT Image 2
  • 角度を指定したい、何度も作り直したい → Nano Banana 2
  • 人物を含まない題材で、1枚あたりの原価を固定したい → Seedream 5.0 Lite

よくある質問

参照画像は何枚渡すのが良いですか?
実測では、参照を増やすより顔がはっきり写った良い1枚を渡すほうが安定しました。上限は GPT Image 2 が16枚、Nano Banana 2 と Seedream 5.0 Lite が14枚です。
同じ人物を出すのに LoRA の学習は必要ですか?
参照画像1枚で造作を保てるモデルがあるため、同一性の確保だけが目的なら学習は必須ではありません。判断材料は「LoRAを作る前に読む記事」にまとめています。
なぜ別人が出てくるのですか?
参照画像を受け付けても、それを構図や雰囲気の参考としてしか使わないモデルがあるためです。Seedream 5.0 Lite は参照を渡しても別人になりました。モデル側の性質なので、プロンプトでは解決しません。
この記事を書いた人unsketch 編集部

生成モデルを同じ条件で動かして、かかる時間と料金、出力の癖を記録しています。載せている数字はすべて自分たちで計測したものです。