AI研究検索・リサーチ確認済み

arXiv論文:最大10人の顔を保って集合画像を生成——WithEveryone、指定人物の97.3%を再現

人物ごとの顔と配置を先に計画することで、最大10人の参照人物を1枚に描き分ける画像生成手法を提案しました。

  • 2026-08-21
  • 最終確認日 2026-08-21
自分にどう関係する?

複数の人物やキャラクターを、顔の混同や重複を減らして1枚に配置する画像制作へつながる研究です。

ニュースをやさしく解説

結論から言うと、最大10人の参照人物を、顔の特徴と立ち位置を保ちながら1枚の集合画像に描く手法「WithEveryone」が提案されました。2026年8月21日(日本時間)にarXivで公開された未査読プレプリントです。複数人を指定する画像生成では、人数が増えるほど顔が混ざる、同じ人物が重複する、参照画像をそのまま貼ったようになる問題がありました。

この手法は各人物を個別に指定できるトークンとして入力し、誰をどこに置くかという構造化された配置計画を先に作り、それを画像生成の条件にします。学習時には顔領域の注釈を使い、狙った位置と人物を直接対応させます。学習に含まれない人物で評価したところ、顔の類似度はGPT-Image-2の0.462に対して0.499、コピー貼り付けのような不自然さは0.169から0.055になりました。

要求した人物の97.3%を画像に含め、重複率は2.8%だったと報告しています。家族写真風の創作や、複数キャラクターの広告案を作る技術につながり得ます。ただし一般向けサービスではなく研究段階で、コードは今後公開予定です。顔画像の利用許諾、本人になりすます画像、評価指標と人の見た印象の差にも注意が必要です。

PR

AIをもっと深く学べる本

ニュースに出てきたAIやカテゴリに近い教材を優先しています。

広告(アフィリエイト)リンクを含みます。最新の内容・料金・在庫・条件は、リンク先の公式ページ・販売ページでご確認ください。

広告

source

出典

提供状況や価格は変わるため、最終判断は公式情報で確認します。

arXiv(未査読プレプリント)を開く