10/10 22:05 更新

直すたびに、
顔が変わっていく

――Googleが、そこを直したという

写真はイメージ Photo by Andrés Gómez on Unsplash

10/8 18:40 / 発信国:米国

Googleの新しい画像AI、点数が伸びたのは絵の美しさではなかった

画像生成AIに似顔絵を描かせたとする。「もう少し笑った顔で」と直しを頼む。次は「背景を夜にして」。3枚目が出てきて、手が止まる。笑っている顔が、最初の1枚とどこか違う。

米国のGoogleが2026年10月6日、画像生成AI「Nano Banana 2.1」を公開した。直したとして挙げた点のひとつが、まさにこの、会話を重ねたときの人物の一貫性だ。ほかに画質、指示どおりに描く力、画像の中の文字も挙げている。Gemini APIとGoogle AI Studioから使える。土台はGemini 3.6 Flashだ。

米メディアのDecryptによると、Googleは告知で、見た目のデザイン、マスクを使った編集、被写体の一貫性の3つを進歩として挙げたという。マスクを使った編集は、直したい部分だけを選んで書き直させるやり方だ。

値段も下がった。公式の料金表では、標準の1K画像が1枚0.0336ドル。前のモデルは1枚0.067ドルだから、半分ほどになった。1ドル150円なら、1枚5円だ。参照画像は、1回に14枚まで渡せる。

いちばん伸びたのは、絵の美しさではなかった

ここが、この発表の面白いところ。Googleはモデルカードに、自分で測った点数を載せている。

どちらの画像が好まれるかを比べた全体の点数は、前のモデルの990から1050へ。60上がった。一方、複数の人物を保ったまま直す項目は、978から1106へ。128上がっている。伸びは倍以上だ。図や説明画像に書かれた内容の正しさも、0.179から0.521へ、3倍近くになった。

では、なぜそこが伸びたのか。公開された文書に、作り方の説明はない。点数と、できること・できないことが並んでいるだけだ。

一発で人を驚かせる絵より、直しを重ねても崩れないこと。点数の並びを見るかぎり、競争の場所はそちらへ動いているように見える。筆者の見方だ。

できないことも、自分で書いている

では、もう何度でも安心して直せるのか。そうとは言えない。同じモデルカードに、苦手なことも並んでいる。

ノートパソコンで画像を編集している画面
写真はイメージ Photo by Ben Kolde on Unsplash

小さい文字は、1K画像だとぼやけやすい。長い段落や、ページ1枚ぶんの文字も苦手。入力した画像と出てきた画像で、人物が完全に同じになるとは限らない。左右の向きを取り違えることもあるという。

もうひとつ。まれに被写体のポーズが変わらない、とも書かれている。直してほしいのに、動いてくれないという失敗だ。

機能のほうにも、できないことがある。公式のドキュメントによると、ウェブ検索の結果を見ながら作る機能とThinkingは使えるが、関数の呼び出しやURLの読み込みには対応しない。入力は文字と画像のほか、動画やPDFも受け付ける。

そして、ここまでの点数は、どれもGoogleが自分で測ったもの。米メディアのDecryptも、性能の主張はGoogleの自社テストによるものだと書いている。

安く、何度でも直せる道具にはなった。ただモデルカードには、人物が完全に同じになるとは限らない、と作った側自身が書いている。3枚目でも同じ顔が返ってくる保証は、付いていない。

この話、あなたはどっち? →

出典

よく読まれている記事

こちらの記事も

← 一覧へ戻る