Google · model directory
Nano Bananaとは何か — Googleの画像編集モデルの概要
Nano Bananaは、GoogleのGemini画像モデルの愛称です。会話での編集に最適化され、変更を加えても被写体(とくに顔)の同一性を保ちます。
Nano Banana at a glance
- 開発元
- ファミリー
- Gemini
- 利用方法
- GeminiアプリとAPI
- 特長
- 被写体の一貫性を保つ編集
- 重み
- 非公開
- インターフェース
- 会話型
名前の由来
もともと製品名ではありません。匿名で出品される公開のモデル比較アリーナ(どのシステムか伏せたまま出力を比較する場)に、プレースホルダー名の“nano banana”で現れました。勝ちを重ねて注目され、しばらく“中の人は誰か”という噂が続いたあと、Googleが正体を明かしました。
その後Googleは異例ながらニックネームを残しました。結果として、実務用のしっかりした基盤が、冗談のような名で広く知られています。正式にはGeminiの画像モデルですが、検索されるのは“banana”のほうです。
この経緯は検索行動の“癖”を説明します。マーケティングより先に関心が来たため、人々が投げる問いは製品への問いではなく噂への問い—何なのか、誰が作ったのか、本物なのか—になったのです。
実際にどこが違うのか
多くの画像モデルは“説明から画像を生成する”ことを中心に設計されています。Nano Bananaは“手元の画像を変更する”ことが中心で、難しいのは“頼んでいない部分を変えない”ことです。
汎用モデルに「この写真の人に赤いコートを着せて」と頼むと、たいてい“赤いコートの人物”は出ますが、顎の形や目の間隔がわずかに違い、“同じ人”ではなく“似た人”になります。1回目は持ちこたえても、編集を重ねると同一性は崩れがちです。Nano Bananaが掴んで離さないのは、その“同一の顔”を連続する指示のあいだずっと保つことです。
やり取りの型もそこから決まります。長いpromptを一発で書いて戻りを受け入れるのではなく、毎ターン前回結果を少しずつ調整していきます。光を動かす。次は夕方に。次は屋外に。—この反復自体が製品です。
実務で得意なこと
“同じ被写体が複数回登場する”用途全般に向きます。複数のシーンでのプロダクト写真、連番のコマにわたるキャラクター、1枚のポートレートのバリエーション、1室を4配色で見せるモックアップなど。
また、promptの書式を学びたくない方にも寛容です。仕様書ではなく“編集指示”なので平文で通じ、あいまいな指示でも“全体が別物になる”のではなく“小さな変更”に収まります。
苦手なのは白紙からの生成です。元画像も保持すべき被写体も無い状況では、一貫性の仕組みは働きません。テキストからの構図・光学・作風の制御は、最初から“生成”に最適化されたモデルのほうが有利です。
他の選択肢との関係
Midjourneyとの比較では“作家性”が分水嶺です。Midjourneyは強いハウススタイルを適用し、何か“映えるもの”を作る用途が中心。Nano Bananaは“頼んだ場所以外は極力そのまま”を目指します。前者はスタイリスト、後者はレタッチャーです。
オープン系(Stable DiffusionやFLUX)との比較では“制御の所在”が違います。オープンな重みは、ControlNetやLoRA、inpaintingのパイプラインを組み合わせ、手間の代わりに精密な制御を得られます。Nano Bananaはその一部を“1文の指示”の裏側に畳み、到達は速いが限界も超えにくい設計です。
gpt-image-1との比較では、どちらもクローズドで“指示に従う会話型”、大きなアシスタントに接続された点で近い存在です。実務での差としてよく語られるのは“複数ターンでどちらが顔を保てるか”で、リーダーボードを鵜呑みにせず自分の素材で試す価値があります。
LaFotoとの関係
商用関係はありません—当社はGoogleと提携しておらず、そのモデルの再販も行っていません。このページは“それは何か”という質問に短く正直に答えるため、そして“好きなモデルだけ載せる”目録にしないために存在します。
本サイトの編集系ページとあわせて読むことをおすすめします。語彙が共通だからです。Nano Bananaが会話で行うことは、オープンな生態系では名前のついた手法で行います。マスク内を変えるのがinpainting、枠外を広げるのがoutpainting、元画像からの乖離許容量がdenoise強度。これらの語を知ると、どのエディターが“何をしていて何をしていないか”がはっきり見えます。
編集か、生成か
解決するために作られた課題
人物写真の一部だけを変えたい、と汎用の画像モデルに頼むと、返ってくるのは「ほぼ同じ別人」になりがちです。顎の位置がずれ、目の座りが変わり、家族の誰かに見える——同一人物には見えない。単発の編集なら耐えますが、連続して4回は保てません。
依頼どおりに変えつつも、人物の同一性だけは固定する——これは固有のエンジニアリング課題であり、このモデルが正面から取り組む対象です。その集中ゆえ、生成もできますが性格としては「エディター(編集器)」と説明しています。

実際に使われている3つの用途
複数画像での一貫性が要件のとき
同じ被写体を6つの背景で
一度撮った製品を、キッチンカウンター、カフェテーブル、屋外ベンチ、スタジオ背景へと置き換えても、常に同じ製品だと識別できること。
ジェネレーターに「同じ製品」を6回頼むと、似た別物が6個返ってきます。この差が、編集モデルを使う商業的な理由のすべてです。
- 一度の撮影で、多場所へ配置。
- シーンが変わっても被写体は同一であること。
- 出力ごとにラベルとロゴを確認してください。

連続しても人物が破綻しない仕事
コミック、絵コンテ、解説シーケンス、児童書——どれも5コマ目でキャラクターが別人化して破綻します。
オープンなエコシステムではLoRAの学習でこのケースを解きます。対話型エディターは学習なしで近い地点に到達しますが、制御精度はやや落ちます。
- 学習ステップは不要。
- 長尺では少しずつドリフトが蓄積。
- 定期的に元画像でリセットしてください。

手元の写真から選択肢を増やす
1枚のポートレートを、複数のライティング・背景・衣装に展開して、スタジオを再手配せずにクライアントへ選択肢を提示します。
正直な限界として、どのバリエーションも現実の被写体の写真ではありません。もっともらしい代案です。ムードボードには有用ですが、記録写真には不適です。
- リサーチ用途なら再撮より速い。
- 本番撮影の代替にはなりません。
- 身分証用途には使用不可。

Nano Bananaのよくある質問
初回のセッション後に出てくる疑問
物珍しさが落ち着いた頃に出る話題です。
なぜ最終的に顔がドリフトするのですか?
各編集は元画像ではなく直前の結果に条件付けられるため、小さな誤差が累積します。数ターンごとに元画像を再投入して参照をリセットすると、ゆるやかな崩れを防げます。
同じ結果を2回得られますか?
高い再現性は期待できません。対話型編集は、オープンなパイプラインのようにseedを公開していません。シンプルな操作性と引き換えの一般的なトレードです。
inpaintingより優れていますか?
操作は容易です。明示的なマスクを使うinpaintingは、どのピクセルを変更してよいかを厳密に制御できます。文章での指示は、その判断をモデルに委ねます。精密作業にはマスクが依然として有利です。
参照画像を複数使えますか?
参照の合成はよくある要望で、対応はUIやバージョンによって異なります。第三者の説明に頼らず、ご自身の素材で検証してください。
苦手分野は何ですか?
ゼロからの生成です。元画像がないと、一貫性を保つ仕組みが機能しません。text-to-imageに特化したモデルの方が、画角や光学の制御が利きます。
人物以外でも機能しますか?
はい。しかも安定することが多いです。製品や建物は、顔ほど凝視される細部が少ないためです。

さらに探る
LaFotoのほかのページへ
編集は仕事の一部です。他にもあります。
Nano Banana — questions people ask
- Nano Bananaとは?
- GoogleのGemini系の画像生成・編集モデルに付いた愛称で、現在は公式にも使われています。会話型の編集で、連続する変更のあいだも被写体の同一性を保つ設計です。
- Nano Bananaを作ったのは?
- Googleです。Geminiファミリーに属します。
- なぜNano Bananaという名前なのですか?
- 匿名のモデル比較アリーナにプレースホルダー名で現れ、非常に好成績を収めたため名が定着しました。Googleはそれに抗わず採用しました。
- Nano Bananaはオープンソースですか?
- いいえ。重みは非公開で、利用はGoogleのアプリおよびAPI経由です。
- Nano Bananaが最も得意なことは?
- 既存画像の編集で被写体の同一性を保つことです。多くのモデルが1〜2回で崩しがちな“同じ顔”を、連続する変更のあいだ維持します。
- Nano BananaはMidjourneyより優れていますか?
- 用途が異なります。Midjourneyは無から“映える”画像を作る強い美学を持ち、Nano Bananaは頼んだ部分だけを変え、実在の写真の残りを極力そのままにします。
- Nano Bananaはテキストだけから画像を生成できますか?
- 可能ですが強みではありません。真価は“編集で被写体を保つこと”にあり、そのためには保持すべき元画像が必要です。
- LaFotoはNano Bananaを使っていますか?
- いいえ。Googleとの関係もありません。本ページは当社のモデルディレクトリ内のリファレンスです。
今日から作り始める
最高のAI画像ジェネレーターで最初の一枚を。
一文から数秒でフォトリアルな画像を生成し、細部まで洗練。セットアップ不要、Discord不要、GPU不要。
4,200+名のクリエイターがLaFotoを利用中