Săriți la conținut
LaFoto

Google · model directory

Ce este Nano Banana? Modelul de editare a imaginilor de la Google, explicat

Nano Banana este porecla modelului de imagini Gemini de la Google, creat pentru editare conversațională care păstrează același subiect între modificări.

Nano Banana este porecla pentru modelul Gemini de generare și editare de imagini de la Google. Trăsătura distinctivă este editarea conversațională: furnizați o imagine, descrieți în limbaj obișnuit ce schimbare doriți, iar modelul o aplică păstrând restul cadrului — mai ales chipul unei persoane — recognoscibil același. Numele a fost o etichetă venită din comunitate, pe care Google a adoptat-o ulterior.

Nano Banana at a glance

Producător
Google
Familie
Gemini
Acces
Aplicația Gemini și API
Cunoscut mai ales pentru
Editare cu consistență de personaj
Greutăți
Închise
Interfață
Conversațională

De unde a venit numele

Nu a fost un nume de produs. Un model neetichetat a apărut în arene publice de evaluare în confruntări directe, unde oamenii compară rezultate anonime fără să știe ce sistem le-a produs, sub un nume de rezervă „nano banana”. A câștigat des, lumea a observat, iar speculațiile despre cine era în spate au continuat săptămâni până când Google a confirmat.

Apoi Google a făcut ceva neobișnuit și a păstrat porecla, motiv pentru care o piesă serioasă de infrastructură e cunoscută public sub un nume glumeț. Identitatea formală este un model de imagini Gemini; numele căutat este banana.

Istoria aceasta merită știută pentru că explică de ce termenul se comportă ciudat în căutări. Interesul a apărut înaintea oricărui marketing, așa că întrebările oamenilor sunt cele pe care le pui despre un zvon — ce este, cine l-a făcut, dacă este real — mai degrabă decât întrebările pe care le pui despre un produs.

Ce face de fapt diferit

Majoritatea modelelor de imagini sunt construite pentru a genera o poză dintr-o descriere. Nano Banana este construit pentru a schimba o poză pe care o aveți deja, iar partea grea este tot ceea ce nu i-ați cerut să schimbe.

Dacă rugați un model generalist să pună persoana din această fotografie într-un palton roșu, de obicei veți obține o persoană în palton roșu care nu mai e chiar aceeași — o linie a maxilarului puțin diferită, altă distanță între ochi, o față care pare a unei rude. Identitatea trece printr-o editare, dar se degradează peste mai multe. Lucrul pe care Nano Banana este construit să-l păstreze este acea identitate, pe parcursul unei serii de instrucțiuni succesive.

Modelul de interacțiune decurge din asta. Nu scrieți un singur prompt elaborat și acceptați ce vine înapoi; purtați o conversație în care fiecare tur ajustează rezultatul anterior. Mutați lumina. Acum faceți seară. Acum puneți-l afară. Bucla aceea este produsul.

La ce este bun, în practică

La orice situație în care același subiect trebuie să apară de mai multe ori. Fotografii de produs în mai multe decoruri, un personaj de-a lungul unui șir de panouri, un set de variații pe același portret, un mock-up care trebuie să arate aceeași cameră în patru scheme de culoare.

Este, de asemenea, neobișnuit de iertător pentru cei care nu vor să învețe sintaxa de prompt. Pentru că instrucțiunea este o editare, nu o specificație, propozițiile simple funcționează, iar modul în care eșuează o cerere vagă este o schimbare mică, nu o imagine nerecognoscibilă.

Unde se potrivește mai puțin este cazul „foaia albă”. Când nu există o imagine-sursă și niciun subiect de păstrat, mecanismul de consistență nu are ce face, iar modelele construite pentru compoziție text-la-imagine tind să ofere mai mult control asupra încadrării, opticii și stilului când porniți de la zero.

Cum se poziționează față de alternative

În raport cu Midjourney, linia de demarcație este autoratul estetic. Midjourney aplică un stil propriu puternic și este folosit în general ca să creeze ceva spectaculos; Nano Banana încearcă să lase fotografia neschimbată în afara cererii dumneavoastră. Unul este stilist, celălalt este retușor.

Față de modelele deschise — Stable Diffusion și FLUX — diferența este unde locuiește controlul. Greutățile deschise le permit oamenilor să adauge ControlNet, LoRA și fluxuri de inpainting pentru control fin, cu prețul asamblării întregului pipeline. Nano Banana pune o felie mai îngustă din acel control în spatele unei propoziții, lucru mai rapid de atins și mai greu de depășit.

Față de gpt-image-1, cele două sunt mai apropiate între ele decât de orice altceva: ambele sunt închise, urmăresc instrucțiuni și sunt conduse conversațional, atașate unui asistent mare. Diferența practică raportată de cei mai mulți este care dintre ele păstrează mai bine o față peste mai multe ture, iar asta merită testată pe materialul propriu, nu luată dintr-un clasament.

Ce legătură are asta cu LaFoto

Niciuna comercială — nu suntem afiliați cu Google și nu revindem modelele sale. Această pagină există pentru că oamenii întreabă ce este „chestia” și răspunsul onest este scurt, iar un director care ar descrie doar modelele care ne plac nouă n-ar mai fi un director.

Merită citită alături de paginile de editare de aici, pentru că vocabularul se transferă. Ce face Nano Banana conversațional, ecosistemul deschis face cu tehnici denumite: inpainting pentru o schimbare într-o mască, outpainting pentru o schimbare dincolo de cadru, denoise strength pentru cât de mult i se permite rezultatului să se îndepărteze de sursă. Cunoașterea acestor cuvinte face mult mai clar ce face și ce nu face orice editor.

Editare versus generare

Problema pentru care a fost construit

Dacă cereți oricărui model generalist de imagini să schimbe un singur lucru într-o fotografie cu o persoană, de obicei primiți înapoi o persoană aproape corectă. Linia mandibulei s-a mutat, ochii stau altfel, chipul pare o rudă, nu același individ. O singură editare supraviețuiește; patru la rând, nu.

A păstra identitatea constantă în timp ce tot ce solicitați se schimbă este o problemă de inginerie specifică, iar acesta este exact obiectivul acestui model. De aici și motivul pentru care este descris drept editor, nu generator, chiar dacă le poate face pe ambele.

Aceeași fotografie portret tipărită de patru ori, cu iluminare diferită pe fiecare print

Trei utilizări reale

Când coerența între imagini este obligatorie

Același obiect în șase decoruri

Un produs fotografiat o dată, apoi plasat pe un blat de bucătărie, o masă de cafenea, o bancă în aer liber și un fundal de studio, rămânând vizibil același obiect peste tot.

Un generator căruia îi cereți același produs de șase ori returnează șase produse similare. Acea diferență este întreaga logică comercială pentru un model de editare.

  • Fotografiați o dată, plasați de multe ori.
  • Obiectul trebuie să supraviețuiască schimbării scenei.
  • Verificați eticheta și logo-ul în fiecare ieșire.
O scenă de produs editată cu AI, cu fundal înlocuit

Întrebări despre Nano Banana

Ce se întreabă după prima sesiune

Lucrurile care apar după ce trece noutatea.

De ce tot deviază chipul până la urmă?

Fiecare editare este condiționată de rezultatul anterior, nu de original, astfel că erorile mici se compun. Reîncărcarea imaginii-sursă la câteva iterații resetează referința și oprește alunecarea lentă.

Pot obține același rezultat de două ori?

Nu în mod fiabil. Editarea conversațională nu expune un seed așa cum o face un lanț deschis, acesta fiind compromisul general pentru o interfață atât de simplă.

Este mai bun decât inpainting-ul?

Este mai ușor. Inpainting-ul cu mască explicită vă dă control exact asupra pixelilor care se pot schimba; o propoziție lasă acea judecată la model. Pentru lucrări de precizie, masca rămâne necesară.

Poate lucra din mai mult de o imagine de referință?

Combinarea referințelor este o cerere frecventă, iar suportul variază în funcție de interfață și versiune. Testați pe materialul propriu, nu vă bazați pe descrieri terțe.

La ce se descurcă prost?

Pornirea de la zero. Fără o imagine sursă, mecanismul de consistență nu are ce conserva, iar modelele construite pentru compoziție text-la-imagine oferă mai mult control asupra încadrării și opticii.

Funcționează și pe subiecte non-umane?

Da, și adesea mai fiabil — un produs sau o clădire are mai puține trăsături pe care privitorul le scrutează decât are o față umană.

Un portret de studio generat de AI cu iluminare moale, învăluitoare

Continuați explorarea

În alte secțiuni LaFoto

Editarea e un job. Acestea sunt celelalte.

Nano Banana — questions people ask

Ce este Nano Banana?
Este porecla, folosită acum oficial, pentru modelul Gemini de generare și editare de imagini al Google. Este construit pentru editare conversațională care păstrează același subiect de-a lungul mai multor schimbări succesive.
Cine a făcut Nano Banana?
Google. Face parte din familia Gemini.
De ce se numește Nano Banana?
A apărut anonim în arene publice de comparare a modelelor sub acel nume provizoriu, a avut rezultate remarcabile, iar eticheta a rămas. Google a adoptat-o în loc să lupte împotriva ei.
Este Nano Banana open source?
Nu. Greutățile sunt închise, iar accesul se face prin aplicația și API-ul Google.
La ce este Nano Banana cel mai bun?
La editarea unei imagini existente păstrând subiectul recognoscibil — același chip peste mai multe schimbări succesive, pe care majoritatea modelelor de imagini îl pierd după una-două.
Este Nano Banana mai bun decât Midjourney?
Fac lucruri diferite. Midjourney impune un estetic puternic și este folosit pentru a crea imagini spectaculoase din nimic; Nano Banana încearcă să modifice doar ce ați cerut și să lase restul unei fotografii reale neatins.
Poate Nano Banana să genereze imagini doar din text?
Da, dar nu acolo stă avantajul său. Capacitatea sa distinctivă este păstrarea unui subiect prin editări, ceea ce cere o imagine-sursă de păstrat.
Folosește LaFoto Nano Banana?
Nu, și nu avem nicio afiliere cu Google. Această pagină este material de referință în directorul nostru de modele.

Începeți să creați astăzi

Generați prima imagine cu cel mai bun generator de imagini AI.

Transformați o propoziție într-o imagine finală, fotorealistă, în câteva secunde — apoi rafinați fiecare detaliu. Fără configurare, fără Discord, fără GPU.

Alăturați-vă celor 4.200+ creatori care folosesc LaFoto