Google · model directory
Apa itu Nano Banana? Model pengeditan gambar Google dijelaskan
Nano Banana adalah julukan untuk model gambar Gemini milik Google, dibuat untuk pengeditan percakapan yang menjaga konsistensi subjek di tengah perubahan.
Nano Banana at a glance
- Pengembang
- Keluarga
- Gemini
- Akses
- Aplikasi dan API Gemini
- Dikenal karena
- Edit konsisten pada karakter
- Bobot
- Tertutup
- Antarmuka
- Percakapan
Asal-usul namanya
Ini bukan nama produk. Sebuah model tanpa label muncul di arena evaluasi head-to-head publik, tempat orang membandingkan keluaran anonim tanpa tahu sistem mana yang membuatnya, dengan placeholder "nano banana". Ia sering menang, orang memperhatikan, dan tebakan siapa di baliknya berlangsung berminggu-minggu sebelum Google mengonfirmasi.
Google lalu melakukan hal yang tidak biasa: mempertahankan julukan itu, sehingga sebuah infrastruktur serius dikenal publik dengan nama bergurau. Identitas formalnya adalah model gambar Gemini; nama yang dicari orang adalah banana.
Sejarah itu penting karena menjelaskan kenapa istilah ini berperilaku aneh di pencarian. Minat datang sebelum pemasaran, jadi pertanyaan orang adalah pertanyaan tentang kabar burung — apa itu, siapa pembuatnya, benarkah — bukan pertanyaan tentang sebuah produk.
Apa yang sebenarnya dibuat berbeda
Sebagian besar model gambar dibangun untuk membuat gambar dari deskripsi. Nano Banana dibangun untuk mengubah gambar yang sudah ada, dan bagian tersulitnya adalah segala hal yang tidak Anda minta untuk diubah.
Minta model serbaguna memakaikan mantel merah pada orang di foto ini dan Anda biasanya mendapat orang bermantel merah yang bukan benar-benar orang yang sama — rahang sedikit berbeda, jarak mata berbeda, wajah terasa seperti saudaranya. Identitas bertahan satu edit dan menurun setelah beberapa kali. Hal yang dipegang erat oleh Nano Banana adalah identitas itu, melintasi serangkaian instruksi beruntun.
Model interaksinya mengikuti hal tersebut. Anda tidak menulis satu prompt rumit lalu menerima hasilnya; Anda berdialog, setiap giliran menyesuaikan hasil sebelumnya. Pindahkan cahaya. Sekarang jadikan sore. Sekarang taruh dia di luar. Siklus itu adalah produknya.
Kegunaan praktisnya
Apa pun yang menuntut subjek yang sama muncul lebih dari sekali. Fotografi produk di beberapa latar, karakter di rangkaian panel, satu set variasi dari satu potret, mock-up yang harus menampilkan satu ruangan dalam empat skema warna.
Ia juga lebih memaafkan bagi orang yang tidak ingin mempelajari sintaks prompt. Karena instruksinya berupa edit, bukan spesifikasi, kalimat biasa sudah bekerja, dan kegagalan dari permintaan yang kabur biasanya hanya perubahan kecil, bukan gambar yang tak dikenali.
Yang kurang cocok adalah kasus halaman kosong. Saat tidak ada gambar sumber dan tidak ada subjek yang harus dipertahankan, mesin konsistensi tidak punya pekerjaan, dan model yang dibangun untuk komposisi text-to-image cenderung memberi Anda kontrol lebih atas pembingkaian, optik, dan gaya dari awal.
Posisinya dibanding alternatif
Dibanding Midjourney, pembagiannya adalah otor estetik. Midjourney menerapkan gaya rumah yang kuat dan umumnya dipakai untuk membuat sesuatu yang mencolok; Nano Banana berusaha membiarkan gambar tetap apa adanya kecuali pada bagian yang Anda minta. Yang satu adalah penata gaya, yang lain peretoucher.
Dibanding model terbuka — Stable Diffusion dan FLUX — perbedaannya ada pada di mana kontrol berada. Bobot terbuka memungkinkan orang memasang ControlNet, LoRA, dan pipeline inpainting untuk kontrol presisi dengan biaya merangkai pipeline. Nano Banana menaruh irisan kontrol yang lebih sempit di balik sebuah kalimat, lebih cepat dijangkau dan lebih sulit dilampaui.
Dibanding gpt-image-1, keduanya lebih mirip satu sama lain daripada ke mana pun: sama-sama tertutup, patuh instruksi, digerakkan percakapan dan terhubung ke asisten besar. Perbedaan praktis yang sering dilaporkan adalah mana yang lebih baik mempertahankan wajah setelah beberapa putaran, dan itu sebaiknya diuji pada materi Anda sendiri alih-alih mengandalkan leaderboard.
Kaitannya dengan LaFoto
Tidak ada hubungan komersial — kami tidak berafiliasi dengan Google dan tidak menjual kembali modelnya. Halaman ini ada karena orang bertanya apa benda ini dan jawaban jujurnya singkat, dan direktori yang hanya menjelaskan model yang kebetulan kami sukai bukanlah direktori.
Patut dibaca berdampingan dengan halaman pengeditan di sini, karena kosakatanya saling pindah. Apa yang dilakukan Nano Banana lewat percakapan, ekosistem terbuka melakukannya dengan teknik bernama: inpainting untuk perubahan di dalam mask, outpainting untuk perubahan di luar bingkai, denoise strength untuk seberapa jauh hasil boleh menyimpang dari sumber. Mengetahui istilah itu membuat jauh lebih jelas apa yang dilakukan atau tidak dilakukan editor mana pun.
Mengedit versus menghasilkan
Masalah yang dirancang untuk dipecahkan
Minta model gambar serbaguna mengubah satu hal pada foto seseorang, hasilnya sering orang yang hampir mirip. Garis rahang bergeser, posisi mata berubah, wajah terasa seperti kerabat, bukan individu yang sama. Satu edit masih aman; empat berturut-turut biasanya tidak.
Menjaga identitas tetap konstan sementara semua yang Anda minta berubah adalah masalah rekayasa yang spesifik, dan inilah sasaran model ini. Fokus itu alasan ia disebut sebagai editor, bukan generator, meski bisa keduanya.

Tiga penggunaan nyatanya
Saat konsistensi antar gambar menjadi syarat
Objek yang sama di enam latar
Satu produk difoto sekali, lalu ditempatkan di meja dapur, meja kafe, bangku luar ruangan, dan latar studio, tetap terbaca sebagai objek yang sama sepanjangnya.
Generator yang diminta membuat produk yang sama enam kali akan mengembalikan enam produk yang mirip. Perbedaan itu adalah seluruh argumen komersial untuk model pengeditan.
- Sekali pemotretan, banyak penempatan.
- Objek harus bertahan saat latar berganti.
- Periksa label dan logo pada setiap keluaran.

Karya berurutan yang harus konsisten
Komik, storyboard, rangkaian penjelas, dan buku anak gagal pada masalah yang sama: karakter berhenti menjadi karakter yang sama pada bingkai kelima.
Kasus ini di ekosistem terbuka biasanya diselesaikan dengan melatih LoRA. Editor percakapan mencapai tempat serupa tanpa pelatihan apa pun, dengan konsekuensi kontrol yang kurang presisi.
- Tanpa langkah pelatihan.
- Pergeseran tetap menumpuk pada rentang panjang.
- Secara berkala kembali merujuk ke gambar asli.

Opsi dari foto yang sudah Anda miliki
Satu potret dibawa ke beberapa set pencahayaan, latar belakang, atau busana agar klien bisa memilih tanpa memesan studio lagi.
Batas jujurnya: tidak satu pun varian tersebut adalah foto dari sesuatu yang nyata. Mereka alternatif yang masuk akal, cocok untuk mood board dan tidak cocok sebagai rekaman.
- Lebih cepat daripada pemotretan ulang untuk eksplorasi.
- Bukan pengganti pemotretan nyata.
- Jangan pernah untuk dokumen identitas.

Pertanyaan Nano Banana
Yang ditanyakan orang setelah sesi pertama
Hal-hal yang muncul saat efek kebaruan hilang.
Mengapa wajah tetap melenceng pada akhirnya?
Setiap edit dikondisikan pada hasil sebelumnya, bukan pada yang asli, sehingga kesalahan kecil terakumulasi. Menyuplai ulang gambar sumber setiap beberapa giliran mengatur ulang referensi dan menghentikan kemelesetan perlahan.
Bisakah saya mendapatkan hasil yang sama dua kali?
Tidak secara andal. Pengeditan percakapan tidak mengekspos seed seperti pipeline terbuka, itulah kompromi umum demi antarmuka yang sesederhana ini.
Apakah lebih baik daripada inpainting?
Lebih mudah. Inpainting dengan mask eksplisit memberi Anda kontrol tepat atas piksel mana yang boleh berubah; sebuah kalimat menyerahkan penilaian itu pada model. Pekerjaan presisi tetap memerlukan mask.
Bisakah bekerja dari lebih dari satu gambar referensi?
Menggabungkan referensi adalah permintaan umum dan dukungannya bervariasi menurut antarmuka dan versi. Ujilah pada materi Anda sendiri alih-alih mengandalkan deskripsi pihak ketiga mana pun.
Apa yang buruk baginya?
Mulai dari nol. Tanpa gambar sumber, mekanisme konsistensi tidak punya apa pun untuk dipertahankan, dan model yang dibangun untuk komposisi teks ke gambar memberi kontrol lebih atas pembingkaian dan optik.
Apakah berfungsi pada subjek non-manusia?
Ya, dan sering kali lebih andal — sebuah produk atau bangunan memiliki lebih sedikit fitur yang benar-benar disorot pemirsa dibanding wajah manusia.

Gagasan yang sama, diberi nama
Kosakata di balik pengeditan percakapan
Terus jelajahi
Di tempat lain di LaFoto
Mengedit satu tugas. Ini yang lainnya.
- pengubah ukuran gambar gratis
- JPG, PNG, dan WebP
- kompresor gambar
- potong gambar
- palet warna gambar
- hapus latar belakang
- periksa data EXIF
- strukturkan prompt
- generator anime AI
- ubah foto jadi kartun
- generator seni piksel
- generator gambar AI terbaik
- LaFoto vs Midjourney
- alternatif Leonardo AI
- dibandingkan dengan Ideogram
- LaFoto vs Canva
- mereproduksi gambar
- apa itu denoise strength
- penjelasan inpainting
- panduan dan penjelasan
Nano Banana — questions people ask
- Apa itu Nano Banana?
- Ini adalah julukan, kini dipakai secara resmi, untuk model generasi dan pengeditan gambar Gemini milik Google. Ia dibuat untuk pengeditan percakapan yang menjaga konsistensi subjek di sepanjang serangkaian perubahan.
- Siapa pembuat Nano Banana?
- Google. Ia bagian dari keluarga Gemini.
- Kenapa namanya Nano Banana?
- Ia muncul anonim di arena perbandingan model publik dengan nama placeholder itu, tampil sangat baik, dan labelnya melekat. Google mengadopsinya alih-alih menolaknya.
- Apakah Nano Banana open source?
- Tidak. Bobotnya tertutup dan aksesnya melalui aplikasi serta API Google.
- Nano Banana paling unggul untuk apa?
- Mengedit gambar yang sudah ada sambil menjaga subjek tetap mudah dikenali — wajah yang sama melintasi beberapa perubahan berurutan, yang biasanya hilang pada kebanyakan model gambar setelah satu-dua kali.
- Apakah Nano Banana lebih baik daripada Midjourney?
- Tugasnya berbeda. Midjourney membawa estetika kuat dan dipakai untuk membuat gambar mencolok dari nol; Nano Banana berusaha hanya mengubah yang Anda minta dan membiarkan sisa foto tetap apa adanya.
- Bisakah Nano Banana membuat gambar dari teks saja?
- Bisa, tetapi bukan di situ keunggulannya. Kemampuan pembeda utamanya adalah menjaga subjek sepanjang proses edit, yang memerlukan gambar sumber untuk dipertahankan.
- Apakah LaFoto menggunakan Nano Banana?
- Tidak, dan kami tidak berafiliasi dengan Google. Halaman ini adalah materi referensi di direktori model kami.
Mulai berkarya hari ini
Hasilkan gambar pertama Anda dengan generator gambar AI terbaik.
Ubah satu kalimat menjadi gambar jadi yang fotorealistis dalam hitungan detik — lalu sempurnakan tiap detail. Tanpa setup, tanpa Discord, tanpa GPU.
Bergabunglah dengan 4.200+ kreator yang menggunakan LaFoto