Lewati ke konten
LaFoto

Direktori model

Model gambar AI, dijelaskan bukan diperingkat

Tujuh model yang benar-benar disebut orang, dan fungsi nyata masing-masing. Tanpa skor, karena jawabannya sepenuhnya bergantung pada pekerjaan yang Anda bawa.

Model-model ini tidak bersaing pada hal yang sama. Midjourney menerapkan estetika, FLUX mengikuti instruksi secara literal, Nano Banana mengubah foto tanpa “menghilangkan” orang di dalamnya, Stable Diffusion memberi Anda komponen, Recraft menghasilkan vektor yang dapat diedit, Seedream mengatur huruf Tiongkok dan Inggris, dan gpt-image-1 mengurai kalimat rumit. Pilih berdasarkan kalimat mana yang menggambarkan masalah Anda.

Cara memilih di antara mereka

Pertanyaan yang paling menentukan adalah apakah Anda membuat gambar baru atau mengubah yang sudah ada. Membuat gambar dari nol menguntungkan model dengan komposisi dan kepatuhan terhadap prompt; mengubah foto menguntungkan model yang membiarkan semua yang tidak Anda sebut tetap utuh. Itu hampir kebutuhan yang berlawanan, dan alat yang dibangun untuk satu biasanya biasa-biasa saja pada yang lain.

Pertanyaan kedua adalah apakah Anda perlu hasil yang dapat direproduksi. Model tertutup yang di-host berubah tanpa kendali Anda, dan gaya yang Anda andalkan secara komersial bisa lenyap di luar jadwal yang Anda kuasai. Bobot terbuka memperbaiki itu dengan konsekuensi Anda harus menjalankan infrastrukturnya sendiri.

Pertanyaan ketiga adalah format keluaran, dan inilah yang sering terlambat disadari. Jika berkas harus dibuka di editor vektor atau dicetak berukuran dua meter, batasan itu menyingkirkan sebagian besar daftar ini bahkan sebelum pertanyaan kualitas muncul.

Apa isi direktori ini

Entri
Tujuh model
Peringkat
Tidak — dideskripsikan
Afiliasi
Tidak berafiliasi dengan mana pun
Harga
Dengan sengaja tidak dicantumkan
Versi
Tidak dikunci — perubahannya terlalu cepat
Diperbarui
Agustus 2026

Cara membaca perbandingan model

Hampir semua peringkat menjawab pertanyaan yang tidak Anda ajukan

Daftar model gambar terbaik biasanya dibuat dengan menjalankan segelintir prompt yang sama pada tiap model dan menilai hasilnya. Itu mengukur bagaimana tiap model menangani prompt tersebut, yang hanya berguna jika pekerjaan Anda mirip dengannya — dan serangkaian prompt uji yang dipilih agar terlihat bagus di blog jarang sekali cocok.

Pertanyaan yang lebih berguna bersifat struktural: apakah model ini membuat gambar atau mengubahnya, apakah ia punya opini estetika, dapatkah Anda menjalankannya sendiri, dan apa yang keluar di ujungnya — piksel atau kurva. Sifat-sifat itu tidak bergeser pada rilis berikutnya, dan sudah menyisihkan sebagian besar daftar sebelum kualitas dibahas.

Tujuh cetakan foto kecil berbingkai tersusun dalam grid di dinding studio pucat

Tiga pertanyaan yang cepat mempersempit pilihan

Pilih berdasarkan kendala sebelum memilih berdasarkan kualitas

Persimpangan pertama, dan yang paling lebar

Membuat gambar dari deskripsi dan menyunting foto yang sudah ada adalah dua masalah yang nyaris berlawanan. Yang satu menonjolkan komposisi dan kepatuhan pada prompt; yang lain menonjolkan tidak menyentuh apa pun yang tidak Anda sebutkan.

Model yang dibangun untuk penyuntingan menjaga identitas subjek lintas perubahan berturut-turut. Model yang dibangun untuk generasi memberi Anda kendali atas pembingkaian, optik, dan gaya dari nol. Sangat sedikit yang unggul di keduanya.

  • Menyunting foto yang ada: Nano Banana.
  • Membuat dari nol: FLUX, Midjourney.
  • Keduanya, secara percakapan: gpt-image-1.
Adegan produk disunting AI dengan latar diganti

Pertanyaan tentang model

Hal yang orang tanyakan sebelum memilih

Jawaban singkat, versi panjangnya ada di halaman tiap model.

Mengapa prompt dan model yang sama menghasilkan gambar berbeda?

Karena noise awalnya berbeda. Sebuah seed mengunci noise itu, dan prompt plus seed plus model mereproduksi gambar secara persis. Ubah salah satu dari tiga itu dan Anda mendapat sesuatu yang terkait tetapi tidak identik.

Apakah model yang lebih baru selalu lebih baik?

Untuk keluaran mentah, biasanya ya. Untuk hal di sekitarnya — perkakas komunitas, adaptor gaya, kejelasan lisensi, kestabilan harga — sering tidak. Stable Diffusion adalah contoh paling jelas model lama yang hidup dari ekosistemnya.

Bisakah saya memindahkan prompt antar model?

Subjek dan adegannya berpindah; parameter dan sintaksnya jarang. Model berbeda dalam cara membaca pembobotan, negatif, dan token gaya, dan prompt yang disetel keras untuk satu model biasanya terlalu terspesifikasi untuk yang lain.

Apa yang benar-benar saya dapat dari bobot terbuka?

Kemampuan menjalankannya secara lokal, mengunci versi selamanya, menghasilkan tanpa biaya per gambar, dan menjaga materi sumber tetap di luar infrastruktur pihak ketiga. Biayanya adalah perangkat keras dan perawatan.

Model mana yang merender teks dengan benar?

Beberapa kini mampu untuk string pendek, dan tidak ada yang bisa menggantikan penataan huruf. Buat gambarnya, tambahkan kata-kata di alat desain, dan Anda menghindari seluruh kategori masalah.

Apakah model lebih penting daripada prompt?

Di bawah standar prompt tertentu, tidak. Prompt spesifik lewat model kelas menengah mengalahkan prompt samar lewat model terbaik yang tersedia, itulah sebabnya panduan prompt di sini lebih panjang daripada direktori ini.

Foto makanan yang dihasilkan AI dalam cahaya siang

Terus jelajahi

Di tempat lain di LaFoto

Direktori menjelaskan perkakas; berikut hal yang Anda lakukan dengannya.

Pertanyaan tentang model gambar AI

Model gambar AI mana yang terbaik?
Tidak ada satu jawaban, itulah sebabnya direktori ini mendeskripsikan alih-alih merangking. Midjourney memaksakan estetika, FLUX mengikuti instruksi secara literal, Nano Banana mengedit foto tanpa menghilangkan orang di dalamnya, Stable Diffusion memberi Anda komponen, Recraft menghasilkan vektor, Seedream menata huruf Tionghoa dan Inggris, dan gpt-image-1 mengurai kalimat yang rumit. Pilih berdasarkan mana yang menggambarkan masalah Anda.
Apa bedanya model terbuka dan tertutup?
Bobot terbuka dapat diunduh dan dijalankan di perangkat keras Anda sendiri, sehingga Anda bisa mengunci satu versi selamanya, menghasilkan tanpa biaya per gambar, dan menjaga materi sumber tetap di luar server pihak ketiga. Model tertutup diakses melalui antarmuka layanan atau aplikasi, tidak memerlukan infrastruktur, dan berubah menurut jadwal penyedia, bukan jadwal Anda.
Mengapa halaman-halaman ini tidak mencantumkan harga atau nomor versi?
Karena keduanya berubah lebih cepat daripada laju revisi halaman direktori, dan angka basi terbaca sebagai kebohongan, bukan sebagai kedaluwarsa. Yang ditulis di sini adalah bagian yang bertahan — siapa pembuatnya, bagaimana cara mengaksesnya, apakah bobotnya terbuka, dan untuk apa ia dibangun agar unggul.
Apakah LaFoto berafiliasi dengan model-model ini?
Tidak. Kami tidak menjual kembali salah satunya dan tidak memiliki hubungan komersial dengan pembuatnya. Satu-satunya tempat kami berbicara sebagai pihak pertama adalah entri FLUX, di mana kami menyatakan model yang menghasilkan citra situs ini sendiri — klaim yang dibuktikan galeri, kartu demi kartu.
Bisakah saya memindahkan prompt dari satu model ke model lain?
Subjek dan adegannya berpindah; parameter dan sintaksnya jarang. Model berbeda dalam cara membaca pembobotan, negatif, dan token gaya, dan prompt yang disetel ketat untuk satu model biasanya menjadi terlalu terspesifikasi untuk yang lain.
Apakah model yang lebih baru selalu lebih baik daripada yang lama?
Pada kualitas keluaran mentah, biasanya ya. Pada segala sesuatu di sekelilingnya — tooling komunitas, adaptor gaya, kejernihan lisensi — sering kali tidak. Stable Diffusion adalah contoh paling jelas tentang model lama yang tetap relevan karena ekosistemnya, bukan karena hasilnya.
Model mana yang sebaiknya saya pakai untuk mengedit foto yang sudah saya miliki?
Model yang dibangun untuk pengeditan, bukan generasi. Kemampuan pembeda utamanya adalah mempertahankan subjek tetap dikenali melintasi perubahan berturut-turut, yang pada kebanyakan model text-to-image hilang setelah satu atau dua suntingan.
Apakah ada yang merender teks secara andal?
Beberapa mampu menangani string pendek dengan cukup baik untuk dirancang mengitarinya, dan tidak satu pun yang dapat menggantikan penataan huruf. Buat gambarnya lalu tambahkan kata-kata di alat desain — huruf hasil generasi tidak bisa diedit, diperiksa ejaannya, atau diterjemahkan setelahnya.

Mulai berkarya hari ini

Hasilkan gambar pertama Anda dengan generator gambar AI terbaik.

Ubah satu kalimat menjadi gambar jadi yang fotorealistis dalam hitungan detik — lalu sempurnakan tiap detail. Tanpa setup, tanpa Discord, tanpa GPU.

Bergabunglah dengan 4.200+ kreator yang menggunakan LaFoto