Saat memesan foto ke seorang fotografer, hasilnya sangat ditentukan oleh seberapa jelas Anda menjelaskan keinginan. "Tolong fotokan saya" akan menghasilkan sesuatu yang mungkin tidak Anda bayangkan. "Tolong fotokan saya setengah badan, latar abu-abu polos, cahaya rata dari depan" menghasilkan sesuatu yang jauh lebih dekat. Prompt Gemini AI menuntut kejelasan yang persis sama.
Karena itu banyak orang menyalin prompt dari internet, menempelkannya apa adanya, lalu bingung karena hasilnya berbeda jauh dari contoh yang mereka lihat. Masalahnya bukan pada model, melainkan pada satu kenyataan sederhana: prompt yang disalin ditulis untuk foto orang lain, bukan foto Anda.
Artikel ini membahas struktur di balik prompt yang bekerja, contoh yang bisa langsung Anda pakai, dan hal-hal yang perlu Anda ketahui sebelum mengandalkan hasilnya. Seluruhnya berfokus pada prompt gambar; kalau yang Anda butuhkan prompt berbentuk teks untuk pekerjaan kantor, sekolah, atau usaha, rumusnya berbeda dan kami kumpulkan di 24 contoh prompt Gemini AI. Untuk contoh di luar Gemini, termasuk video pendek dan bahan jualan, daftarnya ada di 20 contoh prompt AI. Kalau tool yang Anda pakai bukan Gemini, kerangka yang berlaku di semua model kami bahas di prompt AI keren.
Prompt Gemini AI Itu Instruksi, Bukan Mantra
Prompt adalah instruksi tertulis yang Anda berikan ke model AI. Instruksi itu dibaca sebagai deskripsi, bukan sebagai kode rahasia. Tidak ada kata sakti yang membuat hasilnya otomatis bagus — yang ada hanya deskripsi yang lengkap dan deskripsi yang setengah jadi. Pengertian dasarnya, termasuk lapisan lain yang ikut terbaca model selain kalimat Anda, kami bahas di apa itu prompt AI.
Yang membuat prompt gambar terasa berbeda dari mengetik pertanyaan biasa adalah model yang menanganinya. Gemini memakai model khusus untuk membuat dan mengedit gambar, terpisah dari model yang menjawab pertanyaan teks. Model inilah yang punya julukan Nano Banana — nama tidak resmi yang lahir di komunitas dan akhirnya dipakai Google sendiri.
Nama itu penting karena satu alasan praktis. Nano Banana pertama, resminya gemini-2.5-flash-image, dirilis Agustus 2025 dan memicu gelombang foto miniatur serta polaroid yang memenuhi media sosial Indonesia sepanjang September 2025. Google mencatat lebih dari 10 juta orang mengunduh aplikasi Gemini untuk pertama kali karena tren tersebut. Sebagian besar kumpulan prompt Gemini AI yang beredar sampai sekarang ditulis pada periode itu.
Sejak itu keluarganya bertambah. Ini tiga nama yang perlu Anda kenali:
| Julukan | Nama resmi | Peran saat ini |
|---|---|---|
| Nano Banana | Gemini 2.5 Flash Image | Model Agustus 2025, kini lawas |
| Nano Banana 2 | Gemini 3.1 Flash Image | Bawaan aplikasi sejak 26 Februari 2026 |
| Nano Banana Pro | Gemini 3 Pro Image | Untuk tugas visual paling rumit |
Nano Banana 2 menggantikan pendahulunya di mode Fast, Thinking, maupun Pro. Generasi baru membaca instruksi lebih teliti, sehingga prompt lama yang ditulis pendek-pendek justru memberi hasil berbeda dari contoh aslinya. Satu perbedaan lain berdampak langsung ke hasil: akun gratis menerima gambar pada resolusi 1K, sementara akun berbayar sampai 2K.
Gemini adalah salah satu penerapan large language model atau LLM. Cara kerjanya di balik layar sudah kami bahas terpisah. Penjelasannya ada di artikel AI generatif dan LLM.
Rumus Lima Bagian: Subjek, Aksi, Lokasi, Komposisi, Gaya
Dokumentasi resmi Google untuk Nano Banana memberi satu rumus yang mendasari hampir semua prompt gambar yang bekerja dengan baik. Urutannya: subjek, aksi, lokasi, komposisi, lalu gaya.
- Subjek: siapa atau apa yang ada di gambar, sedetail mungkin. Bukan "seorang perempuan", tetapi "seorang perempuan berusia sekitar 30 tahun mengenakan blazer navy dan kemeja putih".
- Aksi: apa yang sedang dilakukan subjek, termasuk arah pandang dan posisi tubuh. Ini yang membedakan pose kaku dari pose yang hidup.
- Lokasi: latar tempat beserta kondisi cahayanya. "Studio abu-abu polos" dan "trotoar kota pukul lima sore" memberi dua dunia yang berbeda.
- Komposisi: seberapa dekat kamera, dari sudut mana, dan di bagian bingkai mana subjek berada. Istilah seperti medium shot (potongan dari pinggang ke atas) dan full body shot (seluruh badan) sangat membantu di sini.
- Gaya: rasa akhir gambar — jenis fotografinya, karakter pencahayaan, palet warna, dan rasio bingkai.

Perbedaannya terasa langsung. Prompt satu baris seperti ini:
Foto profil profesional seorang perempuan.memberi model kebebasan penuh untuk menebak. Prompt yang sama setelah dilengkapi lima bagian:
Foto seorang perempuan berusia sekitar 30 tahun mengenakan blazer navy dan
kemeja putih. Ia berdiri tegak menghadap kamera dengan senyum tipis dan bahu
sedikit menyerong. Latar studio abu-abu polos tanpa gradasi. Medium shot dari
dada ke atas, wajah berada di sepertiga atas bingkai. Gaya foto profil
profesional, pencahayaan three-point softbox yang merata, warna netral,
rasio 4:5.Isinya bukan lebih rumit, hanya lebih lengkap. Setiap kalimat mengisi satu bagian yang sebelumnya kosong dan harus ditebak sendiri oleh model. Rumus yang sama berlaku di luar Gemini, meski kotak masukannya berbeda bentuk — perbandingannya beserta contoh siap salin untuk produk, kartun, dan logo kami susun di contoh prompt AI gambar.
Tiga Aturan yang Paling Sering Dilanggar
Rumus di atas mengatur apa yang ditulis. Tiga aturan berikut mengatur bagaimana menulisnya, dan ketiganya sering dilanggar bahkan oleh orang yang sudah terbiasa memakai Gemini.
Pertama, sebutkan yang Anda inginkan, bukan yang tidak Anda inginkan. Dokumentasi Google menyebutnya positive framing. Menulis "jalanan tanpa mobil" justru memasukkan kata "mobil" ke dalam deskripsi, dan model kerap menggambarnya. Gantilah dengan "jalanan lengang beraspal basah". Aturan ini berlaku untuk semua larangan: alih-alih "jangan ubah wajah", tulis "pertahankan bentuk wajah, jarak mata, dan garis rahang persis seperti foto acuan".
Kedua, mulai dengan kata kerja yang tegas. Kata pertama memberi tahu model operasi apa yang sedang diminta. "Buat", "ganti", "hapus", "gabungkan", dan "perjelas" menghasilkan perilaku yang berbeda-beda. Prompt yang dibuka dengan kata benda saja membuat model harus menebak apakah Anda meminta gambar baru atau suntingan atas gambar yang Anda unggah.
Ketiga, tulis kalimat bercerita, bukan tumpukan kata kunci. Deretan seperti "perempuan, hijab, cafe, estetik, HD, 4K, cinematic" adalah kebiasaan dari generator gambar lama. Gemini membaca kalimat utuh dengan lebih baik karena ia memang model bahasa. Susun sebagai kalimat, dan simpan kata sifat untuk hal yang benar-benar Anda maksud.
Soal bahasa, prompt yang ditulis dalam bahasa Indonesia bekerja dengan baik dan tidak perlu Anda terjemahkan lebih dulu. Yang sebaiknya tetap dalam bahasa Inggris hanyalah istilah teknis fotografi: golden hour, softbox, depth of field, bokeh, dan f/1.8. Istilah itu tidak punya padanan Indonesia yang baku, dan model mengenalinya sebagai penyebutan standar.
Membuat Prompt dari Foto yang Sudah Anda Suka
Ada jalan pintas kalau Anda melihat sebuah foto dan ingin gaya yang sama tanpa harus menguraikannya sendiri. Balik saja arahnya: unggah foto itu ke Gemini, lalu minta ia menuliskan prompt-nya untuk Anda.
Perhatikan foto ini, lalu tuliskan satu prompt berbahasa Indonesia yang bisa
menghasilkan gambar bergaya sama. Uraikan dalam lima bagian: subjek, aksi,
lokasi, komposisi, dan gaya. Sebutkan arah cahaya, jarak kamera, dan palet
warnanya secara spesifik.Hasilnya adalah teks yang bisa Anda simpan, sunting, dan pakai ulang dengan subjek berbeda. Cara ini juga menjadi alat belajar yang efektif: Anda melihat bagaimana sebuah kesan visual diterjemahkan menjadi kata-kata konkret. Setelah beberapa kali, Anda akan mengenali polanya sendiri. Cara yang sama berlaku di luar urusan foto, dan kami bahas bersama syarat lulus sebuah prompt di prompt AI yang bagus.
Satu catatan penting. Menyalin gaya sebuah foto berbeda dengan menyalin orang di dalamnya. Meminta Gemini meniru komposisi dan pencahayaan sebuah karya tidak bermasalah, tetapi meminta wajah seseorang dipindahkan ke tubuh lain adalah hal yang berbeda.
Contoh Prompt Gemini AI untuk Foto Diri
Berikut contoh prompt Gemini AI yang seluruhnya disusun memakai rumus lima bagian. Silakan salin, lalu ganti detail yang bercetak spesifik dengan milik Anda sendiri. Khusus untuk subjek perempuan, bagian busana dan kerudung punya aturan penulisannya sendiri yang dirinci di panduan prompt Gemini AI wanita.
Potret profil untuk keperluan kerja:
Foto seorang pria berusia sekitar 35 tahun mengenakan kemeja putih lengan
panjang tanpa dasi. Ia berdiri menghadap kamera, bahu menyerong 15 derajat,
ekspresi tenang dengan senyum tipis. Latar studio abu-abu terang polos.
Medium shot dari dada ke atas, wajah di sepertiga atas bingkai. Gaya foto
korporat, pencahayaan softbox lembut dari depan kiri, warna netral dan
kontras rendah, rasio 4:5.Potret wanita di luar ruang saat sore:
Foto seorang wanita berusia 20-an mengenakan kemeja linen putih dan celana
kulot krem. Ia berjalan santai sambil menoleh ke samping, satu tangan
memegang tali tas selempang. Trotoar kota dengan deretan pohon di kanan dan
kiri, pukul lima sore. Full body shot dari sudut sedikit rendah, subjek
berada di sepertiga kiri bingkai. Gaya fotografi jalanan, golden hour
backlighting dengan bayangan panjang, depth of field dangkal f/1.8,
rasio 9:16.Potret wanita berhijab dengan cahaya jendela:
Foto seorang perempuan mengenakan hijab pashmina warna mocha dan tunik linen
sewarna. Ia duduk di kursi kayu sambil memangku buku, pandangan ke arah
jendela. Ruang baca dengan jendela besar di sebelah kiri sebagai satu-satunya
sumber cahaya. Medium shot menyamping 45 derajat, ruang kosong disisakan di
sisi arah pandangnya. Gaya potret natural, cahaya jendela lembut, palet warna
hangat, rasio 4:5.Perhatikan bahwa tidak satu pun dari ketiga prompt itu menyebut kata "estetik", "keren", atau "HD". Kata-kata tersebut terlalu kabur untuk diterjemahkan model menjadi keputusan visual. Yang menghasilkan kesan estetik justru keputusan konkret: arah cahaya, jarak kamera, dan palet warna. Kalau Anda membutuhkan katalog contoh yang lebih banyak beserta syarat foto acuan yang menentukan kemiripan hasil, lanjutkan ke panduan prompt Gemini AI foto sendiri.
Contoh Prompt Gemini AI untuk Foto Keluarga
Foto dengan lebih dari satu orang membutuhkan satu tambahan penting: sebutkan jumlah orangnya secara eksplisit, lengkap dengan siapa saja mereka. Tanpa itu, jumlah wajah yang muncul sering meleset.
Jumlah orang juga ada batasnya, dan batas itu ada dua: berapa karakter yang kemiripannya dijaga di gambar hasil, serta berapa foto acuan wajah yang boleh Anda unggah. Angka keduanya berbeda, dan yang kedua lebih sering menjadi penyebab kegagalan. Katalog prompt untuk tiga orang ke atas — termasuk busana adat, Lebaran, dan wisuda — beserta rincian kedua batas itu kami bahas terpisah di panduan prompt Gemini AI foto keluarga.
Foto berdua menuntut penanganan tersendiri, karena dua wajah harus dijaga sekaligus dan sering hanya satu yang selamat. Katalog prompt pasangan beserta cara menggabungkan dua foto terpisah kami bahas di panduan prompt Gemini AI pasangan.
Prompt Gemini AI untuk Mengedit Foto yang Sudah Ada
Bagian ini justru yang paling berguna sehari-hari, dan cara kerjanya berbeda. Anda mengunggah foto lebih dulu, lalu menulis instruksi tentang apa yang berubah dan apa yang tetap.
Google menyebut tekniknya semantic masking. Pada aplikasi edit foto biasa, Anda menyeleksi area dengan kuas. Di Gemini, seleksi itu Anda lakukan lewat kalimat. Karena itu satu kebiasaan jadi wajib: sebutkan secara tegas apa yang harus tetap sama. Tanpa penegasan itu, model merasa bebas menyentuh seluruh gambar.

Mengubah latar menjadi pas foto:
Ganti latar belakang foto ini menjadi biru polos rata tanpa gradasi.
Pertahankan wajah, rambut, pakaian, dan posisi tubuh persis seperti aslinya.
Rapikan tepi rambut agar bersih dari sisa latar lama. Hasil akhir rasio 2:3.Ganti "biru" dengan "merah" untuk keperluan dokumen yang mensyaratkan latar merah. Perlu dicatat, sebagian instansi mensyaratkan pas foto berupa hasil pemotretan asli, sehingga foto olahan AI belum tentu diterima. Untuk lamaran kerja dan kebutuhan tidak resmi, cara ini menghemat waktu.
Menghapus orang yang tidak diinginkan:
Hapus orang yang berdiri di sisi kanan foto ini. Isi area bekasnya dengan
lanjutan pagar dan tanaman yang ada di sekitarnya. Pertahankan dua orang di
tengah, arah pencahayaan, dan warna keseluruhan persis seperti aslinya.Menggabungkan dua foto jadi satu:
Gabungkan kedua foto ini menjadi satu potret berdua. Ambil orang dari gambar
pertama dan orang dari gambar kedua, tempatkan berdampingan dengan tinggi
bahu sejajar. Latar studio abu-abu polos. Samakan arah dan suhu cahaya pada
kedua wajah. Medium shot, rasio 3:2.Memperbaiki foto lama yang buram:
Perjelas foto lama ini: pertajam detail wajah dan tekstur pakaian, kurangi
bintik dan goresan, kembalikan warna kulit yang memudar. Pertahankan bentuk
wajah, potongan rambut, dan pakaian persis seperti aslinya. Batasi perubahan
hanya pada ketajaman, bintik, dan warna.Satu hal yang perlu Anda pahami soal perintah terakhir: Gemini tidak mempertajam foto asli, melainkan menggambar ulang versi baru yang terlihat lebih tajam. Detail yang hilang di foto buram tidak dikembalikan, tetapi ditebak. Untuk kenangan keluarga hasilnya menyenangkan, tetapi jangan dipakai sebagai bukti dokumentasi.
Karena itu pula menambahkan kata "HD", "4K", atau "resolusi tinggi" ke dalam prompt hampir tidak berpengaruh. Ketajaman keluaran ditentukan oleh akun Anda, bukan oleh kata sifat di dalam kalimat. Akun gratis menerima gambar 1K, akun berbayar sampai 2K, dan Nano Banana Pro menyediakan pilihan 4K. Yang benar-benar bisa Anda kendalikan lewat prompt adalah detail yang digambar, bukan jumlah pikselnya.
Cara Menjaga Wajah Tetap Sama
Permintaan yang paling sering muncul saat menyunting foto adalah mengganti latar atau pakaian tanpa mengubah wajah. Keluhannya pun sama: wajahnya berubah. Penyebabnya masuk akal begitu Anda memahami cara kerjanya: model tidak menempelkan wajah Anda ke gambar baru, ia menggambar ulang seluruh gambar termasuk wajahnya. Semakin sedikit petunjuk yang Anda berikan tentang wajah itu, semakin bebas ia menafsirkan.
Ada tiga hal yang membantu, dan ketiganya bisa Anda pakai bersamaan.
- Unggah foto acuan yang jelas. Wajah yang menghadap depan, cahaya rata, dan resolusi cukup memberi model bahan yang jauh lebih banyak daripada foto dari kejauhan.
- Sebutkan ciri yang harus dipertahankan satu per satu. Bukan "wajahnya sama", tetapi "pertahankan bentuk wajah, jarak mata, garis rahang, warna kulit, dan tatanan rambut dari foto acuan".
- Ubah satu hal dalam satu perintah. Ganti latar dulu, periksa hasilnya, baru ganti pakaian. Perubahan bertumpuk dalam satu prompt memperbesar peluang wajah ikut bergeser.
Digabung, bentuknya seperti ini:
Pertahankan bentuk wajah, jarak mata, garis rahang, warna kulit, dan tatanan
rambut dari foto acuan persis seperti aslinya. Ubah hanya latar menjadi ruang
kantor modern dengan jendela besar di belakang. Medium shot, cahaya jendela
lembut dari kiri, rasio 4:5.Meski begitu, ada batas yang diakui Google sendiri. Dalam catatan resminya, DeepMind menyebut akurasi teks, wajah berukuran kecil, dan detail halus masih menjadi kelemahan modelnya. Artinya foto rombongan dengan wajah-wajah kecil di kejauhan memang lebih rawan berubah dibanding potret setengah badan, berapa pun telitinya prompt Anda.
Hal yang Perlu Anda Pertimbangkan Sebelum Memakainya
Kemampuan di atas datang bersama beberapa konsekuensi yang sebaiknya Anda ketahui sejak awal.
Setiap gambar membawa tanda buatan AI. Semua gambar keluaran Gemini disisipi SynthID, watermark digital tak kasatmata yang memungkinkan pengecekan apakah sebuah gambar dibuat atau disunting oleh AI Google. Di luar itu ada watermark yang benar-benar terlihat berupa ikon Gemini sparkle. Sejak 14 Agustus 2026 ikon tersebut bisa Anda matikan sendiri lewat menu Settings kemudian Media Watermark di gemini.google.com. Pengaturannya tersedia untuk akun gratis maupun berlangganan di Indonesia, dan hanya tidak muncul pada akun kerja atau sekolah.
Yang perlu dicatat, pengaturan itu mengendalikan tanda kasatmata saja. SynthID beserta Content Credentials yang menyimpan riwayat pembuatan berkas tetap menyertai setiap gambar. Artinya hasilnya selalu dapat dikenali sebagai keluaran AI, termasuk saat dipakai untuk keperluan komersial.
Jatah pemakaian ada batasnya, dan angkanya tidak diumumkan. Halaman bantuan resmi Gemini tidak lagi mencantumkan jumlah gambar per hari. Yang disebutkan hanya perbandingan relatif. Pengguna tanpa langganan mendapat batas standar, Google AI Plus dua kali lipat, AI Pro empat kali lipat, dan AI Ultra beberapa kali lipat di atas AI Pro. Batas tersebut disegarkan setiap lima jam sampai kuota mingguan habis.
Karena tidak ada angka pasti yang bisa dipegang, hematlah jatah itu. Tulis satu prompt yang lengkap sejak awal, bukan mencoba berkali-kali dengan prompt pendek.
Wajah orang terkenal akan ditolak. Prompt bergaya "foto bersama idola" atau "berfoto dengan artis" termasuk yang paling sering dicari, dan paling sering gagal. Aturan keamanan Gemini menolak permintaan menggambar orang yang bisa dikenali publik, dan Kebijakan Penggunaan Terlarang AI Generatif milik Google secara terpisah melarang penggambaran seseorang tanpa persetujuannya. Penolakan itu kadang juga mengenai foto pribadi yang wajahnya kebetulan mirip figur publik. Kalau prompt Anda ditolak padahal isinya wajar, kemungkinan besar inilah pemicunya.
Hasilnya tetap gambar buatan, bukan foto. Pakaian yang tidak pernah Anda miliki, tempat yang tidak pernah Anda kunjungi, dan tanggal yang tidak pernah terjadi tetap bukan dokumentasi. Untuk melamar kerja, foto profil, atau konten media sosial, tidak ada masalah. Untuk dokumen resmi dan bukti, gunakan foto asli.
Pertanyaan yang Sering Diajukan
Apakah prompt harus ditulis dalam bahasa Inggris? Tidak. Prompt yang ditulis dalam bahasa Indonesia bekerja dengan baik. Yang sebaiknya tetap berbahasa Inggris hanyalah istilah teknis fotografi seperti golden hour, softbox, atau depth of field. Istilah itu tidak punya padanan Indonesia yang baku.
Bagaimana cara mengatur rasio gambar? Cukup sebutkan rasionya di akhir prompt, misalnya "rasio 9:16". Rasio yang didukung ada sepuluh: 1:1, 3:2, 2:3, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9, dan 21:9. Kalau Anda tidak menyebutkannya, model memilih sendiri berdasarkan konteks — permintaan wallpaper ponsel biasanya otomatis jadi vertikal.
Apakah membuat gambar di Gemini gratis? Ada jatah gratis tanpa berlangganan, tetapi jumlahnya tidak diumumkan dan disegarkan setiap lima jam. Sejak 14 Agustus 2026 watermark Gemini sparkle yang terlihat bisa dimatikan lewat pengaturan Media Watermark, termasuk pada akun gratis. Tanda tak kasatmata SynthID tetap ada.
Prompt Gemini AI mana yang sedang banyak dipakai? Tema yang ramai berganti setiap beberapa bulan, dan prompt yang terikat pada satu tema ikut kedaluwarsa bersamanya. Rumus lima bagian di artikel ini tidak ikut usang, karena yang diatur adalah struktur instruksinya, bukan temanya.
Bisakah prompt Gemini AI membuat gambar bergerak? Bisa, tetapi lewat model yang berbeda. Gambar diam ditangani Nano Banana, sedangkan video ditangani Gemini Omni yang diperkenalkan Google pada Mei 2026. Omni menerima gabungan gambar, audio, video, dan teks lalu mengeluarkan video; cara menulis instruksinya kami bahas di prompt video AI. Aksesnya terbuka untuk pelanggan Google AI Plus, Pro, dan Ultra di aplikasi Gemini, serta gratis lewat YouTube Shorts. Semua videonya membawa SynthID.
Bisakah Gemini memperjelas foto yang blur? Bisa membuat versi yang terlihat lebih tajam, tetapi caranya menggambar ulang, bukan memulihkan. Detail yang benar-benar hilang akan ditebak, sehingga hasilnya tidak sahih sebagai bukti.
Kesimpulan
Prompt Gemini AI yang bekerja dengan baik hampir selalu berisi lima bagian yang sama: subjek, aksi, lokasi, komposisi, dan gaya. Dua aturan penulisan menentukan sisanya — sebutkan yang Anda inginkan alih-alih yang Anda hindari, dan tulis dalam kalimat utuh, bukan tumpukan kata kunci. Untuk menyunting foto yang sudah ada, tambahkan satu kebiasaan: tegaskan apa yang harus tetap sama.
Selama Anda menguasai strukturnya, Anda tidak perlu lagi berburu kumpulan prompt setiap kali muncul tren baru — cukup susun sendiri sesuai kebutuhan. Ingat juga batasannya: tanda buatan AI yang menyertai setiap gambar, jatah pemakaian yang terbatas, dan hasil yang tetap merupakan gambar buatan, bukan dokumentasi. Semoga artikel ini membantu.




