Saat memesan foto ke seorang fotografer, hasilnya sangat ditentukan oleh seberapa jelas Anda menjelaskan keinginan. "Tolong fotokan saya" akan menghasilkan sesuatu yang mungkin tidak Anda bayangkan. "Tolong fotokan saya setengah badan, latar abu-abu polos, cahaya rata dari depan" menghasilkan sesuatu yang jauh lebih dekat. Prompt Gemini AI menuntut kejelasan yang persis sama.

Karena itu banyak orang menyalin prompt dari internet, menempelkannya apa adanya, lalu bingung karena hasilnya berbeda jauh dari contoh yang mereka lihat. Masalahnya bukan pada model, melainkan pada satu kenyataan sederhana: prompt yang disalin ditulis untuk foto orang lain, bukan foto Anda.

Artikel ini membahas struktur di balik prompt yang bekerja, contoh yang bisa langsung Anda pakai, dan hal-hal yang perlu Anda ketahui sebelum mengandalkan hasilnya.

Prompt Gemini AI Itu Instruksi, Bukan Mantra

Prompt adalah instruksi tertulis yang Anda berikan ke model AI. Instruksi itu dibaca sebagai deskripsi, bukan sebagai kode rahasia. Tidak ada kata sakti yang membuat hasilnya otomatis bagus — yang ada hanya deskripsi yang lengkap dan deskripsi yang setengah jadi.

Yang membuat prompt gambar terasa berbeda dari mengetik pertanyaan biasa adalah model yang menanganinya. Gemini memakai model khusus untuk membuat dan mengedit gambar, terpisah dari model yang menjawab pertanyaan teks. Model inilah yang punya julukan Nano Banana — nama tidak resmi yang lahir di komunitas dan akhirnya dipakai Google sendiri.

Nama itu penting karena satu alasan praktis. Nano Banana pertama, resminya gemini-2.5-flash-image, dirilis Agustus 2025 dan memicu gelombang foto miniatur serta polaroid yang memenuhi media sosial Indonesia sepanjang September 2025. Google mencatat lebih dari 10 juta orang mengunduh aplikasi Gemini untuk pertama kali karena tren tersebut. Sebagian besar kumpulan prompt Gemini AI yang beredar sampai sekarang ditulis pada periode itu.

Sejak itu keluarganya bertambah. Ini tiga nama yang perlu Anda kenali:

JulukanNama resmiPeran saat ini
Nano BananaGemini 2.5 Flash ImageModel Agustus 2025, kini lawas
Nano Banana 2Gemini 3.1 Flash ImageBawaan aplikasi sejak 26 Februari 2026
Nano Banana ProGemini 3 Pro ImageUntuk tugas visual paling rumit

Nano Banana 2 menggantikan pendahulunya di mode Fast, Thinking, maupun Pro. Generasi baru membaca instruksi lebih teliti, sehingga prompt lama yang ditulis pendek-pendek justru memberi hasil berbeda dari contoh aslinya. Satu perbedaan lain berdampak langsung ke hasil: akun gratis menerima gambar pada resolusi 1K, sementara akun berbayar sampai 2K.

Gemini adalah salah satu penerapan large language model atau LLM. Cara kerjanya di balik layar sudah kami bahas terpisah. Penjelasannya ada di artikel AI generatif dan LLM.

Rumus Lima Bagian: Subjek, Aksi, Lokasi, Komposisi, Gaya

Dokumentasi resmi Google untuk Nano Banana memberi satu rumus yang mendasari hampir semua prompt gambar yang bekerja dengan baik. Urutannya: subjek, aksi, lokasi, komposisi, lalu gaya.

  1. Subjek: siapa atau apa yang ada di gambar, sedetail mungkin. Bukan "seorang perempuan", tetapi "seorang perempuan berusia sekitar 30 tahun mengenakan blazer navy dan kemeja putih".
  2. Aksi: apa yang sedang dilakukan subjek, termasuk arah pandang dan posisi tubuh. Ini yang membedakan pose kaku dari pose yang hidup.
  3. Lokasi: latar tempat beserta kondisi cahayanya. "Studio abu-abu polos" dan "trotoar kota pukul lima sore" memberi dua dunia yang berbeda.
  4. Komposisi: seberapa dekat kamera, dari sudut mana, dan di bagian bingkai mana subjek berada. Istilah seperti medium shot (potongan dari pinggang ke atas) dan full body shot (seluruh badan) sangat membantu di sini.
  5. Gaya: rasa akhir gambar — jenis fotografinya, karakter pencahayaan, palet warna, dan rasio bingkai.

Lima bagian prompt Gemini AI berurutan: subjek, aksi, lokasi, komposisi, dan gaya.Lima bagian prompt Gemini AI berurutan: subjek, aksi, lokasi, komposisi, dan gaya.

Perbedaannya terasa langsung. Prompt satu baris seperti ini:

Code
Foto profil profesional seorang perempuan.

memberi model kebebasan penuh untuk menebak. Prompt yang sama setelah dilengkapi lima bagian:

Code
Foto seorang perempuan berusia sekitar 30 tahun mengenakan blazer navy dan
kemeja putih. Ia berdiri tegak menghadap kamera dengan senyum tipis dan bahu
sedikit menyerong. Latar studio abu-abu polos tanpa gradasi. Medium shot dari
dada ke atas, wajah berada di sepertiga atas bingkai. Gaya foto profil
profesional, pencahayaan three-point softbox yang merata, warna netral,
rasio 4:5.

Isinya bukan lebih rumit, hanya lebih lengkap. Setiap kalimat mengisi satu bagian yang sebelumnya kosong dan harus ditebak sendiri oleh model.

Tiga Aturan yang Paling Sering Dilanggar

Rumus di atas mengatur apa yang ditulis. Tiga aturan berikut mengatur bagaimana menulisnya, dan ketiganya sering dilanggar bahkan oleh orang yang sudah terbiasa memakai Gemini.

Pertama, sebutkan yang Anda inginkan, bukan yang tidak Anda inginkan. Dokumentasi Google menyebutnya positive framing. Menulis "jalanan tanpa mobil" justru memasukkan kata "mobil" ke dalam deskripsi, dan model kerap menggambarnya. Gantilah dengan "jalanan lengang beraspal basah". Aturan ini berlaku untuk semua larangan: alih-alih "jangan ubah wajah", tulis "pertahankan bentuk wajah, jarak mata, dan garis rahang persis seperti foto acuan".

Kedua, mulai dengan kata kerja yang tegas. Kata pertama memberi tahu model operasi apa yang sedang diminta. "Buat", "ganti", "hapus", "gabungkan", dan "perjelas" menghasilkan perilaku yang berbeda-beda. Prompt yang dibuka dengan kata benda saja membuat model harus menebak apakah Anda meminta gambar baru atau suntingan atas gambar yang Anda unggah.

Ketiga, tulis kalimat bercerita, bukan tumpukan kata kunci. Deretan seperti "perempuan, hijab, cafe, estetik, HD, 4K, cinematic" adalah kebiasaan dari generator gambar lama. Gemini membaca kalimat utuh dengan lebih baik karena ia memang model bahasa. Susun sebagai kalimat, dan simpan kata sifat untuk hal yang benar-benar Anda maksud.

Soal bahasa, prompt yang ditulis dalam bahasa Indonesia bekerja dengan baik dan tidak perlu Anda terjemahkan lebih dulu. Yang sebaiknya tetap dalam bahasa Inggris hanyalah istilah teknis fotografi: golden hour, softbox, depth of field, bokeh, dan f/1.8. Istilah itu tidak punya padanan Indonesia yang baku, dan model mengenalinya sebagai penyebutan standar.

Membuat Prompt dari Foto yang Sudah Anda Suka

Ada jalan pintas kalau Anda melihat sebuah foto dan ingin gaya yang sama tanpa harus menguraikannya sendiri. Balik saja arahnya: unggah foto itu ke Gemini, lalu minta ia menuliskan prompt-nya untuk Anda.

Code
Perhatikan foto ini, lalu tuliskan satu prompt berbahasa Indonesia yang bisa
menghasilkan gambar bergaya sama. Uraikan dalam lima bagian: subjek, aksi,
lokasi, komposisi, dan gaya. Sebutkan arah cahaya, jarak kamera, dan palet
warnanya secara spesifik.

Hasilnya adalah teks yang bisa Anda simpan, sunting, dan pakai ulang dengan subjek berbeda. Cara ini juga menjadi alat belajar yang efektif: Anda melihat bagaimana sebuah kesan visual diterjemahkan menjadi kata-kata konkret. Setelah beberapa kali, Anda akan mengenali polanya sendiri.

Satu catatan penting. Menyalin gaya sebuah foto berbeda dengan menyalin orang di dalamnya. Meminta Gemini meniru komposisi dan pencahayaan sebuah karya tidak bermasalah, tetapi meminta wajah seseorang dipindahkan ke tubuh lain adalah hal yang berbeda.

Contoh Prompt Gemini AI untuk Foto Diri

Berikut contoh prompt Gemini AI yang seluruhnya disusun memakai rumus lima bagian. Silakan salin, lalu ganti detail yang bercetak spesifik dengan milik Anda sendiri.

Potret profil untuk keperluan kerja:

Code
Foto seorang pria berusia sekitar 35 tahun mengenakan kemeja putih lengan
panjang tanpa dasi. Ia berdiri menghadap kamera, bahu menyerong 15 derajat,
ekspresi tenang dengan senyum tipis. Latar studio abu-abu terang polos.
Medium shot dari dada ke atas, wajah di sepertiga atas bingkai. Gaya foto
korporat, pencahayaan softbox lembut dari depan kiri, warna netral dan
kontras rendah, rasio 4:5.

Potret wanita di luar ruang saat sore:

Code
Foto seorang wanita berusia 20-an mengenakan kemeja linen putih dan celana
kulot krem. Ia berjalan santai sambil menoleh ke samping, satu tangan
memegang tali tas selempang. Trotoar kota dengan deretan pohon di kanan dan
kiri, pukul lima sore. Full body shot dari sudut sedikit rendah, subjek
berada di sepertiga kiri bingkai. Gaya fotografi jalanan, golden hour
backlighting dengan bayangan panjang, depth of field dangkal f/1.8,
rasio 9:16.

Potret wanita berhijab dengan cahaya jendela:

Code
Foto seorang perempuan mengenakan hijab pashmina warna mocha dan tunik linen
sewarna. Ia duduk di kursi kayu sambil memangku buku, pandangan ke arah
jendela. Ruang baca dengan jendela besar di sebelah kiri sebagai satu-satunya
sumber cahaya. Medium shot menyamping 45 derajat, ruang kosong disisakan di
sisi arah pandangnya. Gaya potret natural, cahaya jendela lembut, palet warna
hangat, rasio 4:5.

Perhatikan bahwa tidak satu pun dari ketiga prompt itu menyebut kata "estetik", "keren", atau "HD". Kata-kata tersebut terlalu kabur untuk diterjemahkan model menjadi keputusan visual. Yang menghasilkan kesan estetik justru keputusan konkret: arah cahaya, jarak kamera, dan palet warna.

Contoh Prompt Gemini AI Pasangan dan Keluarga

Foto dengan lebih dari satu orang membutuhkan satu tambahan penting: sebutkan jumlah orangnya secara eksplisit, lengkap dengan siapa saja mereka. Tanpa itu, jumlah wajah yang muncul sering meleset.

Prompt Gemini AI pasangan di studio:

Code
Foto dua orang dewasa: seorang pria berkemeja putih dan seorang perempuan
bergaun midi hitam. Keduanya berdiri berdampingan, tangan pria di bahu
perempuan, keduanya menghadap kamera. Latar studio merah marun polos.
Medium-full shot, kedua wajah berada di tengah bingkai dengan jarak yang sama
dari tepi. Gaya foto studio editorial, pencahayaan softbox dari dua sisi,
sedikit grain film, rasio 3:2.

Prompt foto keluarga empat orang:

Code
Foto empat orang: seorang ayah, seorang ibu, satu anak laki-laki usia sekitar
10 tahun, dan satu anak perempuan usia sekitar 6 tahun. Ayah dan ibu duduk di
bangku panjang, kedua anak berdiri di belakang bangku sambil bersandar. Taman
rumah berumput dengan pagar tanaman, pagi hari. Full shot, keempat wajah
sejajar dalam satu bidang fokus. Gaya foto keluarga hangat, cahaya matahari
pagi lembut dari belakang kiri, warna cerah natural, rasio 3:2.

Prompt busana pengantin adat Jawa:

Code
Foto dua orang dewasa mengenakan busana pengantin adat Jawa: pria berbeskap
hitam dengan blangkon, perempuan berkebaya beludru dengan sanggul dan roncean
melati. Keduanya berdiri berdampingan menghadap kamera, tangan bertaut di
depan. Pendapa berpilar kayu berukir, cahaya sore masuk dari samping.
Medium-full shot simetris. Gaya foto pernikahan tradisional, pencahayaan
hangat keemasan, detail kain dan sulaman tajam, rasio 4:5.

Ada batas teknis yang perlu Anda ketahui di sini. Google menyatakan Nano Banana Pro mampu menjaga kemiripan maksimal 5 orang dalam satu gambar, dan menjaga kesetiaan hingga 14 objek. Di atas angka itu, wajah mulai bergeser. Untuk foto keluarga besar, hasil paling stabil didapat dengan memotret kelompok kecil lalu menggabungkannya.

Prompt Gemini AI untuk Mengedit Foto yang Sudah Ada

Bagian ini justru yang paling berguna sehari-hari, dan cara kerjanya berbeda. Anda mengunggah foto lebih dulu, lalu menulis instruksi tentang apa yang berubah dan apa yang tetap.

Google menyebut tekniknya semantic masking. Pada aplikasi edit foto biasa, Anda menyeleksi area dengan kuas. Di Gemini, seleksi itu Anda lakukan lewat kalimat. Karena itu satu kebiasaan jadi wajib: sebutkan secara tegas apa yang harus tetap sama. Tanpa penegasan itu, model merasa bebas menyentuh seluruh gambar.

Empat tugas edit foto di Gemini: ganti latar, hapus objek, gabung dua foto, dan perjelas foto.Empat tugas edit foto di Gemini: ganti latar, hapus objek, gabung dua foto, dan perjelas foto.

Mengubah latar menjadi pas foto:

Code
Ganti latar belakang foto ini menjadi biru polos rata tanpa gradasi.
Pertahankan wajah, rambut, pakaian, dan posisi tubuh persis seperti aslinya.
Rapikan tepi rambut agar bersih dari sisa latar lama. Hasil akhir rasio 2:3.

Ganti "biru" dengan "merah" untuk keperluan dokumen yang mensyaratkan latar merah. Perlu dicatat, sebagian instansi mensyaratkan pas foto berupa hasil pemotretan asli, sehingga foto olahan AI belum tentu diterima. Untuk lamaran kerja dan kebutuhan tidak resmi, cara ini menghemat waktu.

Menghapus orang yang tidak diinginkan:

Code
Hapus orang yang berdiri di sisi kanan foto ini. Isi area bekasnya dengan
lanjutan pagar dan tanaman yang ada di sekitarnya. Pertahankan dua orang di
tengah, arah pencahayaan, dan warna keseluruhan persis seperti aslinya.

Menggabungkan dua foto jadi satu:

Code
Gabungkan kedua foto ini menjadi satu potret berdua. Ambil orang dari gambar
pertama dan orang dari gambar kedua, tempatkan berdampingan dengan tinggi
bahu sejajar. Latar studio abu-abu polos. Samakan arah dan suhu cahaya pada
kedua wajah. Medium shot, rasio 3:2.

Memperbaiki foto lama yang buram:

Code
Perjelas foto lama ini: pertajam detail wajah dan tekstur pakaian, kurangi
bintik dan goresan, kembalikan warna kulit yang memudar. Pertahankan bentuk
wajah, potongan rambut, dan pakaian persis seperti aslinya. Batasi perubahan
hanya pada ketajaman, bintik, dan warna.

Satu hal yang perlu Anda pahami soal perintah terakhir: Gemini tidak mempertajam foto asli, melainkan menggambar ulang versi baru yang terlihat lebih tajam. Detail yang hilang di foto buram tidak dikembalikan, tetapi ditebak. Untuk kenangan keluarga hasilnya menyenangkan, tetapi jangan dipakai sebagai bukti dokumentasi.

Karena itu pula menambahkan kata "HD", "4K", atau "resolusi tinggi" ke dalam prompt hampir tidak berpengaruh. Ketajaman keluaran ditentukan oleh akun Anda, bukan oleh kata sifat di dalam kalimat. Akun gratis menerima gambar 1K, akun berbayar sampai 2K, dan Nano Banana Pro menyediakan pilihan 4K. Yang benar-benar bisa Anda kendalikan lewat prompt adalah detail yang digambar, bukan jumlah pikselnya.

Cara Menjaga Wajah Tetap Sama

Permintaan yang paling sering muncul saat menyunting foto adalah mengganti latar atau pakaian tanpa mengubah wajah. Keluhannya pun sama: wajahnya berubah. Penyebabnya masuk akal begitu Anda memahami cara kerjanya: model tidak menempelkan wajah Anda ke gambar baru, ia menggambar ulang seluruh gambar termasuk wajahnya. Semakin sedikit petunjuk yang Anda berikan tentang wajah itu, semakin bebas ia menafsirkan.

Ada tiga hal yang membantu, dan ketiganya bisa Anda pakai bersamaan.

  1. Unggah foto acuan yang jelas. Wajah yang menghadap depan, cahaya rata, dan resolusi cukup memberi model bahan yang jauh lebih banyak daripada foto dari kejauhan.
  2. Sebutkan ciri yang harus dipertahankan satu per satu. Bukan "wajahnya sama", tetapi "pertahankan bentuk wajah, jarak mata, garis rahang, warna kulit, dan tatanan rambut dari foto acuan".
  3. Ubah satu hal dalam satu perintah. Ganti latar dulu, periksa hasilnya, baru ganti pakaian. Perubahan bertumpuk dalam satu prompt memperbesar peluang wajah ikut bergeser.

Digabung, bentuknya seperti ini:

Code
Pertahankan bentuk wajah, jarak mata, garis rahang, warna kulit, dan tatanan
rambut dari foto acuan persis seperti aslinya. Ubah hanya latar menjadi ruang
kantor modern dengan jendela besar di belakang. Medium shot, cahaya jendela
lembut dari kiri, rasio 4:5.

Meski begitu, ada batas yang diakui Google sendiri. Dalam catatan resminya, DeepMind menyebut akurasi teks, wajah berukuran kecil, dan detail halus masih menjadi kelemahan modelnya. Artinya foto rombongan dengan wajah-wajah kecil di kejauhan memang lebih rawan berubah dibanding potret setengah badan, berapa pun telitinya prompt Anda.

Hal yang Perlu Anda Pertimbangkan Sebelum Memakainya

Kemampuan di atas datang bersama beberapa konsekuensi yang sebaiknya Anda ketahui sejak awal.

Setiap gambar membawa tanda buatan AI. Semua gambar keluaran Gemini disisipi SynthID, watermark digital tak kasatmata yang memungkinkan pengecekan apakah sebuah gambar dibuat atau disunting oleh AI Google. Di luar itu ada watermark yang benar-benar terlihat berupa ikon Gemini sparkle. Google menyatakan watermark tampak ini ada pada keluaran pengguna gratis maupun pelanggan Google AI Pro. Hanya pelanggan Google AI Ultra yang mendapat gambar tanpa ikon tersebut di aplikasi Gemini. Jadi kalau hasilnya akan dipakai untuk keperluan komersial, periksa dulu sudut gambarnya.

Jatah pemakaian ada batasnya, dan angkanya tidak diumumkan. Halaman bantuan resmi Gemini tidak lagi mencantumkan jumlah gambar per hari. Yang disebutkan hanya perbandingan relatif. Pengguna tanpa langganan mendapat batas standar, Google AI Plus dua kali lipat, AI Pro empat kali lipat, dan AI Ultra beberapa kali lipat di atas AI Pro. Batas tersebut disegarkan setiap lima jam sampai kuota mingguan habis.

Karena tidak ada angka pasti yang bisa dipegang, hematlah jatah itu. Tulis satu prompt yang lengkap sejak awal, bukan mencoba berkali-kali dengan prompt pendek.

Wajah orang terkenal akan ditolak. Prompt bergaya "foto bersama idola" atau "berfoto dengan artis" termasuk yang paling sering dicari, dan paling sering gagal. Aturan keamanan Gemini menolak permintaan menggambar orang yang bisa dikenali publik, dan Kebijakan Penggunaan Terlarang AI Generatif milik Google secara terpisah melarang penggambaran seseorang tanpa persetujuannya. Penolakan itu kadang juga mengenai foto pribadi yang wajahnya kebetulan mirip figur publik. Kalau prompt Anda ditolak padahal isinya wajar, kemungkinan besar inilah pemicunya.

Hasilnya tetap gambar buatan, bukan foto. Pakaian yang tidak pernah Anda miliki, tempat yang tidak pernah Anda kunjungi, dan tanggal yang tidak pernah terjadi tetap bukan dokumentasi. Untuk melamar kerja, foto profil, atau konten media sosial, tidak ada masalah. Untuk dokumen resmi dan bukti, gunakan foto asli.

Pertanyaan yang Sering Diajukan

Apakah prompt harus ditulis dalam bahasa Inggris? Tidak. Prompt yang ditulis dalam bahasa Indonesia bekerja dengan baik. Yang sebaiknya tetap berbahasa Inggris hanyalah istilah teknis fotografi seperti golden hour, softbox, atau depth of field. Istilah itu tidak punya padanan Indonesia yang baku.

Bagaimana cara mengatur rasio gambar? Cukup sebutkan rasionya di akhir prompt, misalnya "rasio 9:16". Rasio yang didukung ada sepuluh: 1:1, 3:2, 2:3, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9, dan 21:9. Kalau Anda tidak menyebutkannya, model memilih sendiri berdasarkan konteks — permintaan wallpaper ponsel biasanya otomatis jadi vertikal.

Apakah membuat gambar di Gemini gratis? Ada jatah gratis tanpa berlangganan, tetapi jumlahnya tidak diumumkan dan disegarkan setiap lima jam. Gambar dari akun gratis juga membawa watermark Gemini sparkle yang terlihat.

Prompt Gemini AI mana yang sedang banyak dipakai? Tema yang ramai berganti setiap beberapa bulan, dan prompt yang terikat pada satu tema ikut kedaluwarsa bersamanya. Rumus lima bagian di artikel ini tidak ikut usang, karena yang diatur adalah struktur instruksinya, bukan temanya.

Bisakah prompt Gemini AI membuat gambar bergerak? Bisa, tetapi lewat model yang berbeda. Gambar diam ditangani Nano Banana, sedangkan video ditangani Gemini Omni yang diperkenalkan Google pada Mei 2026. Omni menerima gabungan gambar, audio, video, dan teks lalu mengeluarkan video. Aksesnya terbuka untuk pelanggan Google AI Plus, Pro, dan Ultra di aplikasi Gemini, serta gratis lewat YouTube Shorts. Semua videonya membawa SynthID.

Bisakah Gemini memperjelas foto yang blur? Bisa membuat versi yang terlihat lebih tajam, tetapi caranya menggambar ulang, bukan memulihkan. Detail yang benar-benar hilang akan ditebak, sehingga hasilnya tidak sahih sebagai bukti.

Kesimpulan

Prompt Gemini AI yang bekerja dengan baik hampir selalu berisi lima bagian yang sama: subjek, aksi, lokasi, komposisi, dan gaya. Dua aturan penulisan menentukan sisanya — sebutkan yang Anda inginkan alih-alih yang Anda hindari, dan tulis dalam kalimat utuh, bukan tumpukan kata kunci. Untuk menyunting foto yang sudah ada, tambahkan satu kebiasaan: tegaskan apa yang harus tetap sama.

Selama Anda menguasai strukturnya, Anda tidak perlu lagi berburu kumpulan prompt setiap kali muncul tren baru — cukup susun sendiri sesuai kebutuhan. Ingat juga batasannya: watermark yang menyertai setiap gambar, jatah pemakaian yang terbatas, dan hasil yang tetap merupakan gambar buatan, bukan dokumentasi. Semoga artikel ini membantu.