Gemini Omni
Kembali ke semua artikel
8 mnt baca

Google Umumkan Gemini 3.6 Flash, 3.5 Flash-Lite dan 3.5 Flash Cyber: Semua yang Perlu Anda Tahu

Google baru saja merilis Gemini 3.6 Flash, 3.5 Flash-Lite dan 3.5 Flash Cyber. Harga, benchmark, ketersediaan, keamanan, dan peta jalan Gemini 4 — ulasan lengkap.

Gemini 3.6 FlashGemini 3.5 Flash-LiteGemini 3.5 Flash CyberModelsAnnouncement2026Bahasa Indonesia

Tiga model Flash baru dalam satu hari

Pada 21 Juli 2026, Google mengumumkan tiga model Gemini baru sekaligus: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite, dan Gemini 3.5 Flash Cyber. Benang merahnya jelas — ketiganya membidik masalah yang sama yang terus disuarakan developer: agen AI di produksi butuh efisiensi token lebih tinggi, latensi lebih rendah, dan performa lebih andal, bukan sekadar skor besar di judul berita.

Artikel ini mengupas fungsi tiap model, biayanya, di mana bisa dipakai hari ini, dan bocoran Google soal langkah berikutnya (spoiler: Gemini 3.5 Pro sedang diuji bersama mitra, dan pre-training Gemini 4 sudah dimulai). Semua angka berasal dari pengumuman resmi.

Sekilas jajaran modelnya

ModelPeranStatistik utamaAkses
Gemini 3.6 FlashAndalan: coding, pekerjaan pengetahuan, multimodal17% lebih sedikit token output dibanding 3.5 Flash, dengan harga lebih murahTersedia umum hari ini
Gemini 3.5 Flash-LiteModel kelas 3.5 tercepat dan paling hemat biaya350 token output/detik (Artificial Analysis)Tersedia umum hari ini
Gemini 3.5 Flash CyberSpesialis keamanan untuk menemukan & memperbaiki kerentananBersaing dengan model frontier di CyberGym dalam CodeMenderHanya pilot akses terbatas

Gemini 3.6 Flash: andalan baru

3.6 Flash dibangun langsung dari umpan balik developer terhadap 3.5 Flash. Klaimnya tidak biasa untuk peluncuran model: bukan cuma lebih baik, tetapi lebih hemat. Pada Artificial Analysis Index, ia mengonsumsi 17% lebih sedikit token output dibanding 3.5 Flash, dan di beberapa benchmark — seperti DeepSWE dari Datacurve — Google mengamati penurunan hingga 65%. Model ini juga butuh lebih sedikit langkah penalaran dan pemanggilan alat untuk menyelesaikan alur kerja multi-langkah, yang berlipat menjadi penghematan nyata pada tugas agentik.

Peningkatan benchmark Gemini 3.6 Flash atas 3.5 Flash di DeepSWE, MLE Bench, OSWorld-Verified dan GDPval-AA v2

Sorotan benchmark dibandingkan 3.5 Flash:

BenchmarkGemini 3.6 FlashGemini 3.5 Flash
DeepSWE (coding agentik)49%37%
MLE Bench (riset ML)63,9%49,7%
OSWorld-Verified (penggunaan komputer)83,0%78,4%
GDPval-AA v2 (pekerjaan pengetahuan)14211349

Dua detail hari peluncuran lain yang penting bagi para builder:

  • Penggunaan komputer kini menjadi alat sisi klien bawaan melalui Gemini API dan Gemini Enterprise — tanpa perlu perancah terpisah.
  • Pelanggan awal termasuk Figma, Harvey, Hebbia, dan JetBrains; Hebbia dan Harvey secara khusus menyoroti kekuatan multimodal seperti parsing dokumen, analisis grafik dan data, serta penyusunan laporan.

Demo Google yang membandingkan efisiensi token secara berdampingan pada tugas OSWorld layak ditonton: demo efisiensi token 3.6 Flash vs 3.5 Flash (video).

Untuk perbandingan lengkap, lihat ulasan mendalam Gemini 3.6 Flash vs 3.5 Flash kami.

Gemini 3.5 Flash-Lite: dibuat untuk menskalakan alur kerja agentik

Flash-Lite adalah pemain volume. Ini model tercepat di seri 3.5 dengan 350 token output per detik (Artificial Analysis), ditujukan untuk pencarian agentik, pemrosesan dokumen, dan pipeline apa pun di mana throughput menjadi hambatan.

Lompatan kualitas dari 3.1 Flash-Lite sangat dramatis — Terminal-Bench 2.1 di 54% vs 31%, GDM-MRCR v2 konteks panjang di 72,2% vs 60,1%, dan GDPval-AA v2 di 1140 vs 642. Yang mengejutkan, di beberapa evaluasi agentik ia bahkan mengalahkan Gemini 3 Flash yang lebih besar, termasuk SWE-Bench Pro (54,2% vs 49,6%) dan OSWorld-Verified (74,0% vs 65,1%).

Model ini hadir dengan tingkat berpikir yang dapat dikonfigurasi — jalankan minimal/rendah untuk tugas bervolume tinggi yang sensitif latensi, atau naikkan tingkatnya untuk beban kerja subagen multi-langkah — dan penggunaan komputer juga bawaan di sini. Pelanggan awal termasuk Ashler, Palo Alto Networks, dan Ramp, dan model ini sedang diluncurkan di dalam Google Search dan aplikasi Gemini.

Panduan alur kerja agentik 3.5 Flash-Lite kami membahas tingkat berpikir, kalkulasi biaya, dan pemilihan model secara mendalam.

Harga: lebih murah di kedua tingkatan

ModelInput ($/1M token)Output ($/1M token)Catatan
Gemini 3.6 Flash$1.50$7.50Lebih murah dari 3.5 Flash, plus ~17% lebih sedikit token output
Gemini 3.5 Flash-Lite$0.30$2.50Rasio harga-performa terbaik untuk trafik bervolume tinggi
Gemini 3.5 Flash CyberTidak diberi harga publik; pilot akses terbatas via CodeMender

Cerita biaya sesungguhnya ada di perkaliannya: 3.6 Flash mengenakan tarif lebih murah per token dan menghasilkan lebih sedikit token per tugas, sehingga biaya efektif per tugas agentik turun lebih dalam daripada yang tersirat dari daftar harga.

Gemini 3.5 Flash Cyber: spesialis di balik tirai eksklusif

Model ketiga berbeda. 3.5 Flash Cyber dibangun di atas 3.5 Flash dan di-fine-tune untuk menemukan dan memperbaiki kerentanan keamanan dengan harga per token lebih rendah daripada model yang lebih besar. Ia berjalan di dalam CodeMender, agen keamanan kode Google, di mana beberapa agen 3.5 Flash Cyber bekerja bersama menghasilkan satu laporan gabungan — mencapai performa yang bersaing dengan model frontier di benchmark CyberGym.

Hasil benchmark CyberGym Gemini 3.5 Flash Cyber di dalam CodeMender

Karena teknologinya bersifat dwiguna, Google sengaja tidak merilisnya secara luas: model ini akan tersedia eksklusif bagi pemerintah dan mitra tepercaya melalui CodeMender sebagai bagian dari pilot akses terbatas. Tujuannya memberi para pembela garis depan keunggulan waktu untuk menambal kerentanan kritis sebelum dieksploitasi.

Keamanan: lebih sedikit jailbreak, lebih sedikit penolakan

3.6 Flash hadir dengan pengaman Frontier Safety yang ditingkatkan yang mencakup penyalahgunaan CBRN (Kimia, Biologi, Radiologi, Nuklir) dan serangan siber. Google menyatakan model ini jauh lebih tahan terhadap jailbreak sekaligus dilatih untuk meminimalkan penolakan atas penggunaan yang sah — kombinasi yang benar-benar diinginkan developer, alih-alih sikap kaku yang menolak segalanya.

Di mana bisa dipakai hari ini

PlatformGemini 3.6 FlashGemini 3.5 Flash-Lite
Gemini API (Google AI Studio, Android Studio)
Google Antigravity
Gemini Enterprise Agent Platform
Aplikasi Gemini Enterprise
Aplikasi Gemini
Google Search✅ Sedang diluncurkan
CodeMender (3.5 Flash Cyber)Pilot terbatas: hanya pemerintah & mitra tepercaya

Bocoran peta jalan: 3.5 Pro dan Gemini 4

Dua catatan berorientasi masa depan yang terselip dalam pengumuman patut diperhatikan:

  1. Gemini 3.5 Pro saat ini sedang diuji bersama mitra, dengan ketersediaan luas direncanakan “begitu siap”.
  2. Google telah memulai proses pre-training paling ambisiusnya — untuk Gemini 4 — dan mengaku “bersemangat dengan kemajuannya”.

Dibaca bersama, rilis di tingkat Flash ini tampak seperti lapisan efisiensi yang dikunci sebelum dorongan frontier berikutnya.

Intinya

Jika Anda membangun agen, ini peluncuran langka di mana langkah yang tepat sudah jelas: 3.6 Flash untuk pekerjaan agentik yang sensitif kualitas, 3.5 Flash-Lite untuk throughput bervolume tinggi — keduanya lebih murah dari model yang digantikan. Sementara itu, Flash Cyber menandakan arah fine-tune terspesialisasi menurut Google: kuat, sempit, dan sengaja dibatasi.

Terkait