Google Umumkan Gemini 3.6 Flash, 3.5 Flash-Lite dan 3.5 Flash Cyber: Semua yang Anda Perlu Tahu
Google baru sahaja melancarkan Gemini 3.6 Flash, 3.5 Flash-Lite dan 3.5 Flash Cyber. Harga, penanda aras, ketersediaan, keselamatan dan pelan hala tuju Gemini 4.
Tiga model Flash baharu dalam satu hari
Pada 21 Julai 2026, Google mengumumkan tiga model Gemini baharu dalam satu pelancaran: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite dan Gemini 3.5 Flash Cyber. Benang merahnya jelas — ketiga-tiganya menyasarkan masalah sama yang terus dibangkitkan pembangun: ejen AI dalam produksi memerlukan kecekapan token lebih tinggi, kependaman lebih rendah dan prestasi lebih boleh dipercayai, bukan sekadar skor besar di tajuk berita.
Artikel ini merungkai kegunaan setiap model, kosnya, di mana ia boleh digunakan hari ini, dan apa yang Google bayangkan tentang masa depan (pembocor: Gemini 3.5 Pro sedang diuji bersama rakan kongsi, dan larian pra-latihan Gemini 4 sudah pun bermula). Semua angka datang daripada pengumuman rasmi.
Barisan model sepintas lalu
| Model | Peranan | Statistik utama | Akses |
|---|---|---|---|
| Gemini 3.6 Flash | Kuda kerja: pengekodan, kerja pengetahuan, multimodal | 17% kurang token output berbanding 3.5 Flash, pada harga lebih rendah | Tersedia umum hari ini |
| Gemini 3.5 Flash-Lite | Model kelas 3.5 terpantas dan paling menjimatkan | 350 token output/saat (Artificial Analysis) | Tersedia umum hari ini |
| Gemini 3.5 Flash Cyber | Pakar keselamatan untuk mencari & membaiki kerentanan | Bersaing dengan model frontier pada CyberGym dalam CodeMender | Perintis akses terhad sahaja |
Gemini 3.6 Flash: kuda kerja baharu
3.6 Flash dibina terus daripada maklum balas pembangun terhadap 3.5 Flash. Pendekatannya luar biasa untuk pelancaran model: bukan sekadar lebih baik, tetapi lebih berjimat. Pada Artificial Analysis Index, ia menggunakan 17% kurang token output berbanding 3.5 Flash, dan pada sesetengah penanda aras — seperti DeepSWE oleh Datacurve — Google memerhatikan pengurangan sehingga 65%. Ia juga memerlukan lebih sedikit langkah penaakulan dan panggilan alat untuk menyiapkan aliran kerja berbilang langkah, yang tergandakan menjadi penjimatan sebenar pada tugas agentik.

Sorotan penanda aras berbanding 3.5 Flash:
| Penanda aras | Gemini 3.6 Flash | Gemini 3.5 Flash |
|---|---|---|
| DeepSWE (pengekodan agentik) | 49% | 37% |
| MLE Bench (penyelidikan ML) | 63.9% | 49.7% |
| OSWorld-Verified (penggunaan komputer) | 83.0% | 78.4% |
| GDPval-AA v2 (kerja pengetahuan) | 1421 | 1349 |
Dua lagi butiran hari pelancaran yang penting bagi pembina:
- Penggunaan komputer kini menjadi alat sisi klien terbina dalam melalui Gemini API dan Gemini Enterprise — tiada perancah berasingan diperlukan.
- Pelanggan awal termasuk Figma, Harvey, Hebbia dan JetBrains; Hebbia dan Harvey secara khusus menonjolkan kekuatan multimodal seperti penghuraian dokumen, analisis carta dan data, serta penggubalan laporan.
Demo Google yang membandingkan kecekapan token secara bersebelahan pada tugas OSWorld berbaloi ditonton: demo kecekapan token 3.6 Flash vs 3.5 Flash (video).
Untuk perbandingan penuh, lihat ulasan mendalam Gemini 3.6 Flash vs 3.5 Flash kami.
Gemini 3.5 Flash-Lite: dibina untuk menskalakan aliran kerja agentik
Flash-Lite ialah pemain volum. Ia model terpantas dalam siri 3.5 pada 350 token output sesaat (Artificial Analysis), disasarkan untuk carian agentik, pemprosesan dokumen dan mana-mana saluran paip yang throughput menjadi kesesakan.
Lonjakan kualiti berbanding 3.1 Flash-Lite amat dramatik — Terminal-Bench 2.1 pada 54% vs 31%, GDM-MRCR v2 konteks panjang pada 72.2% vs 60.1%, dan GDPval-AA v2 pada 1140 vs 642. Yang mengagumkan, ia malah menewaskan Gemini 3 Flash yang lebih besar pada beberapa penilaian agentik, termasuk SWE-Bench Pro (54.2% vs 49.6%) dan OSWorld-Verified (74.0% vs 65.1%).
Ia hadir dengan tahap pemikiran boleh dikonfigurasi — jalankan minimal/rendah untuk tugas bervolum tinggi yang kritikal kependaman, atau naikkan tahap untuk beban kerja subejen berbilang langkah — dan penggunaan komputer juga terbina dalam di sini. Pelanggan awal termasuk Ashler, Palo Alto Networks dan Ramp, dan model ini sedang dilancarkan dalam Google Search dan apl Gemini.
Panduan aliran kerja agentik 3.5 Flash-Lite kami merangkumi tahap pemikiran, pengiraan kos dan pemilihan model secara mendalam.
Harga: lebih murah di kedua-dua peringkat
| Model | Input ($/1M token) | Output ($/1M token) | Nota |
|---|---|---|---|
| Gemini 3.6 Flash | $1.50 | $7.50 | Lebih rendah daripada 3.5 Flash, ditambah ~17% kurang token output |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | Nisbah harga-prestasi terbaik untuk trafik bervolum tinggi |
| Gemini 3.5 Flash Cyber | — | — | Tiada harga awam; perintis akses terhad melalui CodeMender |
Kisah kos sebenar terletak pada pendaraban: 3.6 Flash mengenakan bayaran lebih rendah setiap token dan menghasilkan lebih sedikit token setiap tugas, jadi kos berkesan setiap tugas agentik jatuh lebih dalam daripada yang dicadangkan senarai harga.
Gemini 3.5 Flash Cyber: pakar di sebalik tirai eksklusif
Model ketiga berbeza. 3.5 Flash Cyber dibina di atas 3.5 Flash dan ditala halus untuk mencari dan membaiki kerentanan keselamatan pada harga setiap token lebih rendah daripada model yang lebih besar. Ia berjalan dalam CodeMender, ejen keselamatan kod Google, di mana beberapa ejen 3.5 Flash Cyber bekerjasama menghasilkan satu laporan gabungan — mencapai prestasi yang bersaing dengan model frontier pada penanda aras CyberGym.

Oleh kerana teknologi ini bersifat dwiguna, Google sengaja tidak melancarkannya secara meluas: ia akan tersedia secara eksklusif kepada kerajaan dan rakan kongsi dipercayai melalui CodeMender sebagai sebahagian daripada perintis akses terhad. Matlamatnya adalah memberikan pembela barisan hadapan kelebihan masa untuk menampal kerentanan kritikal sebelum ia dieksploitasi.
Keselamatan: kurang jailbreak, kurang penolakan
3.6 Flash hadir dengan perlindungan Frontier Safety dipertingkat merangkumi penyalahgunaan CBRN (Kimia, Biologi, Radiologi, Nuklear) dan serangan siber. Google berkata model ini jauh lebih tahan terhadap jailbreak sambil turut dilatih untuk meminimumkan penolakan bagi kegunaan yang sah — gabungan yang benar-benar dimahukan pembangun, bukannya sikap kaku menolak segala-galanya.
Di mana boleh digunakan hari ini
| Permukaan | Gemini 3.6 Flash | Gemini 3.5 Flash-Lite |
|---|---|---|
| Gemini API (Google AI Studio, Android Studio) | ✅ | ✅ |
| Google Antigravity | ✅ | — |
| Gemini Enterprise Agent Platform | ✅ | ✅ |
| Apl Gemini Enterprise | ✅ | — |
| Apl Gemini | ✅ | ✅ |
| Google Search | — | ✅ Sedang dilancarkan |
| CodeMender (3.5 Flash Cyber) | Perintis terhad: kerajaan & rakan kongsi dipercayai sahaja |
Bayangan hala tuju: 3.5 Pro dan Gemini 4
Dua nota berpandangan ke hadapan yang terselit dalam pengumuman ini wajar diberi perhatian:
- Gemini 3.5 Pro kini sedang diuji bersama rakan kongsi, dengan ketersediaan meluas dirancang “sebaik sahaja ia sedia”.
- Google telah memulakan larian pra-latihan paling bercita-cita tinggi setakat ini — untuk Gemini 4 — dan berkata ia “teruja dengan kemajuannya”.
Dibaca bersama, keluaran peringkat Flash ini kelihatan seperti lapisan kecekapan yang dikunci kemas sebelum tolakan frontier seterusnya.
Kesimpulannya
Jika anda membina ejen, ini pelancaran yang jarang berlaku di mana langkah yang betul sudah jelas: 3.6 Flash untuk kerja agentik yang sensitif kualiti, 3.5 Flash-Lite untuk throughput bervolum tinggi — kedua-duanya lebih murah daripada model yang digantikan. Sementara itu, Flash Cyber menandakan ke mana Google fikir penalaan halus khusus sedang menuju: berkuasa, sempit dan sengaja dikawal ketat.