Google Gemini 3.7 Flash'ı duyurdu: kodlama, ajanlar ve bilgi işi için hibrit akıl yürütme
Gemini 3.7 Flash, 13 Ağustos 2026'da yerel hibrit akıl yürütme, yapılandırılabilir thinking budget, frontier kodlama kıyaslamaları ve Aralık'a kadar %50 tanıtım indirimiyle geliyor.
Hibrit akıl yürütmenin yeni amiral gemisi
13 Ağustos 2026’da Google, kodlama, ajanlar ve karmaşık bilgi işi için tasarlanmış amiral gemisi hibrit akıl yürütme modeli Gemini 3.7 Flash’ı yayınladı. Derinlikten hız uğruna vazgeçen önceki Flash nesillerinin aksine 3.7 Flash, API’ye yerel yapılandırılabilir akıl yürütme gömüyor: ayrı bir «akıl yürütme modeli»ne geçmeden istek başına düşünme derinliğini ayarlıyorsunuz.
Lansman aynı anda üç kitleyi hedefliyor: üretim ajanları kuran geliştiriciler, uzun soluklu kodlama görevleri yürüten ekipler ve devasa belge setlerinde güvenilir çok modlu analiz gerektiren kurumlar. Google, 3.7 Flash’ı hem 100 ms altı sohbet yanıtları hem de dakikalar süren derin araştırmalar için tek bir uç nokta sunan model olarak konumlandırıyor.
Yerel hibrit akıl yürütme ve thinking budget
Merkezde thinking_config.thinking_budget var — modelin yanıtlamadan önce harcayabileceği iç akıl yürütme token sayısını kontrol eden bir tam sayı.
thinking_budget | Davranış | En uygun |
|---|---|---|
| 0 | Ultra düşük gecikmeli hızlı mod (ilk token 85 ms altı) | Canlı sohbet, otomatik tamamlama, yüksek QPS yönlendirme |
| 256–1024 | Hafif çok adımlı planlama | Araç yönlendirme, basit refaktörler, RAG sentezi |
| 4096–16384 | Derin çok adımlı akıl yürütme | Ajan döngüleri, karmaşık hata ayıklama, araştırma raporları |
| 32768–65536 | Maksimum derinlik | Uzun soluklu kodlama, çok dosyalı mimari değişiklikleri |
Gemini API’de şöyle ayarlayın:
from google import genai
from google.genai import types
client = genai.Client()
response = client.models.generate_content(
model="gemini-3.7-flash",
contents="Bu React bileşenini hooks kullanacak şekilde refaktör et ve error boundary ekle.",
config=types.GenerateContentConfig(
thinking_config=types.ThinkingConfig(
thinking_budget=8192 # 0 = hızlı mod; derin akıl yürütme için 65536'ya kadar
)
),
)
print(response.text)
Akıl yürütme yerel olduğu için gecikme düzgün ölçeklenir: thinking_budget 0 iken klasik Flash gibi davranır, daha yüksek değerler model kimliği değiştirmeden chain-of-thought kalitesi sağlar. Faturalandırma görünür çıktı tokenlarını iç düşünme tokenlarından ayırır — yalnızca istediğiniz derinlik için ödersiniz.
Kıyaslama öne çıkanları
Google, Gemini 3.6 Flash, Claude Sonnet 5 ve GPT-5.6 Terra ile doğrudan karşılaştırma rakamları yayınladı. 3.7 Flash listelenen tüm değerlendirmelerde önde:
| Kıyaslama | Gemini 3.7 Flash | Gemini 3.6 Flash | Claude Sonnet 5 | GPT-5.6 Terra |
|---|---|---|---|---|
| FrontierCode 1.1 | %43,6 | %34,4 | %39,1 | %37,8 |
| DeepSWE v1.1 | %65,3 | %49,0 | %56,2 | %53,4 |
| WebDev Arena (Elo) | 1588 | 1538 | 1552 | 1544 |
| GDP.pdf | %34,0 | %22,0 | %28,5 | %26,8 |
| AutomationBench | %30,4 | %17,0 | %23,1 | %21,5 |
| GDM-MRCR v2 | %97,0 | %91,2 | %94,5 | %93,1 |
| HLE-Verified | %53,6 | %44,8 | %48,2 | %46,7 |
Geliştiriciler için iki rakam öne çıkıyor:
- DeepSWE v1.1’de %65,3 — 3.6 Flash’a göre 16 puanlık sıçrama; ajanlı kodlama birincil eğitim hedefi.
- GDM-MRCR v2’de %97,0 — 2,5M token pencerede neredeyse mükemmel uzun bağlam geri getirme; belge ağırlıklı iş akışları için kritik.
Önceki nesil bağlamı için Gemini 3.6 Flash vs 3.5 Flash karşılaştırmasına bakın.
Fiyatlandırma ve %50 tanıtım indirimi
Google agresif bir lansman promosyonu yürütüyor:
| Tanıtım fiyatı (31 Ara 2026’ya kadar) | Standart fiyat (1 Oca 2027’den itibaren) | |
|---|---|---|
| Girdi | $0,75 / 1M token | $1,50 / 1M token |
| Çıktı | $3,75 / 1M token | $7,50 / 1M token |
| Bağlam önbelleği | $0,075 / 1M token | $0,075 / 1M token |
2026’nın geri kalanında girdi ve çıktıda %50 indirim. Büyük sistem istemlerini veya belge külliyatlarını yeniden kullandığınızda faydalı bağlam önbelleği, promosyon döneminden bağımsız olarak milyon token başına $0,075’tir.
Daha yüksek thinking budget ile daha az araç çağrısı turu birleşince, tamamlanan ajan görevi başına efektif maliyet token etiket fiyatının çok altına inebilir. API maliyet tahmin rehberimiz tipik iş yüklerini hesaplar.
Çok modlu, web dev ve ajan yetenekleri
Kıyaslamaların ötesinde 3.7 Flash üretime hazır özellikler sunuyor:
- 2,5M token bağlam penceresi — tüm codebase’ler, sözleşme paketleri veya araştırma külliyatları tek seferde.
- Saniyede 245 çıktı token — UX’i boğmadan UI kodu ve uzun raporları akıtacak kadar hızlı.
- %99,7 JSON araç yürütme doğruluğu — ajan araç zincirleri için güvenilir yapılandırılmış çıktılar.
- Computer use — tarayıcı ve masaüstü iş akışları için yerleşik istemci tarafı otomasyon.
- UI üretim sadakati — WebDev Arena’da (1588 Elo) daha yüksek düzen doğruluğu, daha temiz üretilmiş frontend’ler demek.
Bugün Gemini API, Google AI Studio, Gemini Enterprise ve Google Antigravity üzerinden kullanılabilir.
Geliştirici rehberi ve geçiş
3.6 Flash veya 3.5 Flash-Lite’tan yükseltiyorsanız şu kalıplarla başlayın:
- Model kimliğini değiştirin —
gemini-3.6-flashyerinegemini-3.7-flash; API yüzeyi geriye uyumlu. - Görev türüne göre thinking budget ayarlayın — kullanıcı sohbeti için
0, RAG Q&A için1024, kodlama ajanları için8192+, gecikmenin önemsiz olduğu gece batch işleri için yalnızca32768. - Bağlam önbelleğini etkinleştirin — sistem istemi veya belge seti 32K token’ı aşıyor ve istekler arasında tekrarlanıyorsa girdi maliyeti %90 düşer.
- Araç şemalarını ayarlayın — %99,7 JSON doğruluğu katı şemaları ödüllendirir; gevşek tanımlar uygulama katmanında yine başarısız olur.
- Düşünme token kullanımını izleyin — hangi ajan adımlarının gerçekten derin akıl yürütme gerektirdiğini anlamak için
usage_metadatakaydedin.
Ajanlı iş akışı kalıpları için 3.5 Flash-Lite ajanlı iş akışları rehberi — thinking budget kavramı 3.7 Flash’ta daha ince granülariteyle doğal olarak genişler.
Sonuç
Gemini 3.7 Flash, hız ve derinliğin karşılıklı dışlayıcı olmadığı ilk Flash seviyesi model. Yapılandırılabilir thinking_budget, tek modelin gecikmeye duyarlı sohbet ile derin ajanlı kodlamayı birden sunmasını sağlar; lansman fiyatları 2026 sonuna kadar denemeyi ucuzlatır.