Gemini Omni
Tüm makalelere dön
9 dk okuma

Google Gemini 3.7 Flash'ı duyurdu: kodlama, ajanlar ve bilgi işi için hibrit akıl yürütme

Gemini 3.7 Flash, 13 Ağustos 2026'da yerel hibrit akıl yürütme, yapılandırılabilir thinking budget, frontier kodlama kıyaslamaları ve Aralık'a kadar %50 tanıtım indirimiyle geliyor.

Gemini 3.7 FlashHybrid ReasoningCodingBenchmarksPricingAnnouncement2026Türkçe

Hibrit akıl yürütmenin yeni amiral gemisi

13 Ağustos 2026’da Google, kodlama, ajanlar ve karmaşık bilgi işi için tasarlanmış amiral gemisi hibrit akıl yürütme modeli Gemini 3.7 Flash’ı yayınladı. Derinlikten hız uğruna vazgeçen önceki Flash nesillerinin aksine 3.7 Flash, API’ye yerel yapılandırılabilir akıl yürütme gömüyor: ayrı bir «akıl yürütme modeli»ne geçmeden istek başına düşünme derinliğini ayarlıyorsunuz.

Lansman aynı anda üç kitleyi hedefliyor: üretim ajanları kuran geliştiriciler, uzun soluklu kodlama görevleri yürüten ekipler ve devasa belge setlerinde güvenilir çok modlu analiz gerektiren kurumlar. Google, 3.7 Flash’ı hem 100 ms altı sohbet yanıtları hem de dakikalar süren derin araştırmalar için tek bir uç nokta sunan model olarak konumlandırıyor.

Yerel hibrit akıl yürütme ve thinking budget

Merkezde thinking_config.thinking_budget var — modelin yanıtlamadan önce harcayabileceği iç akıl yürütme token sayısını kontrol eden bir tam sayı.

thinking_budgetDavranışEn uygun
0Ultra düşük gecikmeli hızlı mod (ilk token 85 ms altı)Canlı sohbet, otomatik tamamlama, yüksek QPS yönlendirme
256–1024Hafif çok adımlı planlamaAraç yönlendirme, basit refaktörler, RAG sentezi
4096–16384Derin çok adımlı akıl yürütmeAjan döngüleri, karmaşık hata ayıklama, araştırma raporları
32768–65536Maksimum derinlikUzun soluklu kodlama, çok dosyalı mimari değişiklikleri

Gemini API’de şöyle ayarlayın:

from google import genai
from google.genai import types

client = genai.Client()

response = client.models.generate_content(
    model="gemini-3.7-flash",
    contents="Bu React bileşenini hooks kullanacak şekilde refaktör et ve error boundary ekle.",
    config=types.GenerateContentConfig(
        thinking_config=types.ThinkingConfig(
            thinking_budget=8192  # 0 = hızlı mod; derin akıl yürütme için 65536'ya kadar
        )
    ),
)
print(response.text)

Akıl yürütme yerel olduğu için gecikme düzgün ölçeklenir: thinking_budget 0 iken klasik Flash gibi davranır, daha yüksek değerler model kimliği değiştirmeden chain-of-thought kalitesi sağlar. Faturalandırma görünür çıktı tokenlarını iç düşünme tokenlarından ayırır — yalnızca istediğiniz derinlik için ödersiniz.

Kıyaslama öne çıkanları

Google, Gemini 3.6 Flash, Claude Sonnet 5 ve GPT-5.6 Terra ile doğrudan karşılaştırma rakamları yayınladı. 3.7 Flash listelenen tüm değerlendirmelerde önde:

KıyaslamaGemini 3.7 FlashGemini 3.6 FlashClaude Sonnet 5GPT-5.6 Terra
FrontierCode 1.1%43,6%34,4%39,1%37,8
DeepSWE v1.1%65,3%49,0%56,2%53,4
WebDev Arena (Elo)1588153815521544
GDP.pdf%34,0%22,0%28,5%26,8
AutomationBench%30,4%17,0%23,1%21,5
GDM-MRCR v2%97,0%91,2%94,5%93,1
HLE-Verified%53,6%44,8%48,2%46,7

Geliştiriciler için iki rakam öne çıkıyor:

  • DeepSWE v1.1’de %65,3 — 3.6 Flash’a göre 16 puanlık sıçrama; ajanlı kodlama birincil eğitim hedefi.
  • GDM-MRCR v2’de %97,0 — 2,5M token pencerede neredeyse mükemmel uzun bağlam geri getirme; belge ağırlıklı iş akışları için kritik.

Önceki nesil bağlamı için Gemini 3.6 Flash vs 3.5 Flash karşılaştırmasına bakın.

Fiyatlandırma ve %50 tanıtım indirimi

Google agresif bir lansman promosyonu yürütüyor:

Tanıtım fiyatı (31 Ara 2026’ya kadar)Standart fiyat (1 Oca 2027’den itibaren)
Girdi$0,75 / 1M token$1,50 / 1M token
Çıktı$3,75 / 1M token$7,50 / 1M token
Bağlam önbelleği$0,075 / 1M token$0,075 / 1M token

2026’nın geri kalanında girdi ve çıktıda %50 indirim. Büyük sistem istemlerini veya belge külliyatlarını yeniden kullandığınızda faydalı bağlam önbelleği, promosyon döneminden bağımsız olarak milyon token başına $0,075’tir.

Daha yüksek thinking budget ile daha az araç çağrısı turu birleşince, tamamlanan ajan görevi başına efektif maliyet token etiket fiyatının çok altına inebilir. API maliyet tahmin rehberimiz tipik iş yüklerini hesaplar.

Çok modlu, web dev ve ajan yetenekleri

Kıyaslamaların ötesinde 3.7 Flash üretime hazır özellikler sunuyor:

  • 2,5M token bağlam penceresi — tüm codebase’ler, sözleşme paketleri veya araştırma külliyatları tek seferde.
  • Saniyede 245 çıktı token — UX’i boğmadan UI kodu ve uzun raporları akıtacak kadar hızlı.
  • %99,7 JSON araç yürütme doğruluğu — ajan araç zincirleri için güvenilir yapılandırılmış çıktılar.
  • Computer use — tarayıcı ve masaüstü iş akışları için yerleşik istemci tarafı otomasyon.
  • UI üretim sadakati — WebDev Arena’da (1588 Elo) daha yüksek düzen doğruluğu, daha temiz üretilmiş frontend’ler demek.

Bugün Gemini API, Google AI Studio, Gemini Enterprise ve Google Antigravity üzerinden kullanılabilir.

Geliştirici rehberi ve geçiş

3.6 Flash veya 3.5 Flash-Lite’tan yükseltiyorsanız şu kalıplarla başlayın:

  1. Model kimliğini değiştiringemini-3.6-flash yerine gemini-3.7-flash; API yüzeyi geriye uyumlu.
  2. Görev türüne göre thinking budget ayarlayın — kullanıcı sohbeti için 0, RAG Q&A için 1024, kodlama ajanları için 8192+, gecikmenin önemsiz olduğu gece batch işleri için yalnızca 32768.
  3. Bağlam önbelleğini etkinleştirin — sistem istemi veya belge seti 32K token’ı aşıyor ve istekler arasında tekrarlanıyorsa girdi maliyeti %90 düşer.
  4. Araç şemalarını ayarlayın — %99,7 JSON doğruluğu katı şemaları ödüllendirir; gevşek tanımlar uygulama katmanında yine başarısız olur.
  5. Düşünme token kullanımını izleyin — hangi ajan adımlarının gerçekten derin akıl yürütme gerektirdiğini anlamak için usage_metadata kaydedin.

Ajanlı iş akışı kalıpları için 3.5 Flash-Lite ajanlı iş akışları rehberi — thinking budget kavramı 3.7 Flash’ta daha ince granülariteyle doğal olarak genişler.

Sonuç

Gemini 3.7 Flash, hız ve derinliğin karşılıklı dışlayıcı olmadığı ilk Flash seviyesi model. Yapılandırılabilir thinking_budget, tek modelin gecikmeye duyarlı sohbet ile derin ajanlı kodlamayı birden sunmasını sağlar; lansman fiyatları 2026 sonuna kadar denemeyi ucuzlatır.

İlgili