Google تطلق Gemini 3.7 Flash: التفكير الهجين للبرمجة والوكلاء وعمل المعرفة
يصل Gemini 3.7 Flash في 13 أغسطس 2026 مع تفكير هجين أصلي وميزانية thinking قابلة للتحكم ومعايير برمجة متقدمة وخصم تعريفي 50% حتى ديسمبر.
راية جديدة للتفكير الهجين
في 13 أغسطس 2026، أطلقت Google Gemini 3.7 Flash — نموذجها الرائد للتفكير الهجين المخصص للبرمجة والوكلاء وعمل المعرفة المعقد. على عكس أجيال Flash السابقة التي ضحّت بالعمق من أجل السرعة، يدمج 3.7 Flash تفكيرًا أصليًا قابلًا للتحكم في واجهة API: تضبط عمق التفكير لكل طلب دون التبديل إلى «نموذج تفكير» منفصل.
يستهدف الإطلاق ثلاث فئات في آن واحد: مطوري الوكلاء في الإنتاج، والفرق التي تنفذ مهام برمجة طويلة الأمد، والمؤسسات التي تحتاج تحليلًا متعدد الوسائط موثوقًا على مجموعات وثائق ضخمة. تضع Google 3.7 Flash كنموذج يجعل نقطة نهاية واحدة تخدم أخيرًا ردود الدردشة دون 100 ms والبحث العميق لعدة دقائق.
التفكير الهجين الأصلي وميزانية thinking
محور الأمر هو thinking_config.thinking_budget — عدد صحيح يتحكم في عدد رموز التفكير الداخلية التي يمكن للنموذج استهلاكها قبل الإجابة.
thinking_budget | السلوك | الأفضل لـ |
|---|---|---|
| 0 | وضع سريع بزمن استجابة منخفض جدًا (أول رمز أقل من 85 ms) | الدردشة المباشرة، الإكمال التلقائي، التوجيه عالي QPS |
| 256–1024 | تخطيط متعدد الخطوات خفيف | توجيه الأدوات، إعادة هيكلة بسيطة، توليف RAG |
| 4096–16384 | تفكير متعدد الخطوات عميق | حلقات الوكلاء، تصحيح معقد، تقارير بحث |
| 32768–65536 | أقصى عمق | برمجة طويلة الأمد، تغييرات معمارية متعددة الملفات |
اضبطه في Gemini API هكذا:
from google import genai
from google.genai import types
client = genai.Client()
response = client.models.generate_content(
model="gemini-3.7-flash",
contents="أعد هيكلة مكوّن React هذا لاستخدام hooks وأضف error boundaries.",
config=types.GenerateContentConfig(
thinking_config=types.ThinkingConfig(
thinking_budget=8192 # 0 = الوضع السريع؛ حتى 65536 للتفكير العميق
)
),
)
print(response.text)
لأن التفكير أصلي وليس إضافة، يتدرج زمن الاستجابة بسلاسة: thinking_budget 0 يتصرف كـ Flash كلاسيكي، والقيم الأعلى تفتح جودة chain-of-thought دون تغيير معرف النموذج. يفصل الفوترة بين رموز الإخراج المرئية ورموز التفكير الداخلية — تدفع فقط للعمق المطلوب.
أبرز المعايير
نشرت Google أرقامًا مقارنة مباشرة مع Gemini 3.6 Flash وClaude Sonnet 5 وGPT-5.6 Terra. 3.7 Flash يتصدر كل التقييمات المذكورة:
| المعيار | Gemini 3.7 Flash | Gemini 3.6 Flash | Claude Sonnet 5 | GPT-5.6 Terra |
|---|---|---|---|---|
| FrontierCode 1.1 | 43.6% | 34.4% | 39.1% | 37.8% |
| DeepSWE v1.1 | 65.3% | 49.0% | 56.2% | 53.4% |
| WebDev Arena (Elo) | 1588 | 1538 | 1552 | 1544 |
| GDP.pdf | 34.0% | 22.0% | 28.5% | 26.8% |
| AutomationBench | 30.4% | 17.0% | 23.1% | 21.5% |
| GDM-MRCR v2 | 97.0% | 91.2% | 94.5% | 93.1% |
| HLE-Verified | 53.6% | 44.8% | 48.2% | 46.7% |
رقمان يبرزان للمطورين:
- DeepSWE v1.1 عند 65.3% — قفزة 16 نقطة عن 3.6 Flash؛ البرمجة الوكيلية هي الهدف التدريبي الرئيسي.
- GDM-MRCR v2 عند 97.0% — استرجاع سياق طويل شبه مثالي في نافذة 2.5M رمز، حاسم لسير عمل الوثائق.
للسياق عن الجيل السابق، راجع مقارنة Gemini 3.6 Flash vs 3.5 Flash.
الأسعار وخصم التعريف 50%
تجري Google عرضًا aggressive للإطلاق:
| سعر التعريف (حتى 31 ديسمبر 2026) | السعر القياسي (من 1 يناير 2027) | |
|---|---|---|
| الإدخال | $0.75 / مليون رمز | $1.50 / مليون رمز |
| الإخراج | $3.75 / مليون رمز | $7.50 / مليون رمز |
| تخزين السياق المؤقت | $0.075 / مليون رمز | $0.075 / مليون رمز |
هذا خصم 50% على الإدخال والإخراج لبقية 2026. يبقى تخزين السياق — مفيد عند إعادة استخدام prompts نظام كبيرة أو corpuses وثائق — $0.075 لكل مليون رمز بغض النظر عن العرض.
مع تقليل جولات استدعاء الأدوات عند ميزانيات thinking أعلى، قد ينخفض التكلفة الفعلية لكل مهمة وكيل مكتملة دون سعر الرمز الظاهر. دليل تقدير تكلفة API يشرح الحساب لأحمال العمل النموذجية.
القدرات متعددة الوسائط وتطوير الويب والوكلاء
بeyond المعايير، 3.7 Flash يقدم قدرات جاهزة للإنتاج:
- نافذة سياق 2.5M رمز — ابتلاع codebases كاملة أو حزم عقود أو corpuses بحث دفعة واحدة.
- 245 رمز إخراج/ث — سريع بما يكفي لبث كود UI وتقارير طويلة دون خنق UX.
- دقة تنفيذ أدوات JSON 99.7% — مخرجات منظمة موثوقة لسلاسل أدوات الوكلاء.
- Computer use — أتمتة مدمجة من جانب العميل لسير عمل المتصفح وسطح المكتب.
- دقة توليد UI — دقة تخطيط أعلى على WebDev Arena (1588 Elo) تعني frontends مولدة أنظف.
متاح اليوم عبر Gemini API وGoogle AI Studio وGemini Enterprise وGoogle Antigravity.
دليل المطور والترحيل
إذا كنت ترقي من 3.6 Flash أو 3.5 Flash-Lite، ابدأ بهذه الأنماط:
- استبدل معرف النموذج — بدّل
gemini-3.6-flashبـgemini-3.7-flash؛ واجهة API متوافقة للخلف. - اضبط thinking budgets حسب نوع المهمة —
0للدردشة الموجهة للمستخدم،1024لـ RAG Q&A،8192+لوكلاء البرمجة،32768فقط لمهام batch ليلية حيث زمن الاستجابة غير مهم. - فعّل تخزين السياق — إذا تجاوز prompt النظام أو مجموعة الوثائق 32K رمز وتتكرر بين الطلبات، يخفض التخزين تكلفة الإدخال 90%.
- اضبط schemas الأدوات — دقة JSON 99.7% تكافئ schemas صارمة؛ التعريفات الفضفاضة تفشل على مستوى التطبيق.
- راقب استخدام رموز التفكير — سجّل
usage_metadataلفهم أي خطوات الوكيل تحتاج تفكيرًا عميقًا فعلًا.
لأنماط سير عمل الوكلاء، راجع دليل سير عمل 3.5 Flash-Lite — مفهوم thinking budget يمتد طبيعيًا إلى 3.7 Flash بدقة أ finer.
الخلاصة
Gemini 3.7 Flash هو أول نموذج من مستوى Flash حيث السرعة والعمق ليسا متناقضين. thinking_budget القابل للتحكم يجعل نموذجًا واحدًا يخدم الدردشة الحساسة للزمن والبرمجة الوكيلية العميقة، وأسعار الإطلاق تجعل التجربة رخيصة حتى نهاية 2026.