Gemini Omni
عُد إلى كل المقالات
9 د قراءة

Google تطلق Gemini 3.7 Flash: التفكير الهجين للبرمجة والوكلاء وعمل المعرفة

يصل Gemini 3.7 Flash في 13 أغسطس 2026 مع تفكير هجين أصلي وميزانية thinking قابلة للتحكم ومعايير برمجة متقدمة وخصم تعريفي 50% حتى ديسمبر.

Gemini 3.7 FlashHybrid ReasoningCodingBenchmarksPricingAnnouncement2026العربية

راية جديدة للتفكير الهجين

في 13 أغسطس 2026، أطلقت Google Gemini 3.7 Flash — نموذجها الرائد للتفكير الهجين المخصص للبرمجة والوكلاء وعمل المعرفة المعقد. على عكس أجيال Flash السابقة التي ضحّت بالعمق من أجل السرعة، يدمج 3.7 Flash تفكيرًا أصليًا قابلًا للتحكم في واجهة API: تضبط عمق التفكير لكل طلب دون التبديل إلى «نموذج تفكير» منفصل.

يستهدف الإطلاق ثلاث فئات في آن واحد: مطوري الوكلاء في الإنتاج، والفرق التي تنفذ مهام برمجة طويلة الأمد، والمؤسسات التي تحتاج تحليلًا متعدد الوسائط موثوقًا على مجموعات وثائق ضخمة. تضع Google 3.7 Flash كنموذج يجعل نقطة نهاية واحدة تخدم أخيرًا ردود الدردشة دون 100 ms والبحث العميق لعدة دقائق.

التفكير الهجين الأصلي وميزانية thinking

محور الأمر هو thinking_config.thinking_budget — عدد صحيح يتحكم في عدد رموز التفكير الداخلية التي يمكن للنموذج استهلاكها قبل الإجابة.

thinking_budgetالسلوكالأفضل لـ
0وضع سريع بزمن استجابة منخفض جدًا (أول رمز أقل من 85 ms)الدردشة المباشرة، الإكمال التلقائي، التوجيه عالي QPS
256–1024تخطيط متعدد الخطوات خفيفتوجيه الأدوات، إعادة هيكلة بسيطة، توليف RAG
4096–16384تفكير متعدد الخطوات عميقحلقات الوكلاء، تصحيح معقد، تقارير بحث
32768–65536أقصى عمقبرمجة طويلة الأمد، تغييرات معمارية متعددة الملفات

اضبطه في Gemini API هكذا:

from google import genai
from google.genai import types

client = genai.Client()

response = client.models.generate_content(
    model="gemini-3.7-flash",
    contents="أعد هيكلة مكوّن React هذا لاستخدام hooks وأضف error boundaries.",
    config=types.GenerateContentConfig(
        thinking_config=types.ThinkingConfig(
            thinking_budget=8192  # 0 = الوضع السريع؛ حتى 65536 للتفكير العميق
        )
    ),
)
print(response.text)

لأن التفكير أصلي وليس إضافة، يتدرج زمن الاستجابة بسلاسة: thinking_budget 0 يتصرف كـ Flash كلاسيكي، والقيم الأعلى تفتح جودة chain-of-thought دون تغيير معرف النموذج. يفصل الفوترة بين رموز الإخراج المرئية ورموز التفكير الداخلية — تدفع فقط للعمق المطلوب.

أبرز المعايير

نشرت Google أرقامًا مقارنة مباشرة مع Gemini 3.6 Flash وClaude Sonnet 5 وGPT-5.6 Terra. 3.7 Flash يتصدر كل التقييمات المذكورة:

المعيارGemini 3.7 FlashGemini 3.6 FlashClaude Sonnet 5GPT-5.6 Terra
FrontierCode 1.143.6%34.4%39.1%37.8%
DeepSWE v1.165.3%49.0%56.2%53.4%
WebDev Arena (Elo)1588153815521544
GDP.pdf34.0%22.0%28.5%26.8%
AutomationBench30.4%17.0%23.1%21.5%
GDM-MRCR v297.0%91.2%94.5%93.1%
HLE-Verified53.6%44.8%48.2%46.7%

رقمان يبرزان للمطورين:

  • DeepSWE v1.1 عند 65.3% — قفزة 16 نقطة عن 3.6 Flash؛ البرمجة الوكيلية هي الهدف التدريبي الرئيسي.
  • GDM-MRCR v2 عند 97.0% — استرجاع سياق طويل شبه مثالي في نافذة 2.5M رمز، حاسم لسير عمل الوثائق.

للسياق عن الجيل السابق، راجع مقارنة Gemini 3.6 Flash vs 3.5 Flash.

الأسعار وخصم التعريف 50%

تجري Google عرضًا aggressive للإطلاق:

سعر التعريف (حتى 31 ديسمبر 2026)السعر القياسي (من 1 يناير 2027)
الإدخال$0.75 / مليون رمز$1.50 / مليون رمز
الإخراج$3.75 / مليون رمز$7.50 / مليون رمز
تخزين السياق المؤقت$0.075 / مليون رمز$0.075 / مليون رمز

هذا خصم 50% على الإدخال والإخراج لبقية 2026. يبقى تخزين السياق — مفيد عند إعادة استخدام prompts نظام كبيرة أو corpuses وثائق — $0.075 لكل مليون رمز بغض النظر عن العرض.

مع تقليل جولات استدعاء الأدوات عند ميزانيات thinking أعلى، قد ينخفض التكلفة الفعلية لكل مهمة وكيل مكتملة دون سعر الرمز الظاهر. دليل تقدير تكلفة API يشرح الحساب لأحمال العمل النموذجية.

القدرات متعددة الوسائط وتطوير الويب والوكلاء

بeyond المعايير، 3.7 Flash يقدم قدرات جاهزة للإنتاج:

  • نافذة سياق 2.5M رمز — ابتلاع codebases كاملة أو حزم عقود أو corpuses بحث دفعة واحدة.
  • 245 رمز إخراج/ث — سريع بما يكفي لبث كود UI وتقارير طويلة دون خنق UX.
  • دقة تنفيذ أدوات JSON 99.7% — مخرجات منظمة موثوقة لسلاسل أدوات الوكلاء.
  • Computer use — أتمتة مدمجة من جانب العميل لسير عمل المتصفح وسطح المكتب.
  • دقة توليد UI — دقة تخطيط أعلى على WebDev Arena (1588 Elo) تعني frontends مولدة أنظف.

متاح اليوم عبر Gemini API وGoogle AI Studio وGemini Enterprise وGoogle Antigravity.

دليل المطور والترحيل

إذا كنت ترقي من 3.6 Flash أو 3.5 Flash-Lite، ابدأ بهذه الأنماط:

  1. استبدل معرف النموذج — بدّل gemini-3.6-flash بـ gemini-3.7-flash؛ واجهة API متوافقة للخلف.
  2. اضبط thinking budgets حسب نوع المهمة0 للدردشة الموجهة للمستخدم، 1024 لـ RAG Q&A، 8192+ لوكلاء البرمجة، 32768 فقط لمهام batch ليلية حيث زمن الاستجابة غير مهم.
  3. فعّل تخزين السياق — إذا تجاوز prompt النظام أو مجموعة الوثائق 32K رمز وتتكرر بين الطلبات، يخفض التخزين تكلفة الإدخال 90%.
  4. اضبط schemas الأدوات — دقة JSON 99.7% تكافئ schemas صارمة؛ التعريفات الفضفاضة تفشل على مستوى التطبيق.
  5. راقب استخدام رموز التفكير — سجّل usage_metadata لفهم أي خطوات الوكيل تحتاج تفكيرًا عميقًا فعلًا.

لأنماط سير عمل الوكلاء، راجع دليل سير عمل 3.5 Flash-Lite — مفهوم thinking budget يمتد طبيعيًا إلى 3.7 Flash بدقة أ finer.

الخلاصة

Gemini 3.7 Flash هو أول نموذج من مستوى Flash حيث السرعة والعمق ليسا متناقضين. thinking_budget القابل للتحكم يجعل نموذجًا واحدًا يخدم الدردشة الحساسة للزمن والبرمجة الوكيلية العميقة، وأسعار الإطلاق تجعل التجربة رخيصة حتى نهاية 2026.

ذات صلة