إخراج متعدد الوسائط أصيل
موجِّه واحد يُنتج نصًا و keyframes وفيديو متناسقًا، مع شخصيات وأسلوب وإضاءة متّسقة عبر الصيغ.
أُطلق Gemini Omni 1.1 Flash في 27 أغسطس 2026 — تحديث Google الجاهز للإنتاج مع scene extensions حتى 40 ثانية، وfirst/last frame control، و360p draft mode، و4K upscaling، وvideo references. يحل محل Veo داخل تطبيق Gemini ومتاح عبر Google Flow وYouTube Shorts وGoogle Vids وGoogle AI Studio وGemini Enterprise Agent Platform.
كل مقطع أدناه مضمّن مباشرة من صفحة منتج Gemini Omni الرسمية من Google: text-to-video و image-to-video ونقل الأسلوب وتحرير الدردشة و video-to-video وأڤاتار AI — كامل سطح القدرات.
جميع فيديوهات العرض © Google، تُستخدم هنا لأغراض تجميع المعلومات؛ تُبَث مباشرة من storage.googleapis.com/gweb-gemini-cdn.
الريل الرئيسي لـ Gemini Omni: ابتكر وأعد المزج وحرّر الفيديو بالمحادثة.
موجِّه نصي واحد يُنتج مقطعًا متعدد اللقطات ببيئة ولغة كاميرا متّسقة.
ارفع صور مرجعية ليقود Omni الحركة ويملأ الخط الزمني تلقائيًا.
بدّل الخلفيات وغيّر الملابس وانقل الأنماط — يحتفظ شخصك بتفاصيله.
أعد صياغة لقطات موجودة بأسلوب جديد — إضاءة، عدسة، حتى مادة، تُعاد كتابتها بالموجِّه.
أعد توزيع الشخصيات واضبط الإضاءة وثبّت اللقطات — كل ذلك عبر المحادثة، دون إعادة توليد.
أنشِئ أڤاتار AI مرة واحدة، ثم تألّق في كل فيديو مستقبلي دون إعادة رفع الصور.
بخلاف نماذج الفيديو المتخصّصة مثل Veo و Sora 2 و Seedance 2.0 و Kling، يبقي Gemini Omni الاستدلال اللغوي وتوليد الصور والفيديو وتأليف الصوت ضمن بنية واحدة.
موجِّه واحد يُنتج نصًا و keyframes وفيديو متناسقًا، مع شخصيات وأسلوب وإضاءة متّسقة عبر الصيغ.
لا مزيد من ربط نماذج متخصّصة بسلاسل. النص والصورة والفيديو والصوت تتشارك الأوزان والسياق الطويل ذاته.
الأصوات المحيطة والموسيقى والحوار تتطابق مع الصورة في تمريرة أمامية واحدة — خطوات تتزامن مع الإيقاع، وشفاه تطابق الكلام منذ التصدير الأول.
استبدل عنصرًا أو غيّر الإضاءة أو اضبط حركة الكاميرا بلغة طبيعية — دون إعادة توليد كامل، تكرارًا لطريقة Nano Banana.
ارفع مقطعًا موجودًا وأعِد توجيهه بالموجّهات. صور وفيديوهات وصوتيات مرجعية تُدمج في تعليمة واحدة.
قوالب جاهزة لإعلانات المنتجات و Reels والفيديوهات الموسيقية والأفلام القصيرة السينمائية تخفض حاجز الدخول للمبتدئين مع الحفاظ على لغة الكاميرا متّسقة.
الأرقام أدناه وفق إطلاق gemini-omni-1.1-flash للإنتاج في 27 أغسطس 2026. متاح عبر Google AI Studio وGemini Enterprise Agent Platform.
| البُعد | الإشارة المعروفة |
|---|---|
| عائلة النموذج | Google Gemini Omni — 1.1 Flash هو الإصدار الجاهز للإنتاج |
| Model ID | gemini-omni-1.1-flash |
| مدة المقطع | حتى 10 ثوانٍ لكل توليد · حتى 40 ثانية مع scene extensions (زيادات 10 ثوانٍ) |
| الدقّة | 360p draft · 720p standard · 1080p · 4K upscale |
| نسب الأبعاد | 16:9, 9:16, 1:1 |
| الصوت | صوت متزامن أصيل على المخرج · مراجع الصوت عبر API غير مدعومة بعد |
| المدخلات | نص / صورة / فيديو (مرجع الصوت عبر API غير مدعوم بعد) |
| الوصول | تطبيق Gemini، Google Flow، YouTube Shorts/Create، Google Vids · المطوّرون عبر Gemini API وGoogle AI Studio وGemini Enterprise Agent Platform |
| تسعير API | 0.10$ لكل ثانية إخراج فيديو (مثل Veo 3.1 Fast) |
كان stack Google التوليدي مقسّمًا سابقًا: Veo للفيديو، Nano Banana / Imagen للصور، و Gemini للنص. يلفّ Omni كل ذلك في بنية واحدة.
قبل
Veo 3.1
فيديو + صوت أصيل
Nano Banana / Imagen
توليد وتحرير الصور
Gemini 2.5 / 3.x
استدلال · سياق طويل
الآن · Omni
Gemini Omni
نص · صورة · فيديو · صوت، نموذج واحد، موجِّه واحد
نموذج موحّد بسياق طويل وصوت متزامن يعني أنّ الفِرَق تكتب ملخصًا متّسقًا واحدًا وتغادر بمونتاج جاهز.
لقطات افتتاحية وكشف عبوات ومشاهد نمط حياة تصدر مع صوت محيط محسوم.
مقاطع رأسية 9:16 بحوار مباشر وحركة متزامنة مع الإيقاع، صُمِّمت لإيقاف التمرير.
استشهد بمسار صوتي ليقطع Omni الصور على الإيقاع، مع الحفاظ على شخصية ثابتة عبر اللقطات.
اربط عدة omni-clips من 10 ثوان في تتابع متعدد اللقطات مع إضاءة وطبقة صوت مستمرة.
مقاطع جوّ 16:9 قابلة للتكرار لمواقع SaaS والأزياء و DTC — مع علامة تجارية وصديقة للصمت.
حوِّل سيناريو إلى تتابع مرويّ بحوار متزامن الشفاه وصوت محيط متناسق.
مجمّع من Artificial Analysis و Looksy AI و Oimi AI والكلمات الرسمية — للتوجيه، وليس درجات benchmark.
| النموذج | المُنشئ | البنية | صوت أصيل | مدة المقطع |
|---|---|---|---|---|
| Gemini Omni
Omni
| Omni موحّد (فيديو + صورة + صوت) | متزامن في تمريرة واحدة | 10s · حتى 40s | |
| Veo 3.1 | نموذج فيديو متخصّص | نعم | ~8 ث | |
| Seedance 2.0 | ByteDance | فيديو متعدد الوسائط متخصّص | نعم | حتى 15 ث / لقطة |
| Sora 2 | OpenAI | نموذج فيديو متخصّص | نعم | ~20 ث |
| Kling V3.0 | Kuaishou | نموذج فيديو متخصّص | محدود | ~10 ث |
يتوفر Gemini Omni Flash مجانًا في الباقة المجانية من Google Flow وعلى YouTube Shorts وتطبيق YouTube Create. أما تطبيق Gemini المستقل فيتطلب Google AI Plus أو Pro أو Ultra. افتح المنافذ الرسمية أدناه.
استوديو صناعة الأفلام بالذكاء الاصطناعي من Google. تتضمن الباقة المجانية Gemini Omni Flash مع حدود استخدام؛ ارقَ إلى Plus / Pro / Ultra لحدود أعلى وأدوات احترافية.
فتحأنشئ مقاطع Gemini Omni Flash داخل Shorts دون أي تكلفة. أرخص طريقة رسمية لتجربة Omni مجانًا.
فتحمحرر فيديو على الجوال مع Gemini Omni Flash مدمج. لا حاجة لاشتراك ذكاء اصطناعي.
فتحاستخدم Omni داخل تطبيق Gemini الرسمي. يحتاج خطة Google AI Plus أو Pro أو Ultra.
فتحأسرع طريق مجاني: سجّل الدخول إلى YouTube Shorts أو تطبيق YouTube Create، اختر قالبًا واستخدم نفس البرومبت متعدد اللقطات الذي يعمل في تطبيق Gemini.
تتغير الحصة المجانية والأسعار حسب المنطقة والحساب. تحقق دائمًا من المنافذ الرسمية أعلاه.
مرتّب حسب تاريخ التقرير العلني. محدّث حتى إطلاق Omni 1.1 Flash للإنتاج في 27 أغسطس 2026.
رصد مستخدم X بحساب @Thomas16937378 العبارة "Start with an idea or try a template. Powered by Omni." داخل تبويب فيديو Gemini.
أبرز TestingCatalog و Chetaslua بطاقة "Meet our new video model" مع Model ID كامل وسقف مقطع 10 ثوانٍ.
مقطع "بروفيسور يحلّ مثلثات على سبورة" أبرز اتساق النص ودقّة الفيزياء، مما أشعل المقارنات مع Veo 3.1.
كشفت Google عن Gemini Omni على المسرح الرئيسي لـ I/O 2026، وأطلقت صفحة المنتج الرسمية مع فيديوهات تجريبية، وبدأت استبدال Veo 3.1 داخل تطبيق Gemini.
الإطلاق يأتي مع أڤاتار AI شخصي وتحرير video-to-video وتحرير بأسلوب الدردشة متعدد الأدوار — مع قيود حسب المنطقة الجغرافية والاشتراك.
معرّف gemini-omni-flash-preview يصل إلى Google AI Studio وGemini API وGemini Enterprise Agent Platform بـ 0.10$ لكل ثانية إخراج فيديو — نفس سعر Veo 3.1 Fast. التحرير المحادثي والمراجع متعددة الوسائط (نص، صورة، فيديو) مدعومة؛ مراجع الصوت عبر API ليست بعد.
Model ID gemini-omni-1.1-flash أصبح جاهزًا للإنتاج عبر Google AI Studio وGemini Enterprise Agent Platform. قدرات جديدة: scene extensions حتى 40 ثانية، first/last frame specification، 360p draft mode (أسرع 60%، ثلث التكلفة)، 4K upscaling، video references. مدمج من Adobe Firefly وFigma Weave وRunway وغيرها.
أعلنت Google عن rollout أوسع لـ Gemini Omni Pro بما يتجاوز معاينة Ultra، إلى جانب image & audio output modalities بما يتجاوز الإطلاق الحالي المرتكز على الفيديو — وعد "any input → any output" الكامل.
Gemini Omni هي عائلة Google متعددة الوسائط الموحّدة. النموذج الإنتاجي هو Gemini Omni 1.1 Flash (gemini-omni-1.1-flash)، الذي يولّد فيديو بصوت متزامن أصيل من مدخلات نص وصورة وفيديو داخل بنية واحدة. يدعم scene extensions حتى 40 ثانية، وfirst/last frame control، و360p drafts، و4K upscaling.
مجاني جزئيًا. يتوفر Gemini Omni Flash مجانًا في الباقة المجانية من Google Flow وعلى YouTube Shorts وتطبيق YouTube Create. لاستخدام Omni داخل تطبيق Gemini المستقل يلزم اشتراك مدفوع في Google AI Plus أو Pro أو Ultra.
يبدأ Google AI Plus من حوالي 7.99 دولار أمريكي شهريًا، وAI Pro هو الباقة الأكثر شيوعًا للمبدعين، وAI Ultra حوالي 100 دولار أمريكي شهريًا. عمليتا توليد عبر Omni Flash تستهلكان نحو 86% من الحصة اليومية في AI Pro، فخطّط لإعادة المحاولات. ستصدر واجهة المطورين بأسعار خاصة بها.
صدر بالفعل. أعلنت Google عن Gemini Omni على المسرح الرئيسي لمؤتمر Google I/O 2026 في 19 مايو 2026، مع نشر صفحة المنتج الرسمية وفيديوهات تجريبية في الوقت ذاته.
Gemini Omni هو خليفة Veo داخل تطبيق Gemini — تقول Google صراحةً إن Omni "سيحلّ محل Veo في تطبيق Gemini". stack الفيديو الآن مطوي في البنية ذاتها مع نص وصور Gemini.
نعم. الأصوات المحيطة والموسيقى والحوار تُنتَج في التمريرة ذاتها مع الفيديو — وهذا سبب اسم "omni".
المقاطع الفردية حتى 10 ثوانٍ، مع scene extensions تصل إلى 40 ثانية إجمالاً (زيادات 10 ثوانٍ). يدعم صوتًا أصيلًا، حتى 5 مراجع صور، مراجع فيديو حتى 3 ثوانٍ، وتحرير multi-turn. مسودة بـ 360p أو upscale إلى 4K.
يتطلب Gemini Omni خطّة Google AI Plus أو Pro أو Ultra، ويجب أن يكون عمرك 18+. قد تُقيّد بعض الميزات (الأڤاتار، تحرير video-to-video) في دول معيّنة.
نسخة رقمية اختيارية منك، تتيح لـ Gemini توليد فيديوهات تبدو وتُسمع مثلك دون الحاجة لرفع الصور كل مرة — وأنت وحدك من يستخدم أڤاتارك.
كل ما في هذه الصفحة مجمّع من المصادر العلنية أدناه. القراءة المقارنة مستحسنة.
منشور الإعلان الرسمي الذي يفصّل إطلاق Omni Flash وقدراته وواجهاته وخطة الطرح.
ملخص كامل لمؤتمر I/O 2026 يشمل Gemini Omni، وباقة AI Ultra الجديدة بسعر 100$، والإصدارات المحيطة.
صفحة الإطلاق الرسمية مع فيديوهات تجريبية وجولة قدرات والخطط المدعومة وتفاصيل الطرح.
نظرة عامة من محلل مستقل حول كيفية دمج Omni لمكدسي Veo + Imagen في نموذج واحد، وما المتاح الآن مقابل لاحقًا.
تفاصيل التسريب وسلاسل UI وتحليل الديمو المبكر.
Model ID كامل والمواعِظ داخل التطبيق وردود فعل المجتمع.
ملخص أنيق للمواصفات وحالات الاستخدام والمقارنات.
تعدد الوسائط على مستوى العائلة، السياق الطويل، والاتجاه الوكيلي.