Gemini Omni 1.1 Flash: ما الجديد وكيف تهاجر من المعاينة؟
أتاحت جوجل نموذجها التحادثي للفيديو للاستخدام العام في 27 أغسطس 2026. معرّف النموذج هو gemini-omni-1.1-flash، وهو يحل محل نقطة النهاية gemini-omni-flash-preview التي أُطلقت في المعاينة العامة يوم 30 يونيو. إذا كنت تستخدم المعاينة، يجب الترحيل قبل أن توقف جوجل نقطة النهاية في 30 سبتمبر 2026.
إصدار GA ليس مجرد تحديث لاسم النموذج. فقد أضاف أربع إمكانيات مهمة للإنتاج:
- تمديد المشهد حتى 40 ثانية.
- تحديد الإطار الأول والأخير.
- إنشاء مسودات بدقة 360p وبتكلفة منخفضة.
- تحسين الدقة حتى 4K.
يغطي هذا المقال التغييرات والتكلفة وطرق الوصول والقيود الحالية. ولخلفية أوسع حول عائلة Omni، راجع ما هو Gemini Omni.
ما الذي يفعله Gemini Omni 1.1 Flash؟
يستقبل Omni 1.1 Flash النصوص والصور والفيديو، ثم يعيد فيديو. ويعمل عبر Interactions API بدلًا من generateContent، ما يتيح التوليد متعدد الأدوار مع الاحتفاظ بالحالة.
عمليًا، يمكنك إنشاء مقطع ثم إرسال دور متابعة لتحريره دون إعادة تحميله.
يدعم النموذج خمس فئات من المهام:
- نص إلى فيديو: إدخال prompt وإخراج مقطع.
- صورة إلى فيديو: استخدام صورة كإطار افتتاحي أو كمرجع للحركة والأسلوب.
- مرجع إلى فيديو: استخدام حتى ثلاثة مقاطع مرجعية، مدة كل منها ثلاث ثوانٍ، للحفاظ على الحركة والمظهر واتساق الشخصيات.
- تحرير: تعديل فيديو سبق إنشاؤه داخل المحادثة.
- توسيع: إضافة 10 ثوانٍ إلى نهاية مقطع.
لا يستخدم النموذج الصوت الموجود في المقاطع المرجعية؛ بل يحلل الحركة والمظهر فقط.
تمديد المشهد مع سياق يصل إلى 10 ثوانٍ
كان نموذج المعاينة يعتمد على الثانية الأخيرة من المقطع عند التمديد. ساعد ذلك على الحفاظ على لوحة الألوان، لكنه لم يكن كافيًا للحفاظ على الشخصيات أو حركة الكاميرا؛ لذلك كان تمديد الفيديو مختلفًا عن تمديد اللقطة نفسها.
يحلل Omni 1.1 ما يصل إلى 10 ثوانٍ من السياق السابق، وتصف جوجل النتيجة بأنها تحسين للاتساق البصري والالتزام السردي. ويمكنك إضافة 10 ثوانٍ في كل مرة، حتى مدة تراكمية تبلغ 40 ثانية.
ضع في اعتبارك القيود التالية:
- يضيف التمديد محتوى إلى نهاية المقطع فقط.
- لا يمكنك إدراج لقطة في البداية أو منتصف الفيديو.
- الحد الأقصى للفيديو المحمّل هو 10 ثوانٍ، إلا عند استخدام تفاعل متعدد الأدوار يحتفظ فيه النموذج بالحالة السابقة.
تشرح جولة تمديد المشهد لمدة 40 ثانية شكل الطلب ومكان ظهور الفواصل.
التحكم في الإطارين الأول والأخير
يمكنك الآن تمرير إطار أول وإطار أخير مع prompt يصف الحركة بينهما. ينشئ النموذج اللقطات الانتقالية التي تربط الإطارين، ما يجعله مناسبًا لمدارات الكاميرا وانتقالات التكبير والتصغير والمقاطع المتكررة.
هذه الميزة مهمة عند بناء منتج فيديو قابل للتنبؤ. أما تحويل النص إلى فيديو فيعتمد على احتمالات كثيرة، بينما يمنحك تحديد الإطارين نقطتين ثابتتين ويترك للنموذج حل المساحة الوسطى فقط.
المسودة بدقة 360p وتأثيرها على التكلفة
ينشئ Omni 1.1 معاينات بدقة 360p أسرع بنسبة تصل إلى 60% من 720p، وبتكلفة تعادل الثلث. سير العمل المقترح:
- جرّب prompt بدقة 360p.
- عدّل prompt حتى تحصل على النتيجة المطلوبة.
- أعد إنشاء النسخة النهائية بدقة 720p أو 1080p أو 4K.
بما أن إنشاء الفيديو يُحاسب لكل ثانية، فإن معظم المقاطع الناتجة أثناء التكرار لا تُستخدم. تقليل تكلفة المحاولات المهدرة إلى الثلث يجعل مرحلة الاستكشاف أقل تقييدًا. يشرح تفصيل التسعير التكلفة لكل ثانية.
تُحدد الدقة في تنسيق الاستجابة. لاحظ أن 1080p و4k ترقيتان للإطارات التي تم إنشاؤها، وليستا عرضين أصليين بالدقة نفسها.
أين يتوفر النموذج؟
يتوفر Omni 1.1 Flash عبر:
- Gemini API في Google AI Studio للمطورين.
- Gemini Enterprise Agent Platform للنشر المؤسسي.
- Google Flow لمشتركي AI Plus وPro وUltra.
- تطبيق Gemini، حيث يحصل المشتركون على ميزة تمديد المشهد.
وأعلنت جوجل عن شركاء يستخدمون النموذج ضمن منتجاتهم، منهم Adobe Firefly وFigma Weave وRunway وGMI Cloud.
لا توجد طبقة مجانية للنموذج عبر API. وعلى عكس نماذج Flash النصية، التي توفر مسارًا مجانيًا محدود المعدل في AI Studio، تُحاسب كل ثانية من مخرجات Omni منذ أول طلب.
النموذج مجاني على YouTube Shorts وYouTube Create، لكن هذه منتجات مختلفة بحدود مختلفة. يوضح ملخص الوصول المجاني ما يتيحه كل مسار.
القيود الحالية
راجع هذه القيود قبل تصميم ميزة تعتمد على النموذج:
- لا يدعم تعليمات النظام أو
temperatureأوtop_pأو stop sequences أو negative prompts. لاستبعاد عنصر معين، اذكر ذلك في prompt العادي. - لا يتوفر تحميل وتحرير الفيديو في المنطقة الاقتصادية الأوروبية وسويسرا والمملكة المتحدة. وينطبق قيد إضافي على تحرير الصور التي تحتوي على قاصرين. أما الفيديوهات التي أنشأها النموذج فتظل قابلة للتحرير في هذه المناطق.
- يُحظر تحرير أفراد معينين يمكن التعرف عليهم.
- لا يمكنك إضافة حوار عند تمديد فيديو صامت محمّل من مصدر آخر. يمكنك تمديد الفيديو الصامت أو استخدامه ضمن تفاعل متعدد الأدوار.
- يدعم الاستنتاج على فيديو إدخال واحد فقط، وليس عدة مقاطع فيديو معًا.
- اللغة الإنجليزية هي اللغة المدعومة بالكامل عمليًا؛ أما اللغات الأخرى فما زالت غير مختبرة.
يتضمن كل مخرج علامة SynthID المائية. وهي غير مرئية للمشاهدين، لكنها قابلة للكشف برمجيًا، لذا يجب مراعاتها عند تقديم ادعاءات حول مصدر المحتوى.
Gemini Omni 1.1 Flash أم Veo 3.1؟
تقدم جوجل الآن عائلتين لإنشاء الفيديو باستخدام مفتاح API نفسه:
- Veo 3.1: محرك عرض سينمائي مع صوت أصلي.
- Omni 1.1 Flash: نموذج فيديو تحادثي يعمل عبر أدوار متعددة.
تكلفة ثانية بدقة 720p في Omni تقارب ربع تكلفة الثانية القياسية في Veo 3.1. كما لا يقدم Veo ما يعادل حلقة التحرير متعددة الأدوار في Omni.
توضح المقارنة جنبًا إلى جنب متى تستخدم كل نموذج. وإذا كان لديك تكامل قائم مع Veo، فما زال دليل Veo 3.1 API صالحًا.
الترحيل من نقطة نهاية المعاينة
ستتوقف الطلبات التي تستخدم gemini-omni-flash-preview عن العمل بعد 30 سبتمبر 2026. غالبًا يكفي تغيير سلسلة معرّف النموذج، لكن تحقق من النقطتين التاليتين:
- الدقة الافتراضية: أصبحت 720p هي الافتراضية، وأضيف خيارا 360p و4K. إذا كان كودك يفترض حجم إخراج ثابتًا، اختبر القيمة الفعلية.
-
حجم الاستجابة: تُعاد مقاطع الفيديو الأكبر من 4 ميجابايت بصيغة URI بدل base64 مضمن. إذا كان المعالج يقرأ
output_video.dataفقط، فقد يفشل بصمت عند استخدام الدقات الأعلى.
للتأكد، احفظ الطلب في عميل API وقارن الاستجابات بين معرّفَي النموذج قبل الترحيل. باستخدام Apidog، ضع معرّف النموذج في متغير بيئة، واحفظ طلبًا واحدًا، ثم بدّل البيئة وقارن النتائج.
تشرح جولة Gemini Omni 1.1 Flash API الإعداد خطوة بخطوة.
الأسئلة الشائعة
ما معرّف نموذج Gemini Omni 1.1 Flash؟
gemini-omni-1.1-flash. أما معرّف المعاينة الذي سيتوقف فهو gemini-omni-flash-preview.
متى صدر Gemini Omni 1.1 Flash؟
صدر كإصدار عام GA في 27 أغسطس 2026، بينما صدرت المعاينة في 30 يونيو 2026.
هل Gemini Omni 1.1 Flash مجاني؟
لا. لا توجد طبقة مجانية لـ Omni، وتُحسب تكلفة كل عملية إنشاء. أما النماذج النصية مثل Gemini 3.6 Flash فما زالت تملك مسار AI Studio المجاني.
ما مدة فيديو Gemini Omni؟
ينشئ النموذج مقاطع مدتها 10 ثوانٍ. ويمكن لتمديد المشهد زيادتها إلى 40 ثانية تراكمية، بزيادات قدرها 10 ثوانٍ.
هل يولد Gemini Omni الصوت؟
تركز الوثائق على إخراج الفيديو، ويتجاهل النموذج الصوت في المقاطع المرجعية. أما Veo 3.1 فهو النموذج الذي يولد صوتًا أصليًا؛ راجع Veo 3.1 API إذا كان الصوت مطلوبًا.
هل يمكنني تعديل فيديو صورته بنفسي؟
نعم، حتى 10 ثوانٍ من الإدخال، مع استثناء المنطقة الاقتصادية الأوروبية وسويسرا والمملكة المتحدة. ارفع الفيديو باستخدام Files API ومرر URI كمدخل.
Gemini Omni 1.1 Flash هو أول إصدار من النموذج مناسب للإطلاق الفعلي. ابدأ بطلب محفوظ يستخدم معرّف النموذج العام، واختبر شكل الاستجابة عند كل دقة تحتاج إليها، ثم غادر نقطة نهاية المعاينة قبل نهاية سبتمبر. إذا أردت حفظ هذا التحقق، نزّل Apidog قبل الموعد النهائي.
Top comments (0)