HitPaw VikPea HitPaw VikPea
اشترِ الآن
hitpaw video enhancer header image

HitPaw VikPea (Video Enhancer)

  • تحسين جودة الفيديو تلقائيًا باستخدام الذكاء الاصطناعي القائم على التعلم الآلي
  • أداة ترقية الفيديو بالذكاء الاصطناعي لإزالة الضبابية وتلوين الفيديوهات
  • ذكاء اصطناعي مصمم خصيصًا لإصلاح الفيديوهات التالفة أو غير القابلة للتشغيل
  • إزالة واستبدال خلفية الفيديو بسرعة وسلاسة

مراجعة Gemini Omni 1.1 Flash: الميزات والأسعار وواجهة API

hitpaw editor in chief بواسطة محمد أمين
آخر تحديث: 2026-09-08 11:02:29

لم تنتظر Google طويلًا لتحديث نموذج الفيديو الخاص بها. لم يكن قد مضى على إصدار Gemini Omni Flash سوى وقت قصير منذ يونيو، وبحلول أواخر أغسطس، كانت Google DeepMind قد أطلقت بالفعل Gemini Omni 1.1 Flash، وهو إصدار يعالج الكثير من الشكاوى التي كانت لدى الناس بشأن الإصدار الأصلي. مشاهد أطول، وتحكم حقيقي بالإطارات، وطريقة أقل تكلفة لاختبار الأفكار قبل الدفع مقابل مقطع مكتمل؛ هذه هي الخلاصة.

لكن ما إذا كان التحول إليه يستحق العناء فعلًا، أو ما إذا كان يستحق بناء سير عمل حوله من الأساس، يعتمد على أمور مثل التسعير لكل ثانية، ومدى صمود التحرير فعليًا، وأين لا يزال يقصّر مقارنةً بـ Veo أو Sora. هذا ما تتناوله هذه المراجعة.

الجزء 1. ما هو Gemini Omni 1.1 Flash وما الذي يمكنه فعله؟

ما هو نموذج الذكاء الاصطناعي Gemini Omni 1.1 Flash وميزاته الرئيسية

نظرة عامة على Gemini Omni 1.1 Flash وتاريخ الإصدار

تم طرح نقطة النهاية gemini-omni-flash-preview مع النموذج الأصلي في ذلك يونيو، وسيتم إيقافها في 27 أغسطس 2026، مع إصدار Gemini Omni 1.1 Flash. معرّف النموذج الخاص بواجهة API هو gemini-omni-1.1-flash، وتذكر Google أن نقطة نهاية المعاينة الأقدم ستظل متاحة حتى 30 سبتمبر 2026، مما يصعّب على من يواصلون التطوير على تلك النقطة معرفة الموعد النهائي.

إنه نموذج متعدد الوسائط، ما يعني أنه يقبل النصوص والصور والصوت والفيديو كمدخلات، ولا يستخدم استدعاء توليد بسيطًا لمرة واحدة؛ بل يستخدم Interactions API من Google بدلًا من ذلك.

تحتوي جميع فيديوهاته على مؤثرات صوتية وضوضاء محيطة وحوار ومؤثرات صوتية متزامنة، وليست فيديوهات صامتة يتعين عليك إضافة الموسيقى إليها. وهو يدعم دقات 360p و720p و1080p و4K بنسبة أبعاد 16:9 أو 9:16، رغم أن 1080p و4K من الناحية التقنية هما «ترقيتان للدقة» وليستا معروضتين محليًا.

ما الجديد في Gemini Omni 1.1 Flash لتوليد الفيديو بالذكاء الاصطناعي؟

Gemini Omni 1.1 Flash لتوليد الفيديو بالذكاء الاصطناعي وإنشاء الفيديوهات الإبداعية

ظلت الميزات الأساسية في Omni Flash الأصلي دون تغيير إلى حد كبير: تحويل النص إلى فيديو، وتحويل الصورة إلى فيديو، وتحويل المرجع إلى فيديو، والتحرير بالمحادثة. الفرق هو مقدار التحكم الذي يمكنك ممارسته في النتيجة.

  • لم تعد الاستمرارات تعتمد فقط على الإطار الأخير من المشهد السابق؛ إذ تقرأ الآن ما يصل إلى 10 ثوانٍ من اللقطات السابقة. وهذا يجعل الاستمرارات أقل تقطعًا بكثير مما كانت عليه في الإصدارات السابقة.
  • أصبح بالإمكان الآن تمديد المقاطع بزيادات قدرها 10 ثوانٍ، حتى إجمالي 40 ثانية، مقارنةً بالحد الثابت البالغ 10 ثوانٍ في الإصدار الأصلي.
  • يتيح لك الاستيفاء بين الإطار الأول والأخير تحديد صورة أولى وصورة أخيرة، ثم يستوفي النموذج بينهما وينتج انتقالًا سلسًا، وهو جيد للقطات الدوران والتكبير والفاصل الزمني.
  • وضع المسودة الجديد بدقة 360p يبلغ سعره نحو ثلث السعر وهو أسرع بنسبة 60%، ويمكن استخدامه لاختبار الأفكار قبل قضاء وقت في تصييرها بالجودة الكاملة.
  • أصبحت المقاطع القصيرة من الفيديو مقبولة الآن كمرجع، بالإضافة إلى الصور الثابتة، لذا أصبح نقل شخصية أو أسلوب حركة بين اللقطات أكثر موثوقية.

لا يجعل أيٌّ من هذا Omni منتجًا جديدًا بالكامل. إنه المفهوم نفسه، ولكن مع التفاصيل الإضافية التي كان الناس يبحثون عنها منذ الإصدار الأول: توليد الفيديو وتحريره بصورة طبيعية عبر الكلام.

الجزء 2. كيفية استخدام Gemini Omni 1.1 Flash؟

كيفية استخدام Gemini Omni 1.1 Flash في Google AI Studio

لأي شخص يريد فقط تجربته دون كتابة تعليمات برمجية، يُعد Google AI Studio أسهل نقطة بداية.

افتح AI Studio، واختر Gemini Omni 1.1 Flash من قائمة النماذج، ثم اكتب برومبت أو حمّل صورة أو مقطعًا مرجعيًا.

Gemini Omni 1.1 Flash في Google AI Studio لتطوير الذكاء الاصطناعي واختباره

توصي Google بأن تكون محددًا بشأن المشهد وحركة الكاميرا والإضاءة بدلًا من جملة عامة مقتضبة، لأن النموذج يعتمد على تلك التفاصيل لملء فيزياء اللقطة وتأطيرها.

بمجرد وصول مسودة، يمكنك إعادة توليدها أو طلب دقة مختلفة أو الانتقال مباشرةً إلى تحريرها عبر برومبتات متابعة.

كيف يتعامل Gemini Omni 1.1 Flash مع تحرير الفيديو وتمديده؟

هنا تبرز فائدة Interactions API. بدلًا من كتابة برومبت طويل واحد والأمل في أن يطابقه الناتج، تنشئ مقطعًا ثم تتحدث إليه: استبدل الخلفية، غيّر وقت اليوم، اجعل شخصية تستدير لمواجهة الكاميرا. يطبق النموذج التغيير الذي طلبته فقط ويترك بقية اللقطة كما هي، وهذا أقل هشاشة بكثير من إعادة التوليد من الصفر في كل مرة يحدث فيها خطأ ما.

يعمل التمديد بالطريقة الحوارية نفسها. توجه النموذج إلى مقطع موجود، ولأنه يقرأ الآن ما يصل إلى 10 ثوانٍ من تلك اللقطات بدلًا من إطار واحد، تحافظ الاستمرارية على اتساق الإضاءة وموضع الشخصية والحركة بدلًا من إعادة ضبط المشهد. اربط عددًا كافيًا من هذه المقاطع معًا، ويمكنك الوصول إلى ذلك الحد التراكمي البالغ 40 ثانية.

الجزء 3. كم تبلغ تكلفة Gemini Omni 1.1 Flash API وكيف تستخدمها؟

ما هو معرّف نموذج Gemini Omni 1.1 Flash API؟

معرّف النموذج المستقر هو gemini-omni-1.1-flash، وهو متاح عبر Gemini API وGoogle AI Studio. كما تدرجه Google، مع وضع علامة Preview عليه، ضمن Gemini Enterprise Agent Platform للفرق التي تنشئ أدوات داخلية، ويظهر في Google Flow لأي شخص لديه اشتراك AI Plus أو Pro أو Ultra.

كيف تستخدم Gemini Omni 1.1 Flash API؟

سير العمل الأساسي هو استدعاء واحد لنقطة نهاية التفاعل. تمرر برومبت نصيًا، ومعه اختياريًا صورة أو مقطعًا صوتيًا أو فيديو مرجعيًا، إلى جانب الدقة المطلوبة، ويعيد النموذج الفيديو المُولَّد كبيانات مشفرة بترميز base64. بعد ذلك، لا يتطلب تحسين النتيجة سوى استدعاء تفاعل آخر يشير إلى الجلسة نفسها، مع وصف التغيير الذي تريده بلغة بسيطة بدلًا من إعادة إرسال البرومبت كاملًا.

كم تبلغ تكلفة Gemini Omni 1.1 Flash API؟

يعمل التسعير وفق نموذج الرموز المميزة القياسي من Google، مع احتساب تكلفة الفيديو حسب الدقة بدلًا من سعر ثابت واحد:

  • المدخلات (النص أو الصورة أو الفيديو أو الصوت، وجميعها تُحتسب بالطريقة نفسها): 1.50 دولار لكل مليون رمز مميز
  • مخرجات النص: 9.00 دولارات لكل مليون رمز مميز
  • إخراج الفيديو: 17.50 دولارًا لكل مليون رمز مميز، مع احتساب 720p بمعدل 5,792 رمزًا مميزًا في الثانية

عند حسابها لكل ثانية، تصل التكلفة تقريبًا إلى الأرقام التالية:

  • مسودة 360p: نحو 0.03 دولار لكل ثانية
  • 720p: نحو 0.10 دولار لكل ثانية
  • 1080p: نحو 0.15 دولار لكل ثانية
  • 4K: نحو 0.30 دولار لكل ثانية

لذا، تبلغ تكلفة مقطع كامل مدته 10 ثوانٍ بدقة 720p قرابة دولار واحد، بينما تبلغ تكلفة المقطع نفسه عند إنشائه أولًا كمسودة بدقة 360p نحو ثلاثين سنتًا. لا توجد خطة مجانية ولا خصم للدفعات، مما يجعل سير عمل الإنشاء كمسودة ثم الترقية خيارًا مجديًا بالفعل إذا كنت تختبر الكثير من البرومبتات قبل الالتزام بالتصيير النهائي.

ما حدود Gemini Omni 1.1 Flash API؟

هناك بعض القيود العملية التي يجدر معرفتها قبل بناء أي شيء جاد فوق هذا النموذج:

  • لا يزال الحد الأقصى للتوليدات الفردية 10 ثوانٍ؛ وأي مدة أطول تتطلب ربط الامتدادات حتى إجمالي 40 ثانية.
  • يتم إنتاج دقتَي 1080p و4K كترقية للتصيير الأساسي، وليس توليدهما أصليًا بتلك الدقة.
  • يستمد تمديد المشهد السياق من ما يصل إلى 10 ثوانٍ من اللقطات السابقة، لذا قد ينحرف الاتساق بعد تلك النافذة.
  • توضح بطاقة النموذج الخاصة بـ Google صراحةً أن الحركة المعقدة، والتحريرات متعددة الخطوات، ودقة النصوص المعروضة على الشاشة لا تزال مجالات قد تكون فيها النتائج غير متسقة.

الجزء 4. هل Gemini Omni 1.1 Flash أفضل من نماذج Gemini السابقة؟

Gemini Omni 1.1 Flash مقابل Gemini Omni Flash

يرتبط الانتقال من Omni Flash الأصلي إلى 1.1 بالتحكم أكثر من الجودة الخام. كان الإصدار الأول يقتصر على 10 ثوانٍ دون مسار للتمديد أو وسيلة لتعيين إطار نهاية محدد، لذلك كانت وثائق Google نفسها توجه المستخدمين إلى Veo لأي شيء يحتاج إلى تمديد المشهد أو التحكم في الإطار الأخير. يدمج الإصدار 1.1 هذه الإمكانات مباشرةً في Omni: مشاهد تراكمية لمدة 40 ثانية، واستيفاء بين الإطارين الأول والأخير، ومستوى 360p أقل تكلفة للنمذجة الأولية. لم يتغير السعر عند 720p، لذا تحصل على إمكانات أكبر بالمعدل المعلن نفسه.

Gemini Omni 1.1 Flash مقابل نماذج توليد الفيديو بالذكاء الاصطناعي الأخرى

مقارنةً ببقية المجال، لا يزال أكبر عامل تميّز في Omni 1.1 هو التحرير التحاوري متعدد الأدوار المدمج في Interactions API، إذ تتعامل معظم النماذج المنافسة مع التوليد والتحرير كأداتين منفصلتين. لا يزال Veo 3.1 خيار Google الآخر، ولا يزال الخيار المفضل لبعض المسارات القديمة، رغم أن Omni قلّص جزءًا كبيرًا من تلك الفجوة بهذا التحديث. وبالمقارنة مع نماذج Sora أو نماذج بأسلوب Kling، يمنحه مسار الصوت الأصلي ودعم التحويل من مرجع إلى فيديو أفضليةً لكل من يريد مقطعًا قابلًا للاستخدام في تمريرة واحدة بدلًا من تجميع الفيديو والصوت معًا لاحقًا. تدعي Google تحقيق Omni 1.1 لنتيجة رائدة في لوحة صدارة Text-to-Video Arena، إلا أن هذا رقم خاص بـ Google ولم يتم التحقق منه بشكل مستقل.

هل يستحق Gemini Omni 1.1 Flash الاستخدام؟

لأي شخص يعمل في أعمال إبداعية تكرارية، أو الإعلانات، أو المقاطع الاجتماعية، أو فيديوهات المفاهيم السريعة، فإن تسعير الإنشاء كمسودة ثم الترقية والتحرير التحاوري تجعل هذه أداة عملية فعلًا بدلًا من مجرد شيء مستحدث. يحصل المطورون على هيكل تكلفة واضح قائم على الدقة ومسار انتقال موثق بعيدًا عن نقطة نهاية المعاينة القديمة. الجوانب غير المثالية هي نفسها التي تقر بها Google: لا تزال الحركة تصبح مهتزة في المشاهد المعقدة، كما أن النص المعروض داخل الفيديو ليس موثوقًا دائمًا. إذا كان استخدامك يعتمد على مقاطع قصيرة وتكرارية، فهي تستحق السعر. أما إذا كنت تحتاج إلى إخراج 4K أصلي طويل المدة مباشرةً من البداية، فستظل بحاجة إلى ضبط توقعاتك وفقًا لذلك.

الجزء 5. نصائح احترافية: كيفية تحسين فيديوهات Gemini Omni 1.1 Flash بالذكاء الاصطناعي إلى 8K

لماذا ينبغي تحسين الفيديوهات المُنشأة بالذكاء الاصطناعي بعد توليدها؟

حتى مع إدراج 4K كخيار للإخراج، فإن تلك الدقة هي ترقية للتصيير الأصلي وليست التقاطًا أصليًا بدقة 4K. وهذا يعني أن التفاصيل الدقيقة، وملمس البشرة، والشعر، والقماش، وعناصر الخلفية قد تظل تبدو ناعمة قليلًا، كما تميل آثار الضغط أو الضوضاء الخفيفة إلى الظهور بمجرد مشاهدة المقطع على شاشة أكبر أو إدخاله إلى مخطط زمني للتحرير. والوجوه تحديدًا من أول الأشياء التي تفقد حدتها أثناء التوليد بالذكاء الاصطناعي، لأن النموذج يتنبأ بالتفاصيل بدلًا من تسجيلها.

كيفية ترقية فيديوهات Gemini Omni 1.1 Flash إلى 8K باستخدام HitPaw VikPea

هنا يثبت محسّن الفيديو المتخصص أهميته في سير العمل. HitPaw VikPea AI Video Enhancer مصمم خصيصًا لأخذ لقطات كهذه، سواء كانت مُنشأة بالذكاء الاصطناعي أو غير ذلك، وترقيتها إلى 8K مع تنظيف المشكلات التي تميل نماذج التوليد إلى تركها: التفاصيل الناعمة، والضوضاء، والتشوهات، وعرض الوجوه غير المتسق.

الميزات الرئيسية لـ HitPaw VikPea

  • إصلاح الفيديو بالذكاء الاصطناعي: يجب إصلاح ملفات الفيديو التالفة أو المعطوبة أو منخفضة الجودة.
  • النموذج التوليدي بالذكاء الاصطناعي: استعد مقاطع الفيديو منخفضة الدقة التي تقل عن 720p، بما في ذلك الأفلام القديمة وأشرطة VHS، مع تفاصيل ووضوح محسّنين.
  • تلوين الفيديو: أداة طبيعية لاستعادة وتلوين اللقطات بالأبيض والأسود.
  • ترقية الفيديو إلى 4K/8K: ترقية مقاطع الفيديو منخفضة الدقة بالذكاء الاصطناعي إلى 4K و8K
  • تصدير بدقة مخصصة: صدّر مقاطع الفيديو بسهولة بدقات تصل إلى 5K و8K.
  • واجهة سهلة الاستخدام: مناسبة للاستخدام من قبل المبتدئين والخبراء على حد سواء.

هذه هي الخصائص التي تجعل HitPaw VikPea خيارًا رائعًا عند التعامل مع الدقات المتقدمة.

كيفية ترقية الفيديو إلى دقة فيديو 8K باستخدام HitPaw VikPea

الخطوة 1: التثبيت والتنزيل

انتقل إلى الموقع الرسمي ونزّل HitPaw VikPea. بعد تثبيته، شغّل التطبيق وسجّل الدخول عند الحاجة.

الخطوة 2: إدخال لقطاتك إلى Video Enhancer

انقر على اللوحة اليسرى لفتح وحدة Video Enhancer. اضغط على الأيقونة لاستيراد ملف الفيديو إلى الواجهة.

تحميل لتحسين جودة الفيديو على الكمبيوتر

الخطوة 3: استخدم نموذج الذكاء الاصطناعي المناسب

إلى جانب نموذج عام يطبق التحسين بشكل شامل، توجد عدة نماذج متخصصة يمكن تطبيقها على الفيديو وفقًا لاحتياجات التحسين المحددة.

اختر نموذج الذكاء الاصطناعي المطلوب وطبّقه

يمكنك تطبيق نماذج أخرى مثل UHD Restoration Model التي ستُحسّن جودة فيديو عالي الدقة بدقة 720p بشكل أكبر، مما يعزز الوضوح ويستعيد الحدة.

نموذج تحسين Ultra HD

اختر مدة المعاينة (3 أو 5 ثوانٍ). إذا كنت بحاجة إلى تحسين بضعة عناصر فقط من الفيديو، فاستخدم أداة القص. حدّد دقة الإخراج وتنسيقه.

نصائح: إذا لم تكن متأكدًا من النموذج الذي يجب استخدامه، فاستخدم AI Pilot. سيفحص الفيديو تلقائيًا ويوصي بالتحسين الأنسب.

الخطوة 4: المعاينة والحفظ

بعد إجراء جميع التعديلات اللازمة، انقر على «معاينة» لمقارنة نتائج الفيديو قبل التحسين وبعده. يتيح لك ذلك رؤية الفرق بوضوح بين الإصدار الأصلي والإصدار المُحسَّن قبل الإنهاء.

مقارنة قبل وبعد لتحسين الفيديو

الخطوة 5: التصدير أو التصدير السحابي

عندما تكون راضيًا عن المعاينة، اختر «تصدير» أو «تصدير سحابي» لحفظ الفيديو. استمتع بمقاطع فيديو محسّنة بوضوح مذهل.

عاين الفيديو المُحسَّن وصدّره.

الأسئلة الشائعة حول Gemini Omni 1.1 Flash

إنه نموذج Google المتاح عمومًا لتوليد الفيديو وتحريره، وقد صدر في 27 أغسطس 2026. يستقبل مدخلات نصية وصورية وصوتية وفيديو، وينتج مقاطع قصيرة بصوت متزامن، مع دعم التحرير الحواري وتمديد المشاهد.

لا. إنه متاح فقط ضمن فئة Gemini API المدفوعة، دون حصة مجانية لتوليد الفيديو. يمكن لمشتركي Google AI Plus وPro وUltra الوصول إليه عبر Google Flow باستخدام أرصدة خطتهم بدلًا من الفوترة المباشرة عبر API.

يتعامل مع تحويل النص إلى فيديو، والصورة إلى فيديو، والمرجع إلى فيديو باستخدام الصور أو المقاطع القصيرة، والاستيفاء بين الإطارين الأول والأخير، وتمديد المشاهد حتى طول تراكمي يبلغ 40 ثانية، وكل ذلك قابل للتحرير عبر محادثة متعددة الأدوار باللغة الطبيعية.

تُحتسب تكلفة إخراج الفيديو بمعدل 17.50 دولارًا لكل مليون رمز، أي ما يقارب 0.03 دولار لكل ثانية بدقة 360p، و0.10 دولار بدقة 720p، و0.15 دولار بدقة 1080p، و0.30 دولار بدقة 4K. وتبلغ تكلفة المدخلات من النصوص والصور والصوت والفيديو سعرًا ثابتًا قدره 1.50 دولار لكل مليون رمز.

يضيف الإصدار 1.1 تمديد المشاهد لمدة 40 ثانية (بدلًا من حد ثابت يبلغ 10 ثوانٍ)، والاستيفاء بين الإطارين الأول والأخير، ووضع مسودة بدقة 360p، وإخراجًا بدقة 4K، وهي ميزات لم تكن متوفرة في النموذج الأصلي عند الإطلاق.

الخلاصة

لا يُعد Gemini Omni 1.1 Flash إعادة ابتكار بقدر ما هو حل لما طلبه الناس فعليًا بعد الإصدار الأول: مشاهد أطول، وتحكم حقيقي بالإطارات، وطريقة منخفضة التكلفة لاختبار الأفكار قبل إنفاق أموال فعلية على تصيير نهائي. لا تزال المدخلات متعددة الوسائط، والصوت الأصلي، والتحرير الحواري عبر Interactions API تمثل الأساس الذي يجعله مفيدًا، كما أن تسعير المسودة ثم الترقية يجعل التجربة معه أكثر مرونة بكثير.

نظرًا لأن حتى إخراج 4K هنا عبارة عن ترقية دقة وليس توليدًا أصليًا، فإن تمرير مقاطعك النهائية عبر HitPaw VikPea بعد ذلك يُعد طريقة مباشرة لزيادة حدة التفاصيل، وتقليل التشويش، وتنظيف الوجوه قبل اعتماد الفيديو بصيغته النهائية.

اترك تعليقًا

أنشئ تقييمك لمقالات HitPaw

مقالات ذات صلة

هل لديك أسئلة؟

download
انقر هنا للتثبيت