القاهرة مباشر

Baidu MuseStreamer: منافس Google Veo 3 يغير صناعة الفيديو بالذكاء الاصطناعي!

الثلاثاء 8 يوليو 2025 10:30 صـ 12 محرّم 1447 هـ
نموذج MuseStreamer من Baidu لتوليد فيديو ذكاء اصطناعي ينافس Veo 3 من Google
نموذج MuseStreamer من Baidu لتوليد فيديو ذكاء اصطناعي ينافس Veo 3 من Google

أفادت تقارير حديثة أن شركة بايدو (Baidu) قد كشفت عن نموذجها المبتكر لتوليد الفيديو بالذكاء الاصطناعي. يُعرف هذا النموذج باسم MuseStreamer، ويتميز بقدرته الفريدة على دمج الصوت الصيني الأصيل في الفيديوهات المُولّدة. هذا الإنجاز يضعه في المرتبة الثانية عالميًا بعد نموذج Veo 3 من جوجل، لكن بايدو تؤكد أنه الأول من نوعه في دعم توليد الصوت الصيني الأصلي.

إلى جانب هذا النموذج المذهل، أطلقت بايدو أيضًا نموذجًا لغويًا كبيرًا (LLM). كما قدمت الشركة منصة جديدة لإنشاء محتوى الفيديو تُسمى HuiXiang. تجدر الإشارة إلى أن كلاً من MuseStreamer وHuiXiang متاحان حاليًا داخل الصين فقط.

تطور نماذج توليد الفيديو بالذكاء الاصطناعي

شهد عالم نماذج توليد الفيديو بالذكاء الاصطناعي تطورًا ملحوظًا. ففي غضون عامين فقط، انتقلنا من نماذج تواجه تحديات في تفاصيل بسيطة كعدد أصابع الأشخاص، إلى نماذج لغوية كبيرة (LLM) تستطيع محاكاة الفيزياء والحركة بواقعية ودقة عالية. ومع ذلك، ظلت إحدى النقاط الصعبة التي تجنبتها معظم شركات الذكاء الاصطناعي هي دمج الصوت الأصيل في مقاطع الفيديو المُولّدة.

جوجل تقتحم مجال الصوتيات مع Veo 3

في مؤتمر جوجل للمطورين (Google I/O 2025)، حققت جوجل قفزة نوعية. أصبحت جوجل أول شركة تقدم إمكانية توليد الفيديو مع الصوت الأصيل من خلال نموذجها Veo 3. وقد أحدث هذا النموذج ضجة كبيرة، متفوقًا على منافسه القوي Sora من OpenAI. قامت الشركة العملاقة، ومقرها ماونتن فيو، بتوسيع نطاق Veo 3 مؤخرًا. أصبح Veo 3 متاحًا في جميع الدول الـ 154 التي يتوفر فيها تطبيق Gemini، مما يعكس جهود جوجل المكثفة لتطوير هذه الأداة المبتكرة.

بايدو تدخل المنافسة بقوة مع MuseStreamer

وفقًا لتقرير صادر عن Tech in Asia (عبر AI Base)، دخلت شركة بايدو الصينية العملاقة المنافسة بقوة. قدمت بايدو نموذج الذكاء الاصطناعي MuseStreamer. يُقال إن هذا النموذج ينتج مقاطع فيديو بصوت صيني، ويُعد النموذج الوحيد القادر على ذلك. من الجدير بالذكر أن Veo 3 من جوجل لا ينتج الصوت إلا باللغة الإنجليزية.

لا يقتصر عمل MuseStreamer على إنشاء حوارات متزامنة مع مقاطع الفيديو فحسب. بل يمكنه أيضًا إضافة مؤثرات صوتية وضوضاء محيطة إليها. وقد زعمت بايدو أن نموذجها حقق نسبة 89.38% على معيار VBench I2V، محتلاً المركز الأول. تقدم بايدو هذا النموذج اللغوي الكبير (LLM) كأداة قوية لإنشاء المحتوى للمستهلكين.

منصة HuiXiang: واجهة بايدو لإنشاء الفيديو

بالإضافة إلى نموذج الذكاء الاصطناعي، أطلقت بايدو منصة جديدة لمحتوى الفيديو تُسمى HuiXiang. تُعد HuiXiang الواجهة الأمامية لنموذج الذكاء الاصطناعي MuseStreamer. تتيح المنصة للمستخدمين مشاركة المطالبات وإنشاء مقاطع الفيديو بسهولة.

ذكر التقرير أن HuiXiang تدعم حاليًا إنشاء مقاطع فيديو مدتها 10 ثوانٍ بدقة 1080 بكسل. بالمقارنة، لا يمكن لـ Veo 3 إنشاء مقاطع فيديو تتجاوز مدتها 8 ثوانٍ. ومع ذلك، لا يوجد وضوح بشأن نسبة العرض إلى الارتفاع الافتراضية للفيديو في HuiXiang. كما لا توجد معلومات مؤكدة حول ما إذا كان بإمكان المستخدمين إنشاء مقاطع فيديو بنسب عرض إلى ارتفاع مختلفة.

الكلمات المفتاحية: الذكاء الاصطناعي، توليد الفيديو، بايدو، MuseStreamer، HuiXiang، Veo 3، جوجل، الصوت الصيني.

وصف ميتا: اكتشف كيف يدخل نموذج Baidu MuseStreamer سوق توليد الفيديو بالذكاء الاصطناعي، متفوقًا بقدرته الفريدة على دمج الصوت الصيني، ومنافسًا Veo 3 من Google.