Google Vids يكشف عن صور رمزية مخصصة بالذكاء الاصطناعي وتكامل مع Gemini Omni

تعمل Google على تحويل أداة بيئة العمل المدعومة بالذكاء الاصطناعي الخاصة بها إلى قوة دافعة لإنتاج الفيديو المخصص. فمع أحدث التحديثات لـ Google Vids، أصبح بإمكان المستخدمين الآن إنشاء صور رمزية رقمية (avatars) مخصصة تحاكي ملامحهم وأصواتهم، مما يشير إلى تحول كبير في كيفية تعامل الشركات مع التواصل عبر الفيديو.

دخول الصور الرمزية الرقمية المخصصة إلى بيئة العمل

في خطوة تستهدف مباشرة سوق إنشاء الفيديو الاحترافي، تتيح Google Vids الآن للمستخدمين أن يكونوا "نجوم" محتواهم الخاص. فمن خلال تحميل صورة سيلفي واحدة وتسجيل صوتي، يمكن للمستخدمين إنشاء صورة رمزية رقمية مخصصة تبدو وتسمع بشكل مذهل مثلهم تمامًا. تم تصميم هذه الميزة لتبسيط إنتاج تحديثات الشركة، وفيديوهات التدريب، والاتصالات الداخلية دون الحاجة إلى التصوير المستمر.

ولمعالجة المخاوف الأخلاقية المحيطة بالـ deepfakes (التزييف العميق)، تقوم Google بتنفيذ ضمانات صارمة. ترتبط هذه الصور الرمزية المخصصة تحديدًا بحساب Google الخاص بالمستخدم، ويتم وضع علامة مائية غير مرئية عليها باستخدام تقنية SynthID. يقتصر الوصول إلى ميزات هذه الصور الرمزية حاليًا على المستخدمين الذين تبلغ أعمارهم 18 عامًا فأكثر في مناطق جغرافية محددة، مما يضمن إطلاقًا مدروسًا لهذه الوسائط الاصطناعية عالية الدقة.

تعزيز الإبداع باستخدام Gemini Omni

إن تطور Google Vids مدفوع بالتكامل مع Gemini Omni، وهو نموذج الذكاء الاصطناعي متعدد الوسائط المتقدم من Google. يتيح هذا التكامل سير عمل متطور من "النص إلى الفيديو" (prompt-to-video)، حيث يمكن للمستخدمين الجمع بين الأوامر النصية المكتوبة وصور مرجعية محملة. يقوم Gemini Omni بدمج هذه المدخلات المتباينة لإنشاء تسلسلات فيديو متماسكة.

وإلى جانب مجرد التوليد، يعمل Gemini Omni كمجموعة أدوات ذكية لما بعد الإنتاج. يمكن للنموذج أداء مهام بصرية معقدة مثل تبديل الخلفيات، وإصلاح مشكلات الإضاءة في التسجيلات الملتقطة بالهاتف المحمول، وإضافة تأثيرات سينمائية. والأهم من ذلك، يقدم التحديث دعمًا للتعديلات خطوة بخطوة، مما يسمح للمبدعين بإجراء تغييرات دقيقة وتكرارية على مشاريعهم أثناء العمل، مما يلغي الإحباط الناتج عن الاضطرار إلى إعادة عملية الرندرة (render) من البداية عند الحاجة إلى تعديل تفصيل واحد.

تغيير المشهد التنافسي

تمثل هذه التحديثات تحولًا استراتيجيًا لشركة Google. فبينما تم طرح Vids في البداية كأداة عرض تقديمية مدعومة بالذكاء الاصطناعي لـ Google Workspace، إلا أنها تتطور بسرعة لتصبح منصة شاملة لإنشاء الفيديو. ومن خلال دمج هذه القدرات مباشرة في منظومة Workspace، تنتقل Google إلى ما هو أبعد من مجرد شرائح العرض البسيطة وتدخل مجال إنتاج الفيديو عالي الجودة.

يضع هذا التطور Google في منافسة مباشرة مع الشركات الناشئة المتخصصة في فيديو الذكاء الاصطناعي مثل HeyGen وSynthesia وCaptions وD-ID. وبينما تركز تلك المنصات بشكل كبير على المقدمين الاصطناعيين، تكمن ميزة Google في تكاملها السلس مع سير عمل المؤسسات الحالي. بالنسبة للمؤسسين والمطورين، يشير هذا إلى اتجاه تتحول فيه النماذج متعددة الوسائط مثل Gemini Omni من تجارب بحثية إلى مكونات أساسية وتفاعلية في حزمة الإنتاجية المهنية.

النقاط الرئيسية

  • التوائم الرقمية المخصصة: يمكن للمستخدمين إنشاء صور رمزية بالذكاء الاصطناعي باستخدام صورة سيلفي وتسجيل صوتي فقط، مما يسهل عملية إرسال الرسائل عبر الفيديو الاحترافي.
  • التحرير متعدد الوسائط: يتيح التكامل مع Gemini Omni إنشاء فيديوهات معقدة بناءً على الأوامر النصية، وإجراء تعديلات بصرية تكرارية وخطوة بخطوة.
  • أمان بمستوى المؤسسات: جميع الصور الرمزية المخصصة محمية بعلامة مائية غير مرئية من SynthID ومرتبطة بحسابات Google موثقة لمنع سوء الاستخدام.