Meta تكشف عن Muse Image: ذكاء اصطناعي وكيل (Agentic AI) يجلب المستخدمين الحقيقيين إلى Instagram

أطلقت Meta رسميًا أول نموذج لتوليد الصور بالذكاء الاصطناعي طوره قسم Superintelligence Labs الجديد التابع لها، مما يمثل تحولاً كبيراً في كيفية تفاعل مستخدمي وسائل التواصل الاجتماعي مع المحتوى التوليدي. ومن المقرر دمج نموذج Muse Image بسلاسة عبر Instagram وWhatsApp وتطبيق Meta AI، مع وصول الدعم لـ Facebook وMessenger قريباً.

صعود الذكاء الاصطناعي الوكيل (Agentic AI): Muse Image و Spark LLM

على عكس نماذج الانتشار (diffusion models) التقليدية التي تكتفي بالاستجابة للنصوص، وصف Alexandr Wang، رئيس Superintelligence Labs، نموذج Muse Image التابع لـ Meta بأنه "وكيل" (agentic). وهذا يعني أن النموذج لا يعمل في معزل عن المحيط؛ بل يعمل بالتزامن مع نموذج اللغة الكبير Muse Spark للتفكير ومعالجة الأوامر المعقدة.

ومن خلال الاستفادة من قدرات التفكير في Spark LLM، يمكن لـ Muse Image البحث في الويب والدخول في مرحلة تخطيط قبل توليد بكسل واحد. يضمن ذلك التزاماً أعلى بكثير بالأوامر واتساقاً منطقياً. كما تلمح Meta إلى نموذج Muse Video القادم، والذي يهدف إلى منافسة الشركات الرائدة في هذا المجال من خلال التركيز على الدقة البصرية العالية والاتساق الزمني (temporal consistency)—أي القدرة على الحفاظ على الاستقرار البصري عبر الإطارات المتحركة.

التكامل الاجتماعي: الإشارات (@Mentions) ودمج الملامح الشخصية

ربما تكون الميزة الأكثر إحداثاً للتغيير في Muse Image هي تكامله العميق مع الرسم البياني الاجتماعي (social graph) الخاص بـ Meta. فلأول مرة، يمكن للمستخدمين الإشارة (@mention) إلى حسابات Instagram أخرى مباشرة ضمن أمر الذكاء الاصطناعي. يتيح ذلك للنموذج الوصول إلى الصور العامة للمستخدمين المشار إليهم لدمج ملامحهم في الصور المولدة بواسطة الذكاء الاصطناعي.

وبينما يفتح هذا آفاقاً جديدة هائلة للتعبير الإبداعي والسرد القصصي الرقمي، فإنه يثير أيضاً تساؤلات هامة تتعلق بالهوية الرقمية. وقد عالجت Meta هذه المخاوف بالتصريح بأن المستخدمين يحتفظون بالتحكم في كيفية إعادة استخدام محتواهم لتدريب وتوليد الذكاء الاصطناعي، رغم أن القدرة على "سحب" أشخاص حقيقيين إلى بيئات اصطناعية تمثل تطوراً كبيراً في التفاعل عبر وسائل التواصل الاجتماعي.

ما وراء التوليد: إعادة تصميم الواقع والتحرير التفاعلي

يتم تقديم Muse Image كأداة إبداعية متعددة الوظائف بدلاً من كونها مجرد مولد بسيط من نص إلى صورة. يقدم النموذج العديد من الميزات القائمة على المنفعة:

  • إعادة التصميم البصري: يمكن للمستخدمين سحب صور من Facebook Marketplace أو الويب لإعادة تصميم غرف كاملة، مما يسمح بالتصور المكاني الفوري.
  • التحكم المباشر: تتيح الأداة قدرات "الرسم الداخلي" (in-painting) حيث يمكن للمستخدمين الرسم مباشرة على الصور الموجودة لتوجيه الذكاء الاصطناعي لإجراء تعديلات محددة.
  • أداة للتصميم الجرافيكي: يمكن للنموذج إنشاء تصميمات منظمة للاستخدامات العملية، مثل الدعوات، والبطاقات البريدية، وأصول وسائل التواصل الاجتماعي.

من خلال الانتقال من مجرد التوليد إلى مجال التفكير والتخطيط والتكامل الاجتماعي، تحاول Meta تحويل الذكاء الاصطناعي التوليدي إلى طبقة منفعة أساسية لمنظومة Meta بأكملها.

النقاط الرئيسية

  • سير عمل وكيل (Agentic Workflow): يستخدم Muse Image نموذج Muse Spark LLM للتفكير والتخطيط والبحث في الويب، متجاوزاً مجرد مطابقة الأنماط البسيطة إلى تنفيذ الأوامر المعقدة.
  • تكامل الرسم البياني الاجتماعي: تتيح القدرة على الإشارة (@mention) لمستخدمي Instagram للذكاء الاصطناعي دمج ملامح من العالم الحقيقي من الملفات الشخصية العامة في المحتوى المولد.
  • توسيع المنظومة: يحول النموذج تطبيقات التواصل الاجتماعي إلى استوديوهات إبداعية قادرة على إعادة تصميم الغرف، والتحكم المباشر في الصور، والتصميم الجرافيكي.