S Sardaana
← العودة إلى Sardaana AI
AI خبر

Meta تكشف عن Muse Realtime Avatar: صور رمزية فيديو تعبيرية متزامنة مع صوت Muse في أقل من ثانية

في 23 سبتمبر 2026 قدّمت Meta نظام Muse Realtime Avatar الذي يحوّل Muse Realtime Voice إلى صور رمزية تفاعلية مشروطة بصورة أو رسم. البث بدقة 448×768 وبزمن انتقال نحو 870 مللي ثانية؛ Muse لمن هم 18 عامًا فأكثر.

في 23 سبتمبر 2026 خلال Meta Connect قدّمت Meta نظام Muse Realtime Avatar الذي يحوّل Muse Realtime Voice إلى صور رمزية تعبيرية تفاعلية مشروطة بوسائط مرجعية مثل صورة أو رسم أو حتى حيوانات وأشياء. كما أعلنت الشركة نظارات Ray-Ban Meta Audio وقالت إن Muse قادم إلى النظارات؛ ويظل Muse متاحًا لمن هم في سن 18 فأكثر.

كيف يعمل

تُقاد الصورة الرمزية بمحوّل انتشار (Diffusion Transformer) موجّه بالصوت يشارك تيار رموز الكلام مع نموذج الصوت حتى تبقى حركة الشفاه والتعبير متزامنتين. تقول Meta إنها تبث صورة عمودية بدقة 448×768 بمعدل 25 إطارًا في الثانية، وبزمن انتقال يقارب 870 مللي ثانية من نهاية دور المستخدم إلى أول بايت من الصوت والفيديو المتزامنين.

تقلّل عملية التقطير الحساب بشكل حاد: يُستبدل نموذج معلّم كان يستخدم 120 تقييمًا لكل جزء بطالب يحتاج تقييمين غير موجّهين فقط — أي خفضًا بمقدار 60 مرة. وعلى وحدة معالجة رسومية GB200 واحدة، تفيد Meta بـ 12 جلسة فيديو فورية متزامنة، أي زيادة سعة بمقدار 8 أضعاف مقارنة بخط أساس BF16.

المقارنات والسلامة

في مقارنات مكالمات مباشرة، فضّل المقيّمون البشريون وفق Meta نظام Muse Realtime Avatar إجمالًا على Runway Characters وHeyGen LiveAvatar. وللسلامة تطبّق Meta علامة مائية غير مرئية Meta Video Seal دون إضافة زمن انتقال.

لماذا يهم

تربط الصور الرمزية الفورية المشروطة بمرجع بين الذكاء الاصطناعي الحواري والحضور على الشاشة. وتقدّم أرقام التأخير والسعة والعلامة المائية التي نشرتها Meta أساسًا ملموسًا لكيفية طرح مثل هذه الأنظمة — بينما تعكس بوابة العمر 18+ والوسم إطار السلامة المعلن لـ Muse.

متوفر أيضًا بـ: EnglishСаха тылаРусскийEspañol中文Português

تسجيل الدخول إلى Sardaana

تحتاج إلى حساب فقط للنشر والرد والتصويت والتعاون.

يمكنك تصفّح الموقع وقراءة الأخبار والمشاريع والمنتدى دون تسجيل.