مباشر
أين يمكنك متابعتنا

أقسام مهمة

Stories

67 خبر
  • زيارة بوتين إلى الصين
  • نبض الملاعب
  • إسرائيل تواصل غاراتها على لبنان
  • زيارة بوتين إلى الصين

    زيارة بوتين إلى الصين

  • نبض الملاعب

    نبض الملاعب

  • إسرائيل تواصل غاراتها على لبنان

    إسرائيل تواصل غاراتها على لبنان

  • العملية العسكرية الروسية في أوكرانيا

    العملية العسكرية الروسية في أوكرانيا

  • هدنة وحصار المضيق

    هدنة وحصار المضيق

  • فيديوهات

    فيديوهات

  • شي جين بينغ خلال لقائه بوتين: الشرق الأوسط يمر بمرحلة حرجة بين الحرب والسلام

    شي جين بينغ خلال لقائه بوتين: الشرق الأوسط يمر بمرحلة حرجة بين الحرب والسلام

  • مقتل 12 وإصابة 15 أكثر من إثر القصف الإسرائيلي على لبنان الثلاثاء

    مقتل 12 وإصابة 15 أكثر من إثر القصف الإسرائيلي على لبنان الثلاثاء

  • لحظة بلحظة.. تحت غطاء "وقف النار" إسرائيل تواصل عملياتها في لبنان

    لحظة بلحظة.. تحت غطاء "وقف النار" إسرائيل تواصل عملياتها في لبنان

الموناليزا تغني الراب! .. "مايكروسوفت" تطور نموذج ذكاء اصطناعي "واقعي بشكل مخيف"

طورت شركة "مايكروسوفت" نموذج ذكاء اصطناعي، يحول صور وجه الشخص ومقاطع الصوت إلى فيديو مع مزامنة الشفاه وتعبيرات الوجه وحركات الرأس بشكل مناسب.

الموناليزا تغني الراب! .. "مايكروسوفت" تطور نموذج ذكاء اصطناعي "واقعي بشكل مخيف"
لوحة الموناليزا / China News Service / Contributor / Gettyimages.ru

وتم تطوير نموذج الذكاء الاصطناعي الجديد بواسطة فريق من العلماء في مجال الذكاء الاصطناعي في Microsoft Research Asia، ويسمى VASA-1.

وقال الفريق في ورقة بحثية: "لقد قدمنا VASA، وهو إطار عمل لتوليد وجوه ناطقة نابضة بالحياة مع مهارات عاطفية بصرية جذابة (VAS) من خلال صورة ثابتة واحدة ومقطع صوتي للكلام. إن نموذجنا الأول، VASA-1، قادر ليس فقط على إنتاج حركات الشفاه المتزامنة بشكل رائع مع الصوت، ولكن أيضا التقاط مجموعة كبيرة من الفروق الدقيقة في الوجه وحركات الرأس الطبيعية التي تساهم في إدراك الأصالة والحيوية".

ويدعي الفريق أن طريقتهم لا توفر جودة فيديو عالية مع ديناميكيات واقعية للوجه والرأس فحسب، بل تدعم أيضا إنشاء مقاطع فيديو بحجم 512 × 512 عبر الإنترنت بسرعة تصل إلى 40 إطارا في الثانية مع زمن انتقال لا يكاد يذكر.

وهذا يمهد الطريق للتفاعلات في الوقت الفعلي مع الصور الرمزية النابضة بالحياة التي تحاكي سلوكيات المحادثة البشرية، وفقا لما ذكره العلماء.

ويشار إلى أن VASA هو اختصار لـ Visual Affective Skills Animator (بمعنى الرسوم المتحركة للمهارات البصرية العاطفية)، وهو نموذج قادر على تحويل أي صور ثابتة سواء تم التقاطها بواسطة الكاميرا، أو رسمها، إلى رسوم متحركة "متزامنة بشكل رائع".

ويمكن لـ VASA إنشاء فيديو حقيقي "مخيف"، حيث تحاكي "الوجوه الناطقة الواقعية" سلوكيات المحادثة البشرية من خلال إيماءات الوجه وحركة العين والرأس الطبيعية، وكل ذلك من صورة ثابتة واحدة للرأس.

واستخدم الفريق مجموعة بيانات VoxCeleb2 المتاحة للجمهور والتي تحتوي على مقاطع فيديو لأكثر من 6000 من المشاهير الواقعيين.

وبعد التخلص من المقاطع التي تتضمن عدة أفراد وذات جودة منخفضة، قام الفريق بتدريب نموذجهم على مجموعة البيانات المعالجة.

ومن اللافت للنظر أن نموذجهم يمكنه التعامل مع المدخلات خارج مجموعة التدريب، مثل الصور الفنية والكلام بغير الإنجليزية.

غناء الموناليزا

وباستخدام مقطع صوتي لأغنية Paparazzi بصوت آن هاثاواي، أجرى العلماء تجارب على الموناليزا.

وادعى الفريق أن نظام الذكاء الاصطناعي يمكن أن يعمل في الوقت الفعلي، حيث أظهروا مقطعا يوضح الأداة وهي تقوم على الفور بتحريك الصور باستخدام تعبيرات الوجه وحركات الرأس. كما يوفر النموذج التحكم في النظرة والمسافة والعواطف في الفيديو الذي تم إنشاؤه.

مخاوف انتحال الشخصية

في حين أن قدرات النموذج تثير مخاوف انتحال الشخصية، فإن العلماء يصرون على أن هدفهم من الأداة ليس تعزيز التزييف العميق.

وكتبوا في منشور: "نحن نستكشف توليد المهارات العاطفية البصرية للشخصيات الافتراضية والتفاعلية، وليس انتحال شخصية أي شخص في العالم الحقيقي".

ويؤكد فريق البحث أن النموذج سيتم استخدامه للتعليم وتوفير الرفقة. وقد رفضوا أيضا إصدار الكود الذي يدعم النموذج.

وأكد الفريق اهتمامه بتطبيق التقنية الجديدة لتعزيز اكتشاف التزوير. وأكدوا: "ليس لدينا أي خطط لإصدار عرض توضيحي عبر الإنترنت أو واجهة برمجة تطبيقات أو منتج أو تفاصيل تنفيذ إضافية أو أي عروض ذات صلة حتى نتأكد من استخدام التكنولوجيا بشكل مسؤول ووفقا للوائح المناسبة".

المصدر: Interesting Engineering

التعليقات

"الكلام جرحني قبل ما يجرحكم".. الرئيس السوري يعتذر لأهالي محافظة دير الزور (فيديو)

الدفاع الإماراتية: المسيرة التي اعتدت على محطة براكة للطاقة النووية بأبوظبي قدمت من الأراضي العراقية

"فاينانشال تايمز": ترامب عرض في الصين التحالف مع بكين وموسكو ضد "الجنائية الدولية"

عقب خروج احتجاجات.. والد الرئيس السوري يوضح حقيقة تصريحاته المتداولة بشأن دير الزور (فيديو)

إيران تكشف لأول مرة تفاصيل إصابة مجتبى خامنئي في اليوم الأول من "حرب رمضان"

المرشد الأعلى الإيراني: أحد إنجازات الحرب الأخيرة هو ارتقاء بلادنا إلى مصاف الدول العظمى المؤثرة

قرقاش: الموقف الرمادي أخطر من اللا موقف وخلط الأدوار خلال العدوان الإيراني الغاشم محير

ترامب: سننهي الحرب مع إيران بسرعة كبيرة و"طريقة لطيفة"

نيبينزيا: الرد الروسي سيكون حتميا حال إطلاق مسيرات من دول البلطيق

"نفاق صارخ".. إيران ترد على اتهامات المستشار الألماني بشأن الهجوم على منشآت نووية بالإمارات

نيبينزيا يدين الهجمات على المحطة النووية في الإمارات: لولا المغامرة الأمريكية الإسرائيلية ما حدث ذلك

جنود أمريكيون: طلبنا تعزيزا طبيا قبل أسابيع من ضربة إيرانية قاتلة في الكويت لكنه قوبل بالتجاهل

"لا ترتكبوا هذا الخطأ الجسيم معه".. ميركل تقدم نصيحة للسياسيين الأوروبيين تخص بوتين

الداخلية السورية: التحقيقات في تفجير باب شرقي كشفت ‏خيوطا أولية حول الجهات المتورطة (صور + فيديو)