كشفت OpenAI عن مبادئ السلامة في Sora 2: من التزييف العميق إلى وسم المحتوى
كشفت OpenAI كيف جرى دمج السلامة في Sora 2 منذ بداية التطوير. وحصل نموذج الفيديو من الجيل الجديد والمنصة الاجتماعية للإبداع على حماية متعددة المستويات: مرشحات داخل النموذج نفسه، والتحقق من العمر، ووسم المحتوى وفق معيار C2PA، وعمليات red teaming واسعة النطاق قبل الإطلاق. وتقر الشركة بأنه لا يوجد مرشح مثالي، وتعتمد على حماية متعددة الطبقات.
معالج بواسطة الذكاء الاصطناعي من OpenAI Blog؛ بتحرير Hamidun News
نشرت OpenAI وصفًا تفصيليًا للنهج الأمني الذي يكمن وراء Sora 2 — الإصدار الجديد من نموذج توليد الفيديو — والتطبيق المقابل لإنشاء المحتوى. تؤكد الشركة: الأمان لم يتم إضافته فوق منتج مكتمل — بل تم دمجه في البنية منذ بداية التطوير. يمثل Sora 2 جيلًا جديدًا من نموذج الفيديو لدى OpenAI، القادر على توليد مقاطع فيديو واقعية من تعليمات نصية وبصرية بجودة أعلى بشكل ملموس. في الوقت نفسه، أطلقت OpenAI Sora كمنصة اجتماعية مستقلة موجهة نحو المستخدمين المبدعين: الفنانين والمخرجين والمدونين وصانعي المحتوى. إن مزيج النموذج القوي والمنصة العامة المفتوحة هو ما يخلق، برأي الشركة، تحديات أمنية جديدة بشكل أساسي — تحديات لم تواجهها الصناعة من قبل على هذا النطاق.
يتم تنظيم الحماية على مستويات متعددة. المستوى الأول هو التحكم على مستوى النموذج ذاته. تم تدريب Sora 2 على رفض الطلبات التي تنتهك سياسة الاستخدام المقبول: إنشاء deepfakes للأشخاص الحقيقيين بدون موافقتهم، محتوى جنسي يتعلق بالقاصرين، مواد تروج للعنف أو تنشر معلومات مضللة. يتم دمج هذه الطبقة من الحماية مباشرة في أوزان النموذج وتنشط قبل توليد أي محتوى حتى. المستوى الثاني يشمل تدابير من جانب المنصة. تطبيق Sora يتضمن التحقق من العمر والقيود الإقليمية على أنواع معينة من المحتوى وأنظمة الشكاوى وأدوات الإشراف التي تسمح للمستخدمين بالإبلاغ عن الانتهاكات.
يستحق الانتباه الخاص العمل مع نسب محتوى. جميع مقاطع الفيديو المنشأة عبر Sora يتم تمييزها باستخدام معيار C2PA (تحالف نسب المحتوى والأصالة) — مجموعة من البيانات الوصفية التقنية التي تسمح بتحديد المادة كمحتوى يولده الذكاء الاصطناعي. هذا يعني أنه حتى بعد تحميل وإعادة نشر مقطع فيديو، يمكن تحديد مصدره من الناحية التقنية. المبادرة موجهة نحو مكافحة المعلومات المضللة: ستتمكن غرف الأخبار والمنصات والمستخدمون العاديون من معرفة ما تم إنشاؤه بواسطة الذكاء الاصطناعي بدلاً من التقاطه بالكاميرا.
عنصر مهم آخر هو الاختبار الخارجي. قبل الإطلاق العام، أجرت OpenAI اختبار red teaming على نطاق واسع: باحثون أمنيون مستقلون وصناع أفلام وتنظيمات حقوق الإنسان اختبروا النموذج تحت الضغط، محاولين تحديد نقاط الضعف والطرق للالتفاف حول القيود. أثرت نتائجهم مباشرة على التكوين النهائي لنظام الأمان.
تعترف الشركة علنًا: لا آلية حماية توفر ضمانات مطلقة. يتم وضع الرهان على الحماية متعددة الطبقات — مزيج من قيود النموذج وقواعد المنصة والنسب التقني وأدوات الإشراف. بدلاً من البحث عن مرشح واحد مثالي، تبني OpenAI نظامًا من الحواجز المتكاملة بشكل متبادل، كل منها يعقد الإساءة. إطلاق نماذج فيديو قوية للوصول العام هو دائمًا مقايضة بين الإمكانية الإبداعية والمخاطر. كلما كان المحتوى المركب أكثر واقعية، كلما ارتفعت الرهانات للمجتمع. لن يأتي الاختبار الحقيقي لنهج OpenAI في لحظة الإطلاق، بل مع بدء استخدام Sora 2 من قبل ملايين الأشخاص في أكثر السياقات تنوعًا — بما في ذلك غير المتوقعة.
هل تحتاج إلى ذكاء اصطناعي يعمل داخل شركتك — وليس فقط في موجز الأخبار؟
أبني ذكاءً اصطناعياً جاهزاً للإنتاج للشركات — أنظمة CRM مخصّصة، أدوات داخلية، وكلاء مستقلون، أتمتة سير العمل. ملك لك، مصمّم وفق عمليتك، دون رسوم لكل مستخدم. من إعداد جمال خميدون، مدير المنتجات في AlpinaGPT (منصة ذكاء اصطناعي، أكثر من 6000 مستخدم).
أهم ما في عالم الذكاء الاصطناعي — مرة كل أسبوع
سبع قصص مهمة فعلاً هذا الأسبوع، مختارة بعناية. بلا ضجيج ولا بيانات صحفية.
تم! تحقق من بريدك للتأكيد.