Anthropic Blog→ المصدر

كشفت Anthropic عن تفاصيل حماية Fable 5 السيبرانية واقترحت مقياس لخطورة Jailbreak

نشرت Anthropic في 2 يوليو 2026 تفاصيل حول كيفية عمل مصنفات الأمان في Fable 5: يقسم النموذج جميع الطلبات السيبرانية إلى أربع فئات—من المحظورة إلى الآمنة تماماً—ويستخدم 'هامش أمان' موسع. وبالتوازي، كشفت Anthropic وشريكتها Glasswing عن المسودة الأولى لمقياس خطورة Jailbreak على مستوى الصناعة وأطلقت برنامج HackerOne للباحثين.

معالج بواسطة الذكاء الاصطناعي من Anthropic Blog؛ بتحرير Hamidun News
كشفت Anthropic عن تفاصيل حماية Fable 5 السيبرانية واقترحت مقياس لخطورة Jailbreak
المصدر: Anthropic Blog. كولاج: Hamidun News.
◐ استمع للمقال

في 2 يوليو 2026، وصفت Anthropic بالتفصيل مبادئ كيفية عمل مصنفات الأمان في Fable 5 وأطلقت المسودة الأولى من إطار عمل صناعي لتقييم خطورة جيلبريك.

كيفية تنظيم مصنفات الأمان في Fable 5

الأمن السيبراني هو في الأساس مجال له استخدامات مزدوجة: نفس القدرات يمكن أن تخدم الدفاع والهجوم. وهذا بالضبط سبب عدم سعي Anthropic لحظر كل شيء يتعلق بذلك. بدلاً من ذلك، تقيم مصنفات Fable 5 كل طلب عبر أربع فئات:

  • الاستخدام المحظور—إجراءات تكون في معظم الحالات قادرة على إلحاق ضرر كبير وتفتقر إلى القيمة الدفاعية. محظورة بشكل غير مشروط.
  • استخدام مزدوج عالي المخاطر—أدوات يستخدمها المهاجمون على نطاق واسع ولكن لها أيضاً تطبيقات مشروعة. محظورة أيضاً.
  • استخدام مزدوج منخفض المخاطر—قدرات دفاعية بطبيعتها في الأساس، مفيدة نظرياً وللمهاجمين. المراقبة؛ أحياناً حظر كاحتياط.
  • الاستخدام غير الضار—المهام المشروعة التي لا تنطوي على إمكانية الضرر. مسموح به مع المراقبة.

المفهوم الرئيسي للنظام هو "هامش الأمان": منطقة موسعة عن قصد يقوم المصنف فيها بحظر الطلبات احتياطياً، حتى لو بدت غير ضارة محتملة. يجب أن يبدو الطلب آمناً بوضوح لضمان النجاح من خلال التحقق.

بالنسبة إلى Fable 5، تم توسيع هذا الهامش عن قصد أكثر من نماذج Anthropic السابقة.

لماذا يتطلب مقياس موحد لخطورة الجيلبريك؟

الجيلبريك هو طريقة غير تقليدية لإجبار نموذج ذكاء اصطناعي على تجاوز قيوده الخاصة. يمكن أن يكون غير ضار تقريباً (يزيل قيد واحد فقط بسيط) أو خطير بشكل حرج (يفتح مجموعة واسعة من القدرات الضارة، مما يجعل النموذج أخطر بشكل أساسي).

في الوقت ذاته، تفتقر الصناعة إلى مصطلحات موحدة لتقييم هذه المخاطر، مما يعقد الحوار بشدة بين شركات الذكاء الاصطناعي والمنظمين. أعدت Anthropic، بالتعاون مع شركاء Glasswing، المسودة الأولى من هذا الإطار. تنظر الشركة إليه كنقطة انطلاق للحوار الموسع الذي يشمل المجتمع الأكاديمي والصناعة والمجتمع المدني والهيئات الحكومية.

يتم قبول الاقتراحات على [email protected].

"نعتقد: بالعمل معاً، سنكون قادرين على تطوير معيار سيسمح لنا باستخدام هذه التكنولوجيا لأغراض دفاعية، مع منع الإساءة بشكل متزامن"، قالت في البيان الرسمي لـ

Anthropic.

بالتوازي، تم إطلاق برنامج على منصة HackerOne: يمكن للباحثين في مجال الأمان إرسال جيلبريكات Fable 5 المكتشفة رسمياً للتحقق من قبل فريق Anthropic.

ما يعنيه هذا

تعترف Anthropic علناً بالتعقيد الأساسي للأمن السيبراني كمجال ذو استخدام مزدوج وتختار نهجاً معايراً بدلاً من الحظر الكامل. إطار عمل خطورة الجيلبريك هو أول محاولة صناعية جادة لإنشاء لغة مشتركة للحوار بين معامل الذكاء الاصطناعي والمنظمين.

إذا ترسخ المعيار، ستكون الشركات قادرة على وصف تهديدات التحايل الأمني بشروط متفق عليها، وستكون الحكومات قادرة على تقييم المزيد من المخاطر الدقيقة للنماذج الجديدة.

أسئلة شائعة

ما هو "هامش الأمان" في Fable 5?

"هامش الأمان" هو منطقة يقوم المصنف فيها بحظر الطلبات احتياطياً، حتى لو بدت غير ضارة بشكل صريح. هذا يقلل من خطر السماح عرضاً بالمهام الخطرة بتكلفة بعض الإيجابيات الخاطئة. في Fable 5، وسعت Anthropic عن قصد هذا الهامش مقارنة بالنماذج السابقة.

كيف يمكن للباحثين الإبلاغ عن جيلبريك Fable 5 الذي وجدوه؟

أطلقت Anthropic برنامجاً خاصاً على منصة HackerOne: يمكن لباحثي الأمان إرسال جيلبريكات Fable 5 المكتشفة للتحقق الرسمي. يتم قبول الاقتراحات المفاهيمية على إطار عمل الخطورة على [email protected].

ZK
Hamidun News
أخبار الذكاء الاصطناعي بدون ضوضاء. اختيار تحريري يومي من أكثر من 50 مصدر. منتج من جمال حميدون، رئيس الذكاء الاصطناعي في Alpina Digital.

هل تحتاج إلى ذكاء اصطناعي يعمل داخل شركتك — وليس فقط في موجز الأخبار؟

أبني ذكاءً اصطناعياً جاهزاً للإنتاج للشركات — أنظمة CRM مخصّصة، أدوات داخلية، وكلاء مستقلون، أتمتة سير العمل. ملك لك، مصمّم وفق عمليتك، دون رسوم لكل مستخدم. من إعداد جمال خميدون، مدير المنتجات في AlpinaGPT (منصة ذكاء اصطناعي، أكثر من 6000 مستخدم).

ما رأيك؟
جارٍ تحميل التعليقات…