Habr AI→ المصدر

Claude Fable 5 مقابل GPT-5.5 Pro: مقارنة في 12 مهمة عبر مجمع BotHub

نشر Habr مقارنة بين Claude Fable 5 من Anthropic و GPT-5.5 Pro من OpenAI في 12 مهمة عملية. Claude Fable 5 هو أول نموذج من فئة Mythos الجديدة، التي تصنف فوق Opus في تسلسل Anthropic الهرمي، وأعادت Anthropic بشكل غير متوقع إتاحتها للوصول المفتوح. تم إجراء الاختبار من خلال مجمع API BotHub مع تتبع التكاليف بالرموز لكل حل.

معالج بواسطة الذكاء الاصطناعي من Habr AI؛ بتحرير Hamidun News
Claude Fable 5 مقابل GPT-5.5 Pro: مقارنة في 12 مهمة عبر مجمع BotHub
المصدر: Habr AI. كولاج: Hamidun News.
◐ استمع للمقال

قارن مؤلفو مدونة Habr على BotHub بين نموذجي لغة رائدين — Claude Fable 5 من Anthropic و GPT-5.5 Pro من OpenAI — في 12 مهمة عملية، اختبروا كلا النموذجين من خلال مجمع API الخاص بهم لشبكات عصبية.

لماذا يتم مقارنة هذا الزوج المعين

في المقالة السابقة، قارن المؤلفون بالفعل Claude Opus 4.8 و GPT-5.5 و Gemini 3.1 Pro، لكنهم وضحوا على الفور: لم تشارك GPT-5.5 Pro في تلك المناسبة لأنه كان من الأصح مقارنتها مع Claude Fable 5 — لكن وقت النشر، Fable 5 لم تكن متاحة. تغيرت الحالة عندما أعادت Anthropic بشكل غير متوقع Claude Fable 5 إلى الوصول العام.

  • Claude Fable 5 — أول نموذج من فئة Mythos الجديدة، التي تحتل مرتبة أعلى من Opus في تسلسل Anthropic
  • أعادت Anthropic بشكل غير متوقع Fable 5 إلى الوصول المفتوح
  • تستند المقارنة على 12 مهمة عملية يومية، وليس معايير رسمية
  • تم إجراء الاختبار من خلال مجمع API BotHub، وليس من خلال واجهات الويب للنماذج

كيف يتم هيكلة منهجية الاختبار

رفض المؤلفون بشكل متعمد المعايير الجاهزة والمطالبات التسويقية من الشركات المصنعة، والمراهنة على مهام يومية حقيقية. تم إجراء الاختبار من خلال مجمع شبكات عصبية BotHub — يعمل من خلال واجهات برمجية، والتي حسب المؤلفين تلغي العكاكيز والحلول البديلة التي تساعد ضمنياً النماذج في واجهات الويب الخاصة بهم. تسمح المنهجية أيضاً برؤية فوري لتكلفة كل مهمة.

يُقاس التكلفة بالعملة الداخلية للمحفظة BotHub — CAPS، المرتبطة بعدد الرموز المنفقة. عادةً، يشتري الروبل الواحد من 4000 إلى 6500 CAPS حسب حجم الشراء؛ في هذه المقارنة، استخدم المؤلفون سعراً يبلغ حوالي 1 روبل = 6370 CAPS، لأن خطتهم تغيرت. ينتمي كلا النموذجين إلى القطاع الممتاز، لذا انتهت الأسعار النهائية للمهام كونها أعلى بشكل كبير من مقارنة Opus 4.8 و GPT-5.5 و Gemini 3.1 Pro السابقة.

يتم تحديد الفائز بكل مهمة بشكل أساسي من الناحية الذاتية، كما هو الحال من قبل، مع تحذير المؤلفين القراء بصراحة بشأن ذلك. تم إطلاق جميع مواد الاختبار في المجال العام، بحيث يمكن للقراء تشكيل آرائهم الخاصة واختيار فضلهم بين النماذج.

ما الذي يجعل هذا التنسيق المقارن مثيراً للاهتمام

النشر المفتوح لجميع مواد الاختبار هو جزء من المنهجية: بدلاً من مجرد إعلان الفائز، يعطون القراء الفرصة لتقييم إجابات كلا النموذجين على كل من 12 مهمة بأنفسهم وتشكيل آرائهم الخاصة، حتى لو اختلفت عن استنتاجات المؤلفين. يكون هذا النهج قيماً بشكل خاص للقطاع الممتاز من النماذج مثل Claude Fable 5 و GPT-5.5 Pro، حيث يصبح تكلفة الطلب نفسه جزءاً من القرار بشأن اختيار نموذج — ليس فقط جودة الرد، بل سعره بوحدة CAPS.

ماذا يعني هذا

عودة Claude Fable 5 إلى الوصول العام تسمح للمرة الأولى بمقارنة مباشرة لنموذج فئة Mythos الأعلى من Anthropic مع إصدار GPT-5.5 Pro الأعلى من OpenAI على قدم المساواة بـ API، وليس من خلال وعود تسويقية من الشركات المصنعة. بالنسبة للفريق الذي يختار نموذجاً لمهام محددة، فإن هذه المقارنات العملية مع حساب تكلفة الرموز الشفاف أكثر قيمة من المعايير الرسمية، التي عادة ما تجتاز النماذج الممتازة تقريباً بنفس الجودة.

الأسئلة الشائعة

ما هي فئة نماذج Mythos في Anthropic؟

Mythos هي فئة نموذج جديدة من Anthropic تحتل مرتبة أعلى من Opus في تسلسل الشركة. Claude Fable 5 هو أول نموذج تم إصداره في هذه الفئة.

كيف حسبت المقارنة تكلفة الطلبات للنماذج؟

تم قياس التكلفة بالعملة الداخلية لمجمع BotHub — CAPS، مرتبطة بعدد الرموز المنفقة. عادةً، 1 روبل يساوي 4000-6500 CAPS حسب حجم الشراء؛ في هذا الاختبار، تم استخدام سعر يبلغ حوالي 1 روبل = 6370 CAPS.

ZK
Hamidun News
أخبار الذكاء الاصطناعي بدون ضوضاء. اختيار تحريري يومي من أكثر من 50 مصدر. منتج من جمال حميدون، رئيس الذكاء الاصطناعي في Alpina Digital.

هل تحتاج إلى ذكاء اصطناعي يعمل داخل شركتك — وليس فقط في موجز الأخبار؟

أبني ذكاءً اصطناعياً جاهزاً للإنتاج للشركات — أنظمة CRM مخصّصة، أدوات داخلية، وكلاء مستقلون، أتمتة سير العمل. ملك لك، مصمّم وفق عمليتك، دون رسوم لكل مستخدم. من إعداد جمال خميدون، مدير المنتجات في AlpinaGPT (منصة ذكاء اصطناعي، أكثر من 6000 مستخدم).

ما رأيك؟
جارٍ تحميل التعليقات…