Habr: Сбер→ المصدر

Apple Foundation Models SDK for Python: локальная Apple Intelligence в агенте Hermes

Команда Сбера собрала нативный провайдер, который подключает локальную модель Apple Intelligence к автономному Python-агенту Hermes через Foundation Models SDK. Модель грузится прямо в процесс и работает на Apple Silicon без облака: среднее время ответа на короткие запросы — 2,8 секунды, а на бенчмарке из 50 вопросов (MMLU, GSM8K, HellaSwag и др.) адаптер дал 46 правильных ответов.

معالج بواسطة الذكاء الاصطناعي من Habr: Сбер؛ بتحرير Hamidun News
Apple Foundation Models SDK for Python: локальная Apple Intelligence в агенте Hermes
المصدر: Habr: Сбер. كولاج: Hamidun News.
◐ استمع للمقال

كشف مهندسو Sber، في تدوينة على مدونة Habr، عن مزوّد أصلي (native provider) يربط نموذج Apple Intelligence المحلي بالوكيل المستقل Hermes المكتوب بلغة Python عبر Apple Foundation Models SDK for Python. وبحسب قياساتهم، بلغ متوسط زمن الاستجابة للاستعلامات القصيرة 2.8 ثانية، وفي اختبار مرجعي (benchmark) من 50 سؤالاً، أعطى المحوّل 46 إجابة صحيحة.

ما هو Foundation Models SDK for Python

Apple Foundation Models SDK for Python هي مكتبة تتيح وصولاً مباشراً إلى نموذج Apple Intelligence المحلي مباشرة من كود Python. أصدرتها Apple في فبراير 2026: يُحمَّل النموذج داخل العملية، وتبقى ذاكرة التخزين المؤقت KV في الذاكرة العشوائية RAM، بينما يعمل الاستدلال (inference) على شرائح Apple Silicon دون أي اتصال بالسحابة.

اكتسبت المكتبة شعبية سريعة بين المطورين. وبحسب GitHub، حصلت بالفعل على 1.2 ألف نجمة، وقدّمت Apple أحدث إصدار، 0.2.0، بدعم للصور، في مؤتمر WWDC26.

  • إصدار المكتبة — فبراير 2026
  • 1.2 ألف نجمة على GitHub
  • الإصدار 0.2.0 بدعم الصور — في WWDC26
  • الاستدلال محلي بالكامل، على شرائح Apple Silicon
  • ذاكرة التخزين المؤقت KV تُخزَّن في ذاكرة العملية

لماذا احتاج Hermes إلى محوّل

لم يكن هناك من قبل مزوّد أصلي جاهز لوكلاء Python. الأغلفة (wrappers) المبنية فوق Foundation Models تحاكي واجهة OpenAI، لكنها لا تسمح للنموذج المحلي بالعمل كمحرك رئيسي للوكيل — بكل آلياته: محدِّد المعدل (rate limiter)، والتراجع (fallback) إلى نماذج أخرى، والتدقيق (audit). كان الاستخدام المباشر لـ Foundation Models موجوداً بالفعل في وكيل iClaw المكتوب بلغة Swift، لكن بالنسبة لوكلاء Python أكثر عمومية، ظلت هذه الإمكانية مغلقة.

يسدّ محوّل Hermes هذه الفجوة: يصبح نموذج Apple المحلي محرك الاستدلال الاعتيادي للوكيل، بدلاً من أن يكون خدمة خارجية خلف غلاف HTTP. وهذا يعني أن الطلبات الموجهة إليه تمر عبر نفس منطق الحدود والتراجع والتسجيل (logging) المطبَّق على استدعاءات النماذج السحابية.

ما النتائج التي أظهرتها الاختبارات المرجعية

في مجموعة اختبار من 50 سؤالاً، حقق المزوّد 46 إجابة صحيحة. أُخذت الأسئلة من خمس مجموعات مرجعية معروفة — MMLU وBoolQ وGSM8K وBIG-Bench وHellaSwag — أي أنها اختبرت في آن واحد المعرفة والمنطق والحساب. وبلغ متوسط زمن رد الفعل للاستعلامات القصيرة 2.8 ثانية — وهو أمر سريع بشكل ملحوظ بالنسبة لاستدلال محلي بالكامل على حاسوب محمول.

الجمع بين السرعة والدقة هو الحجة الرئيسية لهذه الحالة: يستجيب الوكيل دون تأخير في الشبكة ودون استهلاك رموز (tokens) على استدعاءات واجهة برمجة التطبيقات API.

«لماذا لا نجرّب إضافة محوّل قائم على

Foundation Models SDK for Python إلى Hermes، لنحصل على متوسط زمن رد فعل قدره 2.8 ثانية للاستعلامات القصيرة، ونحقق 46 إجابة صحيحة في اختبار مرجعي من 50 سؤالاً؟» — من مقال فريق Sber على Habr.

ما الذي يعنيه هذا

اقتربت النماذج المحلية كثيراً من القيام بدور المحرك الرئيسي للوكلاء المستقلين: دون سحابة، ودون رسوم API، وبزمن استجابة مقبول. وفي السيناريوهات التي تهم فيها الخصوصية والعمل دون اتصال بالإنترنت، يتحول ثنائي Apple Silicon وPython من كونه أمراً غريباً إلى أداة عمل فعلية.

الأسئلة الشائعة

ما هو Apple Foundation Models SDK for Python؟

هي مكتبة Python أصدرتها Apple في فبراير 2026، وتتيح وصولاً مباشراً إلى نموذج Apple Intelligence المحلي: يُحمَّل النموذج داخل العملية ويعمل على شرائح Apple Silicon دون الحاجة إلى السحابة. وعلى GitHub، حصلت على 1.2 ألف نجمة، والإصدار الحالي هو 0.2.0 بدعم للصور.

ما النتائج التي أظهرها محوّل Hermes؟

في اختبار مرجعي من 50 سؤالاً (MMLU وBoolQ وGSM8K وBIG-Bench وHellaSwag)، حقق المزوّد 46 إجابة صحيحة، وبلغ متوسط زمن الاستجابة للاستعلامات القصيرة 2.8 ثانية مع استدلال محلي بالكامل.

ZK
Hamidun News
أخبار الذكاء الاصطناعي بدون ضوضاء. اختيار تحريري يومي من أكثر من 50 مصدر. منتج من جمال حميدون، رئيس الذكاء الاصطناعي في Alpina Digital.

هل تحتاج إلى ذكاء اصطناعي يعمل داخل شركتك — وليس فقط في موجز الأخبار؟

أبني ذكاءً اصطناعياً جاهزاً للإنتاج للشركات — أنظمة CRM مخصّصة، أدوات داخلية، وكلاء مستقلون، أتمتة سير العمل. ملك لك، مصمّم وفق عمليتك، دون رسوم لكل مستخدم. من إعداد جمال خميدون، مدير المنتجات في AlpinaGPT (منصة ذكاء اصطناعي، أكثر من 6000 مستخدم).

ما رأيك؟
جارٍ تحميل التعليقات…