MarkTechPost→ المصدر

Fireworks Nexus: маршрутизация кода в open-weight модели и снижение AI-расходов в 3–5 раз

Fireworks AI выпустила Fireworks Nexus — слой маршрутизации, который отправляет рутинные задачи кодинга на open-weight модели, а сложные оставляет frontier-провайдеру. По данным компании, это режет расходы в 3–5 раз без изменения Claude Code, Codex и OpenCode. В независимом тесте Faros AI связка на GLM-5.2 обошла Opus 4.8 по качеству и стоила вдвое дешевле.

معالج بواسطة الذكاء الاصطناعي من MarkTechPost؛ بتحرير Hamidun News
Fireworks Nexus: маршрутизация кода в open-weight модели и снижение AI-расходов в 3–5 раз
المصدر: MarkTechPost. كولاج: Hamidun News.
◐ استمع للمقال

أطلقت شركة Fireworks AI في 28 يوليو 2026 منصة Fireworks Nexus — وهي منصة لتوجيه المهام والتحكم في الإنفاق، توجّه مهام البرمجة الروتينية إلى نماذج open-weight، وبحسب ما تعلنه الشركة المطوّرة، تخفض التكلفة بمقدار 3–5 مرات دون تغيير الأدوات المعتادة مثل Claude Code.

لماذا كانت هناك حاجة لذلك

ينمو الإنفاق على وكلاء الذكاء الاصطناعي بوتيرة أسرع مما تستطيع الشركات التخطيط له. وبحسب Forbes، استنفدت Uber ميزانيتها الكاملة المخصصة للذكاء الاصطناعي لعام 2026 خلال أربعة أشهر فقط. وتستشهد Fireworks بالتقرير نفسه: فقد ارتفع تبنّي أدوات الوكلاء لدى فرق الهندسة من نحو ثلث الموظفين إلى أكثر من أربعة أخماسهم خلال شهرين، كما بلغ عدد المهندسين الذين يستخدمون Claude Code نحو 5000 مهندس بعد إطلاقه في ديسمبر 2025.

وتصف Fireworks جذر المشكلة بأنه سوء توافق وليس إفراطًا في الإنفاق: فمعظم المؤسسات تنفّذ العمل الروتيني بأسعار "الطليعة" (frontier) لأن الانتقال إلى نماذج open-weight غير مريح تشغيليًا لفرق المنصات.

كيف تعمل Fireworks Nexus

تتكوّن Fireworks Nexus من ثلاثة أجزاء وتُركَّب فوق أدوات التطوير المستخدَمة بالفعل. الميزات الرئيسية:

  • التحكم والمراقبة (Observability) — ميزانيات على مستوى الفريق أو الشركة، وتتبّع العائد على الاستثمار (ROI) لكل نموذج، ونقاط نهاية (endpoints) مستضافة في الولايات المتحدة، وعدم الاحتفاظ بالبيانات إطلاقًا (zero data retention)، وتغطية عبر 20 مركز بيانات عالميًا.
  • FireConnect — تثبيت بسطر واحد بموجب ترخيص Apache 2.0؛ يقوم بمطابقة فتحات (slots) النماذج في الـ harness مع نماذج Fireworks. وتستمر Claude Code وCodex وOpenCode في العمل دون أي تغيير عبر واجهات برمجية متوافقة مع Anthropic وOpenAI.
  • التوجيه الذكي — يقيّم نموذج مُدرَّب مدى تعقيد كل طلب: تذهب المهام الروتينية إلى نموذج open-weight رخيص، بينما تذهب المهام المعقدة إلى مزوّدكم السابق باستخدام مفتاحكم الخاص (الذي، بحسب Fireworks، لا يُخزَّن على الخادم).

لا يزال الموجِّه (router) في مرحلة research preview. وهو حاليًا يوجّه بين Claude Opus 5 وGLM-5.2، لذا يتطلّب مسار pass-through مفتاح Anthropic؛ أما الإعداد المفتوح بالكامل فيوجّه بين Kimi K3 وGLM-5.2.

إلى أي مدى هذا أرخص؟

تبيّن أن الوفورات في الاختبارات المستقلة كانت ملحوظة ولا تُفسَّر بالتخزين المؤقت (caching) وحده. فقد شغّلت Faros AI 211 مهمة هندسية حقيقية من 12 مستودعًا عبر سبعة مسارات من نوع "نموذج+harness". وحصلت Claude Code على GLM-5.2 على 0.568 وفق مقياس النموذج-الحكَم، مقابل 0.521 لـ Claude Code على Opus 4.8 — بتكلفة 0.92 دولار مقابل 1.76 دولار لكل مهمة. وبلغت نسبة إصابة التخزين المؤقت 89.7% و99.7% على التوالي.

"هذه المجموعة خاصة بشركة معينة وليست لوحة ترتيب عالمية"، تحذّر

Faros AI بناءً على نتائج قياسها.

وشملت دراسة ثانية أجرتها Arize بالتعاون مع Fireworks 10 نماذج على 40 مهمة من Terminal-Bench بواقع ست عمليات تشغيل لكل مهمة — أي 2400 عملية تشغيل و626 دولارًا من إنفاق واجهة برمجة التطبيقات (API). ففي المهام السهلة، لا تُظهر نماذج الطليعة أي ميزة: اجتاز Kimi K2.6 نسبة 73%، وGPT-5.5 نسبة 69%. أما في المهام الصعبة فتتصدّر النماذج الأعلى مستوى: GPT-5.5 بنسبة 51%، وKimi K3 بنسبة 32%. وتفوّق التوجيه المحاكى على أي استراتيجية أحادية النموذج: فقد كلّف سلّم التصعيد (escalation ladder) 0.525 دولار لكل مهمة ناجحة، وحلّ باستمرار 32.3 من أصل 40 مهمة، في حين كلّف GPT-5.5 وحده 0.636 دولار وحلّ 25 من أصل 40.

ماذا يعني هذا

تحوّل Fireworks Nexus اختيار النموذج إلى معيار قابل للإدارة: تذهب المهام الروتينية إلى محرّكات open-weight رخيصة، بينما تُحجَز نماذج الطليعة الباهظة للمهام المعقدة حقًا. والأرقام صادرة عن المزوّد ومن برنامجه التجريبي (preview)، لكن عمليات التشغيل المستقلة من Faros AI وArize تدعم الفكرة الأساسية: في جزء من المهام، لا يشتري دفع مبالغ إضافية مقابل نموذج من الطراز الأول جودة أفضل.

الأسئلة الشائعة

هل تعمل Fireworks Nexus مع Claude Code؟

نعم. يُثبَّت مكوّن FireConnect بأمر واحد من لوحة تحكم Fireworks، ويقوم بمطابقة فتحات النماذج، بحيث تستمر Claude Code وCodex وOpenCode في العمل دون أي تغيير عبر واجهات برمجية متوافقة مع Anthropic وOpenAI.

إلى أي مدى تخفض Fireworks Nexus الإنفاق؟

بحسب Fireworks، يبلغ الانخفاض المعتاد 3–5 مرات. وفي الاختبارات التي أُجريت مع فريقَي Notion وDoximity، انخفضت تكلفة كل طلب سحب (pull request) مدمَج بنحو الثلث، وبلغ متوسط سعر الرمز (token) نحو ربع سعره لدى مختبرات النماذج المغلقة.

ZK
Hamidun News
أخبار الذكاء الاصطناعي بدون ضوضاء. اختيار تحريري يومي من أكثر من 50 مصدر. منتج من جمال حميدون، رئيس الذكاء الاصطناعي في Alpina Digital.

هل تريد التوقف عن قراءة الذكاء الاصطناعي والبدء باستخدامه؟

AI News هو موجز منسق لأخبار الذكاء الاصطناعي. تعلمك Hamidun Academy استخدام الذكاء الاصطناعي في عملك.

ما رأيك؟
جارٍ تحميل التعليقات…