The Decoder→ المصدر

Cursor: дешёвые модели пишут код по плану frontier-моделей — стоимость упала в 15 раз

Cursor устроил экзамен рою из ИИ-агентов: перестроить СУБД SQLite на Rust по одной документации, без исходников и интернета. Новая система разделила роли — топовая модель (Opus 4.8, GPT-5.5) планирует, дешёвая Composer пишет код. Итог: все конфигурации дошли до 100% тестов, а стоимость упала с $10 565 у одиночного агента до $1339 — в 15 раз.

معالج بواسطة الذكاء الاصطناعي من The Decoder؛ بتحرير Hamidun News
Cursor: дешёвые модели пишут код по плану frontier-моделей — стоимость упала в 15 раз
المصدر: The Decoder. كولاج: Hamidun News.
◐ استمع للمقال

في يوليو 2026، أجرت Cursor تجربة: كلّفت سرباً من وكلاء الذكاء الاصطناعي بإعادة كتابة قاعدة البيانات SQLite من الصفر بلغة Rust، معتمدةً فقط على التوثيق — دون شيفرة مصدرية، ودون وصول إلى الإنترنت، ودون اختبارات جاهزة. النسخة الجديدة من "السرب" (agent swarm)، التي تفصل بين نموذج المخطِّط ونماذج التنفيذ، نجحت في النهاية في اجتياز 100% من مجموعة الاختبارات في جميع التكوينات، وكان الحل الأرخص أرخص بـ15 مرة من وكيل واحد من الفئة العليا.

ما الذي اختبرته Cursor بالضبط

أعطت Cursor الوكلاء مهمة واحدة — إعادة إنشاء SQLite بلغة Rust من الصفر، بالاعتماد فقط على التوثيق الرسمي. وتم فحص النتيجة النهائية باستخدام معيار sqllogictest الذي يحتوي على ملايين استعلامات SQL؛ وبحسب Cursor، وصل كل تكوين من تكوينات النظام الجديد في النهاية إلى نسبة اجتياز اختبارات بلغت 100%، بينما ظل "السرب" القديم عالقاً في نطاق يتراوح بين 11 و77%.

الفكرة الأساسية للبنية الجديدة هي فصل الأدوار. يعمل نموذج frontier المكلف كمخطِّط: يقسّم المهمة ويتخذ القرارات المعمارية. أما الجزء الأكبر من الكود الروتيني فتكتبه نماذج worker الرخيصة.

  • المهمة: إعادة كتابة SQLite بلغة Rust بالاعتماد على التوثيق فقط، دون شيفرة مصدرية ودون إنترنت
  • المخطِّطون: GPT-5.5، Grok 4.5، Opus 4.8، Fable 5
  • المنفِّذ: Composer 2.5 (وقد تم تشغيله أيضاً كوكيل منفرد للمقارنة)
  • التحقق: معيار sqllogictest، ملايين استعلامات SQL
  • النظام الجديد بعد 4 ساعات: 73–85% في البداية، ووصل الجميع إلى 100%؛ النظام القديم: 11–77%

لماذا يزيل المخطِّط الفوضى

يُحرّر فصل الأدوار السرب من تعارضات الدمج (merge) التي كان يخلقها لنفسه سابقاً. ففي التكوين مع Grok 4.5، أنتج النظام القديم خلال ساعتين 68,000 عملية commit وأكثر من 70,000 تعارض دمج — وغرق فيها. أما السرب الجديد فقد حافظ على وتيرة بلغت نحو 1,000 عملية commit في الثانية، ومع ذلك لم يتجاوز أبداً 1,000 تعارض متزامن.

ويظهر الفرق أيضاً في حجم الكود مع جودة متقاربة. اقتصر ثنائي "Fable 5 يخطِّط + Composer يكتب" على 9,908 أسطر مقابل 64,305 سطراً في النهج القديم. أما ثنائي "Opus 4.8 + Composer" فبلغ 4,645 سطراً مقابل 19,013. وكود أقل يعني أخطاء أقل وصيانة أرخص.

كم تم توفيره

اختلفت تكلفة عمليات التشغيل بمقدار 15 مرة عند نتيجة متقاربة: من 1,339 دولاراً لثنائي "Opus 4.8 + Composer" إلى 10,565 دولاراً لنموذج GPT-5.5 منفرداً. وبحسب Cursor، استهلكت نماذج worker ما بين 69% و90%+ من إجمالي الرموز (tokens)، لكن بسبب فارق الأسعار كانت حصتها من الفاتورة النهائية أكثر تواضعاً بكثير — إذ يتوجب دفع المبالغ الكبيرة أساساً مقابل التخطيط.

يتولى نموذج frontier عملية التفكيك والقرارات الأساسية، بينما تنفّذ نماذج worker الأرخص الخطة بكفاءة بمجرد إزالة الغموض — هذه هي الخلاصة الرئيسية التي توصل إليها فريق

Cursor بعد التجربة.

ماذا يعني هذا

اقتصاد البرمجة بالذكاء الاصطناعي يتغيّر: الدفع مقابل نموذج من الفئة العليا له معنى في مرحلة التخطيط، في حين يمكن إسناد التنفيذ الفعلي إلى منفِّذين رخيصين مع خسارة تكاد تكون معدومة في الجودة. وبالنسبة للفرق، يعني هذا انخفاضاً كبيراً في تكاليف توليد الكود المستقل — شريطة أن يتولى شخص ذكي تقسيم المهمة بالشكل الصحيح.

أسئلة شائعة

ما هو agent swarm في Cursor؟

agent swarm هو سرب من عدد كبير من وكلاء الذكاء الاصطناعي يعملون بالتوازي على المهمة نفسها. وفي النسخة الجديدة، قسّمتهم Cursor إلى مخطِّط (نموذج واحد مكلف) ومنفِّذين (عدد كبير من النماذج الرخيصة)، ما أزال تعارضات الدمج الجماعية.

ما النماذج التي خطّطت، وما التي كتبت الكود؟

كانت النماذج المخطِّطة هي GPT-5.5 وGrok 4.5 وOpus 4.8 وFable 5. أما الكود فكتبه نموذج Composer 2.5 — الذي تم اختباره أيضاً منفرداً للمقارنة.

إلى أي مدى أصبح الكود أرخص؟

بلغ التفاوت 15 مرة: من 1,339 دولاراً لثنائي Opus 4.8 + Composer إلى 10,565 دولاراً لنموذج GPT-5.5 منفرداً، مع جودة نتيجة متقاربة.

ZK
Hamidun News
أخبار الذكاء الاصطناعي بدون ضوضاء. اختيار تحريري يومي من أكثر من 50 مصدر. منتج من جمال حميدون، رئيس الذكاء الاصطناعي في Alpina Digital.

هل تحتاج إلى ذكاء اصطناعي يعمل داخل شركتك — وليس فقط في موجز الأخبار؟

أبني ذكاءً اصطناعياً جاهزاً للإنتاج للشركات — أنظمة CRM مخصّصة، أدوات داخلية، وكلاء مستقلون، أتمتة سير العمل. ملك لك، مصمّم وفق عمليتك، دون رسوم لكل مستخدم. من إعداد جمال خميدون، مدير المنتجات في AlpinaGPT (منصة ذكاء اصطناعي، أكثر من 6000 مستخدم).

ما رأيك؟
جارٍ تحميل التعليقات…