The Decoder→ оригинал

Cursor: дешёвые модели пишут код по плану frontier-моделей — стоимость упала в 15 раз

Cursor устроил экзамен рою из ИИ-агентов: перестроить СУБД SQLite на Rust по одной документации, без исходников и интернета. Новая система разделила роли — топовая модель (Opus 4.8, GPT-5.5) планирует, дешёвая Composer пишет код. Итог: все конфигурации дошли до 100% тестов, а стоимость упала с $10 565 у одиночного агента до $1339 — в 15 раз.

AI-обработка оригинала The Decoder; редакция Hamidun News
Cursor: дешёвые модели пишут код по плану frontier-моделей — стоимость упала в 15 раз
Источник: The Decoder. Коллаж: Hamidun News.
◐ Слушать статью

Cursor в июле 2026 года провёл эксперимент: заставил рой ИИ-агентов заново написать СУБД SQLite на языке Rust, имея только документацию — без исходного кода, доступа в интернет и готовых тестов. Новая версия «роя» (agent swarm), которая разделяет модель-планировщик и модели-исполнители, во всех конфигурациях в итоге прошла 100% тестового набора, а самое дешёвое решение обошлось в 15 раз дешевле одиночного топового агента.

Что именно тестировал Cursor

Cursor дал агентам одну задачу — воссоздать SQLite на Rust с нуля, ориентируясь только на официальную документацию. Готовый результат проверяли на бенчмарке sqllogictest с миллионами SQL-запросов; по данным Cursor, каждая конфигурация новой системы в итоге вышла на 100% прохождения тестов, тогда как старый «рой» застревал в диапазоне 11–77%.

Ключевая идея новой архитектуры — разделить роли. Дорогая frontier-модель работает планировщиком: разбивает задачу и принимает архитектурные решения. Основную массу рутинного кода пишут дешёвые worker-модели.

  • Задача — переписать SQLite на Rust только по документации, без исходников и интернета
  • Планировщики: GPT-5.5, Grok 4.5, Opus 4.8, Fable 5
  • Исполнитель: Composer 2.5 (её же гоняли как одиночного агента для сравнения)
  • Проверка — бенчмарк sqllogictest, миллионы SQL-запросов
  • Новая система через 4 часа: 73–85% на старте, все дошли до 100%; старая — 11–77%

Почему планировщик убирает хаос

Разделение ролей избавляет рой от merge-конфликтов, которые он раньше создавал сам себе. На конфигурации с Grok 4.5 старая система за два часа наделала 68 000 коммитов и больше 70 000 конфликтов слияния — и захлебнулась в них. Новый рой держал темп около 1000 коммитов в секунду и при этом ни разу не превысил 1000 одновременных конфликтов.

Разница видна и в объёме кода при сопоставимом качестве. Связка «Fable 5 планирует + Composer пишет» уложилась в 9908 строк против 64 305 у старого подхода. Пара «Opus 4.8 + Composer» — 4645 строк против 19 013. Меньше кода — меньше багов и дешевле поддержка.

Сколько удалось сэкономить

Стоимость прогонов различалась в 15 раз при сопоставимом результате: от $1339 за связку «Opus 4.8 + Composer» до $10 565 за одиночный GPT-5.5. По данным Cursor, worker-модели съедали 69–90%+ всех токенов, но из-за разницы в ценах их вклад в итоговый счёт был куда скромнее — платить дорого приходится в основном за планирование.

Frontier-модель берёт на себя декомпозицию и ключевые решения, а более дешёвые worker-модели эффективно исполняют план, как только снята неоднозначность, — таков главный вывод команды

Cursor по итогам эксперимента.

Что это значит

Экономика ИИ-кодинга смещается: платить за топовую модель имеет смысл на этапе планирования, а саму реализацию можно отдать дешёвым исполнителям почти без потери качества. Для команд это означает кратное снижение расходов на автономную генерацию кода — при условии, что кто-то умный правильно нарежет задачу.

Частые вопросы

Что такое agent swarm в Cursor?

Agent swarm — это рой из множества ИИ-агентов, которые параллельно работают над одной задачей. В новой версии Cursor разделил их на планировщика (одна дорогая модель) и исполнителей (много дешёвых), что убрало массовые конфликты слияния.

Какие модели планировали, а какие писали код?

Планировщиками выступали GPT-5.5, Grok 4.5, Opus 4.8 и Fable 5. Код писала модель Composer 2.5 — её же тестировали в одиночку для сравнения.

Насколько дешевле обошёлся код?

Разброс составил 15 раз: от $1339 за связку Opus 4.8 + Composer до $10 565 за одиночный GPT-5.5, при сопоставимом качестве результата.

ЖХ
Hamidun News
AI‑новости без шума. Ежедневный редакторский отбор из 50+ источников. Продукт Жемала Хамидуна, Head of AI в Alpina Digital.

Хотите не читать про ИИ, а внедрить его?

«AI News» — это полезные новости из мира ИИ. Системно научиться работать с нейросетями и применять их в работе — в Hamidun Academy.

Что вы думаете?
Загружаем комментарии…