Simon Willison→ оригинал

OpenAI выпустила флагманскую модель GPT-5.6 в трёх версиях — Luna, Terra и Sol

OpenAI выпустила семейство GPT-5.6 из трёх моделей — Luna, Terra и Sol — с ценами от $1 до $30 за 1M токенов. На бенчмарке Agents' Last Exam старшая Sol обошла Claude Fable 5 на 13,1 балла, но на SWE-Bench Pro проиграла ей — 64,6% против 80%. OpenAI заявила, что почти треть заданий SWE-Bench Pro считает некорректными.

AI-обработка оригинала Simon Willison; редакция Hamidun News
OpenAI выпустила флагманскую модель GPT-5.6 в трёх версиях — Luna, Terra и Sol
Источник: Simon Willison. Коллаж: Hamidun News.
◐ Слушать статью

OpenAI 17 июля 2026 года выпустила в общий доступ флагманское семейство моделей GPT-5.6 сразу в трёх размерах — Luna, Terra и Sol, — а по собственному бенчмарку OpenAI старшая модель Sol обошла Claude Fable 5 от Anthropic на 13,1 балла в тесте на долгие агентные задачи Agents' Last Exam.

Сколько стоят новые модели

Цены заданы по модели «за 1 миллион токенов» отдельно на ввод и вывод, и три размера GPT-5.6 заметно отличаются по стоимости.

  • Luna (младшая модель) — $1 за 1M входных токенов / $6 за 1M выходных
  • Terra (средняя модель) — $2,50 за 1M входных токенов / $15 за 1M выходных
  • Sol (старшая модель) — $5 за 1M входных токенов / $30 за 1M выходных
  • Для сравнения: линейка Claude Opus стоит $5/$25 за 1M токенов, а Claude Fable 5 — $10/$50
  • Все три модели GPT-5.6 имеют точку отсечения знаний 16 февраля 2026 года, контекстное окно в 1 миллион токенов и лимит вывода в 128 000 токенов

Насколько GPT-5.6 обгоняет конкурентов

OpenAI опирается на бенчмарк Agents' Last Exam — тест долгих агентных рабочих процессов в 55 профессиональных областях. По заявлению компании, GPT-5.6 Sol набрал в этом тесте 53,6 балла — новый максимум, обойдя Claude Fable 5 (в режиме adaptive reasoning) на 13,1 балла. Даже в режиме среднего уровня рассуждений (medium reasoning) Sol опережает Fable 5 на 11,4 балла при затратах примерно в четыре раза ниже. Младшие модели, Terra и Luna, по утверждению OpenAI, обходят Fable 5 при расходах примерно в 16 раз ниже.

Однако на другом популярном бенчмарке — SWE-Bench Pro, тесте на решение реальных инженерных задач, — Claude Fable 5 набрал 80%, тогда как GPT-5.6 Sol — только 64,6%. Возможно, поэтому накануне запуска OpenAI опубликовала отдельную статью, в которой заявила, что порядка 30% заданий в SWE-bench Pro считает некорректными (broken), и призвала других разработчиков моделей внимательнее проверять результаты на этом бенчмарке.

Что говорят первые тесты

Автор блога, у которого был ранний доступ к GPT-5.6 Sol, описывает модель как «определённо очень компетентную», но отмечает, что на сложных задачах написания кода, с которыми он работает, модель пока не показалась ему лучше Claude Fable 5 от Anthropic. По его словам, наиболее интересные детали содержатся в официальном гайде OpenAI по использованию GPT-5.6 — там описан ряд новых возможностей API, которые ещё предстоит изучить разработчикам сторонних инструментов.

Что это значит

Запуск GPT-5.6 в трёх версиях продолжает гонку между OpenAI и Anthropic за лидерство в агентных задачах — тех, где модель самостоятельно выполняет длинные цепочки действий, а не просто отвечает на разовый запрос. При этом сравнение по разным бенчмаркам даёт противоречивую картину: OpenAI выигрывает на своём собственном тесте агентных workflow, но проигрывает на SWE-Bench Pro — притом что сама OpenAI публично поставила под сомнение качество трети заданий этого бенчмарка. Для разработчиков это сигнал: выбор модели стоит проверять на собственных задачах, а не полагаться на один усреднённый рейтинг.

Частые вопросы

Сколько стоит GPT-5.6 Sol?

Старшая модель GPT-5.6 Sol стоит $5 за 1 миллион входных токенов и $30 за 1 миллион выходных токенов — это дороже, чем Luna ($1/$6) и Terra ($2,50/$15), но дешевле, чем Claude Fable 5 ($10/$50).

Чем GPT-5.6 отличается от Claude Fable 5 по возможностям?

На бенчмарке Agents' Last Exam GPT-5.6 Sol опережает Fable 5 на 13,1 балла (53,6 против результата Fable 5), но на SWE-Bench Pro Fable 5 набирает 80% против 64,6% у Sol — то есть превосходство зависит от типа задачи.

Какой контекст и лимиты у моделей GPT-5.6?

Все три модели — Luna, Terra и Sol — имеют контекстное окно в 1 миллион токенов, лимит вывода в 128 000 токенов и точку отсечения знаний 16 февраля 2026 года.

ЖХ
Hamidun News
AI‑новости без шума. Ежедневный редакторский отбор из 50+ источников. Продукт Жемала Хамидуна, Head of AI в Alpina Digital.

Хотите не читать про ИИ, а внедрить его?

«AI News» — это полезные новости из мира ИИ. Системно научиться работать с нейросетями и применять их в работе — в Hamidun Academy.

Что вы думаете?
Загружаем комментарии…