OpenAI выпустила флагманскую модель GPT-5.6 в трёх версиях — Luna, Terra и Sol
OpenAI выпустила семейство GPT-5.6 из трёх моделей — Luna, Terra и Sol — с ценами от $1 до $30 за 1M токенов. На бенчмарке Agents' Last Exam старшая Sol обошла Claude Fable 5 на 13,1 балла, но на SWE-Bench Pro проиграла ей — 64,6% против 80%. OpenAI заявила, что почти треть заданий SWE-Bench Pro считает некорректными.
AI-обработка оригинала Simon Willison; редакция Hamidun News
OpenAI 17 июля 2026 года выпустила в общий доступ флагманское семейство моделей GPT-5.6 сразу в трёх размерах — Luna, Terra и Sol, — а по собственному бенчмарку OpenAI старшая модель Sol обошла Claude Fable 5 от Anthropic на 13,1 балла в тесте на долгие агентные задачи Agents' Last Exam.
Сколько стоят новые модели
Цены заданы по модели «за 1 миллион токенов» отдельно на ввод и вывод, и три размера GPT-5.6 заметно отличаются по стоимости.
- Luna (младшая модель) — $1 за 1M входных токенов / $6 за 1M выходных
- Terra (средняя модель) — $2,50 за 1M входных токенов / $15 за 1M выходных
- Sol (старшая модель) — $5 за 1M входных токенов / $30 за 1M выходных
- Для сравнения: линейка Claude Opus стоит $5/$25 за 1M токенов, а Claude Fable 5 — $10/$50
- Все три модели GPT-5.6 имеют точку отсечения знаний 16 февраля 2026 года, контекстное окно в 1 миллион токенов и лимит вывода в 128 000 токенов
Насколько GPT-5.6 обгоняет конкурентов
OpenAI опирается на бенчмарк Agents' Last Exam — тест долгих агентных рабочих процессов в 55 профессиональных областях. По заявлению компании, GPT-5.6 Sol набрал в этом тесте 53,6 балла — новый максимум, обойдя Claude Fable 5 (в режиме adaptive reasoning) на 13,1 балла. Даже в режиме среднего уровня рассуждений (medium reasoning) Sol опережает Fable 5 на 11,4 балла при затратах примерно в четыре раза ниже. Младшие модели, Terra и Luna, по утверждению OpenAI, обходят Fable 5 при расходах примерно в 16 раз ниже.
Однако на другом популярном бенчмарке — SWE-Bench Pro, тесте на решение реальных инженерных задач, — Claude Fable 5 набрал 80%, тогда как GPT-5.6 Sol — только 64,6%. Возможно, поэтому накануне запуска OpenAI опубликовала отдельную статью, в которой заявила, что порядка 30% заданий в SWE-bench Pro считает некорректными (broken), и призвала других разработчиков моделей внимательнее проверять результаты на этом бенчмарке.
Что говорят первые тесты
Автор блога, у которого был ранний доступ к GPT-5.6 Sol, описывает модель как «определённо очень компетентную», но отмечает, что на сложных задачах написания кода, с которыми он работает, модель пока не показалась ему лучше Claude Fable 5 от Anthropic. По его словам, наиболее интересные детали содержатся в официальном гайде OpenAI по использованию GPT-5.6 — там описан ряд новых возможностей API, которые ещё предстоит изучить разработчикам сторонних инструментов.
Что это значит
Запуск GPT-5.6 в трёх версиях продолжает гонку между OpenAI и Anthropic за лидерство в агентных задачах — тех, где модель самостоятельно выполняет длинные цепочки действий, а не просто отвечает на разовый запрос. При этом сравнение по разным бенчмаркам даёт противоречивую картину: OpenAI выигрывает на своём собственном тесте агентных workflow, но проигрывает на SWE-Bench Pro — притом что сама OpenAI публично поставила под сомнение качество трети заданий этого бенчмарка. Для разработчиков это сигнал: выбор модели стоит проверять на собственных задачах, а не полагаться на один усреднённый рейтинг.
Частые вопросы
Сколько стоит GPT-5.6 Sol?
Старшая модель GPT-5.6 Sol стоит $5 за 1 миллион входных токенов и $30 за 1 миллион выходных токенов — это дороже, чем Luna ($1/$6) и Terra ($2,50/$15), но дешевле, чем Claude Fable 5 ($10/$50).
Чем GPT-5.6 отличается от Claude Fable 5 по возможностям?
На бенчмарке Agents' Last Exam GPT-5.6 Sol опережает Fable 5 на 13,1 балла (53,6 против результата Fable 5), но на SWE-Bench Pro Fable 5 набирает 80% против 64,6% у Sol — то есть превосходство зависит от типа задачи.
Какой контекст и лимиты у моделей GPT-5.6?
Все три модели — Luna, Terra и Sol — имеют контекстное окно в 1 миллион токенов, лимит вывода в 128 000 токенов и точку отсечения знаний 16 февраля 2026 года.
Хотите не читать про ИИ, а внедрить его?
«AI News» — это полезные новости из мира ИИ. Системно научиться работать с нейросетями и применять их в работе — в Hamidun Academy.
Главное из мира ИИ — раз в неделю
7 ключевых событий недели, отобранных вручную. Без шума, репостов и пресс-релизов.
Готово! Проверьте почту — мы отправили подтверждение.