Habr AI→ оригинал

Claude Fable 5 против GPT-5.5 Pro: сравнение по 12 задачам через агрегатор BotHub

На Habr вышло сравнение Claude Fable 5 от Anthropic и GPT-5.5 Pro от OpenAI по 12 практическим задачам. Claude Fable 5 — первая модель нового класса Mythos, который в иерархии Anthropic стоит выше Opus, и Anthropic неожиданно вернула её в открытый доступ. Тестирование прошло через API-агрегатор BotHub с подсчётом стоимости каждого решения в токенах.

AI-обработка оригинала Habr AI; редакция Hamidun News
Claude Fable 5 против GPT-5.5 Pro: сравнение по 12 задачам через агрегатор BotHub
Источник: Habr AI. Коллаж: Hamidun News.
◐ Слушать статью

Авторы Habr-блога BotHub сравнили две топовые языковые модели — Claude Fable 5 от Anthropic и GPT-5.5 Pro от OpenAI — по 12 практическим задачам, протестировав обе модели через собственный API-агрегатор нейросетей.

Почему сравнивают именно эту пару

В предыдущей статье авторы уже сравнивали Claude Opus 4.8, GPT-5.5 и Gemini 3.1 Pro, но сразу оговорились: GPT-5.5 Pro в тот раз не участвовала, потому что её корректнее ставить против Claude Fable 5 — а та на момент публикации была недоступна. Ситуация изменилась, когда Anthropic неожиданно вернула Claude Fable 5 в общий доступ.

  • Claude Fable 5 — первая модель нового класса Mythos, который в иерархии Anthropic стоит выше Opus
  • Anthropic неожиданно вернула Fable 5 в открытый доступ
  • Сравнение построено на 12 практических, будничных задачах, а не на формальных бенчмарках
  • Тестирование проведено через API-агрегатор BotHub, а не через веб-интерфейсы моделей

Как устроена методика тестирования

Авторы принципиально отказались от готовых бенчмарков и маркетинговых заявлений производителей, сделав ставку на реальные будничные задачи. Тестирование прошло через агрегатор нейросетей BotHub — он работает по API, что, по словам авторов, избавляет сравнение от подпорок и костылей, которые неявно помогают моделям в их фирменных веб-интерфейсах. Заодно методика позволяет сразу видеть, во сколько обходится решение каждой задачи в деньгах.

Стоимость измеряется во внутренней валюте BotHub — CAPS, привязанной к числу потраченных токенов. Обычно за один рубль можно купить от 4000 до 6500 CAPS в зависимости от объёма покупки; в этом сравнении авторы использовали курс около 1 рубль = 6370 CAPS, поскольку у них сменился тариф. Обе модели относятся к премиальному сегменту, поэтому итоговые ценники по задачам оказались заметно выше, чем в прошлом сравнении Opus 4.8, GPT-5.5 и Gemini 3.1 Pro.

Победителя по каждой задаче авторы, как и раньше, определяют преимущественно субъективно, честно предупреждая об этом читателей. Все материалы тестирования выложены в открытый доступ, так что читатели могут сформировать собственное мнение и выбрать своего фаворита среди моделей.

Чем интересен формат сравнения

Открытая публикация всех материалов тестирования — часть методики авторов: вместо того чтобы просто объявить победителя, они дают читателям возможность самим оценить ответы обеих моделей на каждую из 12 задач и сформировать собственное мнение, даже если оно разойдётся с выводами авторов статьи. Такой подход особенно ценен для премиального сегмента моделей вроде Claude Fable 5 и GPT-5.5 Pro, где сама стоимость запроса становится частью решения о выборе модели — не только качество ответа, но и его цена в CAPS.

Что это значит

Возвращение Claude Fable 5 в открытый доступ впервые позволяет напрямую сравнить топовую модель класса Mythos от Anthropic с топовой Pro-версией GPT-5.5 от OpenAI на равных условиях API, а не через маркетинговые обещания разработчиков. Для команд, выбирающих модель под конкретные задачи, такие практические сравнения с прозрачным подсчётом стоимости в токенах ценнее формальных бенчмарков, которые премиальные модели обычно проходят почти одинаково хорошо.

Частые вопросы

Что такое класс моделей Mythos у Anthropic?

Mythos — новый класс моделей Anthropic, который в иерархии компании стоит выше Opus. Claude Fable 5 — первая модель, выпущенная в этом классе.

Как в сравнении считали стоимость запросов к моделям?

Стоимость измеряли во внутренней валюте агрегатора BotHub — CAPS, привязанной к количеству потраченных токенов. Обычно 1 рубль равен 4000-6500 CAPS в зависимости от объёма покупки; в этом тесте использовался курс около 1 рубль = 6370 CAPS.

ЖХ
Hamidun News
AI‑новости без шума. Ежедневный редакторский отбор из 50+ источников. Продукт Жемала Хамидуна, Head of AI в Alpina Digital.

Хотите не читать про ИИ, а внедрить его?

«AI News» — это полезные новости из мира ИИ. Системно научиться работать с нейросетями и применять их в работе — в Hamidun Academy.

Что вы думаете?
Загружаем комментарии…