Habr AI→ original

Claude Fable 5 vs GPT-5.5 Pro: Comparação em 12 Tarefas via Agregador BotHub

Habr publicou uma comparação de Claude Fable 5 da Anthropic e GPT-5.5 Pro da OpenAI em 12 tarefas práticas. Claude Fable 5 é o primeiro modelo da nova classe Mythos, que se classifica acima de Opus na hierarquia da Anthropic, e Anthropic inesperadamente a devolveu ao acesso aberto. Os testes foram conduzidos através do agregador de API BotHub com rastreamento de custo em tokens para cada solução.

Processado por IA de Habr AI; editado por Hamidun News
Claude Fable 5 vs GPT-5.5 Pro: Comparação em 12 Tarefas via Agregador BotHub
Fonte: Habr AI. Colagem: Hamidun News.
◐ Ouvir artigo

Os autores do blog Habr BotHub compararam dois modelos de linguagem top — Claude Fable 5 da Anthropic e GPT-5.5 Pro da OpenAI — em 12 tarefas práticas, testando ambos os modelos através de seu próprio agregador de API de redes neurais.

Por que especificamente este par é comparado

No artigo anterior, os autores já haviam comparado Claude Opus 4.8, GPT-5.5 e Gemini 3.1 Pro, mas esclareceram imediatamente: GPT-5.5 Pro não participou naquela ocasião porque era mais correto compará-la contra Claude Fable 5 — mas no momento da publicação, Fable 5 não estava disponível. A situação mudou quando Anthropic inesperadamente devolveu Claude Fable 5 ao acesso público.

  • Claude Fable 5 — o primeiro modelo da nova classe Mythos, que ocupa um patamar acima de Opus na hierarquia da Anthropic
  • Anthropic inesperadamente devolveu Fable 5 ao acesso aberto
  • A comparação é baseada em 12 tarefas práticas e cotidianas, não em benchmarks formais
  • Os testes foram realizados através do agregador de API BotHub, não através das interfaces web dos modelos

Como a metodologia de teste é estruturada

Os autores deliberadamente recusaram benchmarks prontos e afirmações de marketing dos fabricantes, apostando em tarefas cotidianas reais. Os testes ocorreram através do agregador de redes neurais BotHub — funciona através de APIs, o que, de acordo com os autores, elimina as muletas e soluções alternativas que implicitamente ajudam os modelos em suas interfaces web de marca. A metodologia também permite ver imediatamente quanto cada tarefa custa em dinheiro.

O custo é medido na moeda interna do BotHub — CAPS, vinculada ao número de tokens gastos. Tipicamente, um rublo compra de 4000 a 6500 CAPS dependendo do volume de compra; nesta comparação, os autores usaram uma taxa de aproximadamente 1 rublo = 6370 CAPS, já que seu plano mudou. Ambos os modelos pertencem ao segmento premium, então os preços finais para as tarefas acabaram sendo significativamente mais altos do que na comparação anterior de Opus 4.8, GPT-5.5 e Gemini 3.1 Pro.

O vencedor de cada tarefa é determinado principalmente de forma subjetiva, como antes, com os autores avisando honestamente aos leitores sobre isso. Todos os materiais de teste foram lançados em domínio público, para que os leitores possam formar suas próprias opiniões e escolher seu favorito entre os modelos.

O que torna este formato de comparação interessante

A publicação aberta de todos os materiais de teste é parte da metodologia: em vez de simplesmente declarar um vencedor, eles dão aos leitores a oportunidade de avaliar as respostas de ambos os modelos para cada uma das 12 tarefas e formar suas próprias opiniões, mesmo que divirjam das conclusões dos autores. Esta abordagem é especialmente valiosa para o segmento premium de modelos como Claude Fable 5 e GPT-5.5 Pro, onde o custo da solicitação em si se torna parte da decisão sobre a escolha de um modelo — não apenas a qualidade da resposta, mas seu preço em CAPS.

O que isso significa

O retorno de Claude Fable 5 ao acesso público permite pela primeira vez uma comparação direta do modelo de classe Mythos superior da Anthropic com a versão GPT-5.5 Pro superior da OpenAI em termos de API iguais, em vez de através de promessas de marketing dos fabricantes. Para equipes que escolhem um modelo para tarefas específicas, tais comparações práticas com contabilidade transparente de custos de tokens são mais valiosas do que benchmarks formais, que os modelos premium geralmente passam quase igualmente bem.

Perguntas Frequentes

O que é a classe de modelos Mythos na Anthropic?

Mythos é uma nova classe de modelos da Anthropic que ocupa um patamar acima de Opus na hierarquia da empresa. Claude Fable 5 é o primeiro modelo lançado nesta classe.

Como a comparação calculou o custo das solicitações aos modelos?

O custo foi medido na moeda interna do agregador BotHub — CAPS, vinculada ao número de tokens gastos. Tipicamente, 1 rublo equivale a 4000-6500 CAPS dependendo do volume de compra; neste teste, foi utilizada uma taxa de aproximadamente 1 rublo = 6370 CAPS.

ZK
Hamidun News
Notícias de AI sem ruído. Seleção editorial diária de mais de 50 fontes. Produto de Zhemal Khamidun, Head of AI na Alpina Digital.

Precisa de IA funcionando dentro da sua empresa — não só no feed de notícias?

Eu construo IA em produção para empresas — CRM sob medida, ferramentas internas, agentes autônomos, automação de processos. Pertence a você, moldada ao seu processo, sem taxa por usuário. Feito por Zhemal Khamidun, CPO da AlpinaGPT (plataforma de IA, 6.000+ usuários).

O que você acha?
Carregando comentários…