Claude Fable 5 vs GPT-5.5 Pro: Comparación en 12 Tareas a través del Agregador BotHub
Habr publicó una comparación de Claude Fable 5 de Anthropic y GPT-5.5 Pro de OpenAI en 12 tareas prácticas. Claude Fable 5 es el primer modelo de la nueva clase Mythos, que se clasifica por encima de Opus en la jerarquía de Anthropic, e Anthropic inesperadamente la devolvió al acceso abierto. Las pruebas se realizaron a través del agregador de API BotHub con seguimiento de costos en tokens para cada solución.
Procesado por IA desde Habr AI; editado por Hamidun News
Los autores del blog de Habr BotHub compararon dos modelos de lenguaje de primer nivel — Claude Fable 5 de Anthropic y GPT-5.5 Pro de OpenAI — en 12 tareas prácticas, probando ambos modelos a través de su propio agregador de API de redes neuronales.
Por qué se compara exactamente este par
En el artículo anterior, los autores ya habían comparado Claude Opus 4.8, GPT-5.5 y Gemini 3.1 Pro, pero aclararon inmediatamente: GPT-5.5 Pro no participó en esa ocasión porque era más correcto compararla contra Claude Fable 5 — pero en el momento de la publicación, Fable 5 no estaba disponible. La situación cambió cuando Anthropic inesperadamente devolvió Claude Fable 5 al acceso público.
- Claude Fable 5 — el primer modelo de la nueva clase Mythos, que ocupa un rango superior a Opus en la jerarquía de Anthropic
- Anthropic inesperadamente devolvió Fable 5 al acceso abierto
- La comparación se basa en 12 tareas prácticas y cotidianas, no en puntos de referencia formales
- Las pruebas se realizaron a través del agregador de API de BotHub, no a través de las interfaces web de los modelos
Cómo está estructurada la metodología de prueba
Los autores deliberadamente rechazaron puntos de referencia listos y afirmaciones de marketing de los fabricantes, apostando por tareas cotidianas reales. Las pruebas se realizaron a través del agregador de redes neuronales BotHub — funciona a través de API, lo que según los autores elimina los apoyos y soluciones que implícitamente ayudan a los modelos en sus interfaces web de marca. La metodología también permite ver inmediatamente cuánto cuesta cada tarea en dinero.
El costo se mide en la moneda interna de BotHub — CAPS, vinculada al número de tokens gastados. Típicamente, un rublo compra de 4000 a 6500 CAPS dependiendo del volumen de compra; en esta comparación, los autores utilizaron una tasa de aproximadamente 1 rublo = 6370 CAPS, ya que su plan cambió. Ambos modelos pertenecen al segmento premium, por lo que los precios finales para las tareas resultaron ser significativamente más altos que en la comparación anterior de Opus 4.8, GPT-5.5 y Gemini 3.1 Pro.
El ganador de cada tarea se determina principalmente de manera subjetiva, como antes, con los autores advirtiendo honestamente a los lectores sobre esto. Todos los materiales de prueba se han puesto en el dominio público, por lo que los lectores pueden formarse sus propias opiniones y elegir su favorito entre los modelos.
Lo que hace interesante este formato de comparación
La publicación abierta de todos los materiales de prueba es parte de la metodología: en lugar de simplemente declarar un ganador, dan a los lectores la oportunidad de evaluar las respuestas de ambos modelos a cada una de las 12 tareas por sí mismos y formar su propia opinión, incluso si difiere de las conclusiones de los autores. Este enfoque es especialmente valioso para el segmento premium de modelos como Claude Fable 5 y GPT-5.5 Pro, donde el costo de la solicitud en sí se convierte en parte de la decisión sobre la elección de un modelo — no solo la calidad de la respuesta, sino su precio en CAPS.
Lo que esto significa
El regreso de Claude Fable 5 al acceso público por primera vez permite una comparación directa del modelo de clase Mythos más importante de Anthropic con la versión GPT-5.5 Pro más importante de OpenAI en términos de API iguales, en lugar de a través de promesas de marketing de los fabricantes. Para los equipos que eligen un modelo para tareas específicas, tales comparaciones prácticas con contabilidad de costos de tokens transparente son más valiosas que los puntos de referencia formales, que los modelos premium típicamente pasan casi igualmente bien.
Preguntas frecuentes
¿Qué es la clase de modelos Mythos en Anthropic?
Mythos es una nueva clase de modelos de Anthropic que ocupa un rango superior a Opus en la jerarquía de la empresa. Claude Fable 5 es el primer modelo lanzado en esta clase.
¿Cómo calculó la comparación el costo de las solicitudes a los modelos?
El costo se midió en la moneda interna del agregador BotHub — CAPS, vinculada al número de tokens gastados. Típicamente, 1 rublo equivale a 4000-6500 CAPS dependiendo del volumen de compra; en esta prueba, se utilizó una tasa de aproximadamente 1 rublo = 6370 CAPS.
¿Necesitas IA funcionando dentro de tu empresa — no solo en tu feed de noticias?
Construyo IA en producción para empresas — CRM a medida, herramientas internas, agentes autónomos, automatización de procesos. Tuya, adaptada a tu proceso, sin coste por usuario. Creado por Zhemal Khamidun, CPO de AlpinaGPT (plataforma de IA, 6.000+ usuarios).
Lo esencial de la IA — una vez por semana
Siete historias que de verdad importaron, elegidas a mano. Sin ruido ni notas de prensa.
¡Listo! Revisa tu correo para la confirmación.