Modelos · · 9 min de lectura

Anthropic lanza Claude Opus 5.5: rendimiento Fable 5.1 a un 40% menos de coste

Anthropic presenta Claude Opus 5.5 tras 'pacing the frontier': rinde como Fable 5.1 pero cuesta un 40% menos que Opus 5, con $4/$20 por millón de tokens y salvaguardas de clase Fable.

Comparte: Compartir en LinkedIn Publicar en X

Anthropic ha presentado hoy Claude Opus 5.5, el primer modelo de su nueva familia 5.5, y el anuncio apunta directamente a la economía de los agentes en producción: promete rendimiento equivalente a Claude Fable 5.1 en la mayoría de tareas con un coste de ejecución un 40% menor que Opus 5.

TL;DR: Claude Opus 5.5 es el nuevo modelo de frontera de Anthropic: según el fabricante rinde como Fable 5.1 pero cuesta un 40% menos que Opus 5 en workloads típicos. Baja a $4/$20 el millón de tokens (entrada/salida), lidera los benchmarks de agentic coding y computer use de Anthropic, y se distribuye por API en Claude Platform, AWS Bedrock, Google Cloud Vertex y Azure. Sin pesos abiertos, sin posibilidad de desactivar el thinking, y con un clasificador de seguridad que filtra cada acción antes de ejecutarla.

Fuentes: el anuncio oficial de Anthropic del 22 de septiembre de 2026 y la cobertura de MarkTechPost. Como siempre con lanzamientos de este tipo, los números son los del fabricante hasta que haya evaluaciones independientes.

Qué es Claude Opus 5.5

Es el primer modelo de la familia 5.5 de Anthropic, con ID claude-opus-5-5 (en OpenRouter, anthropic/claude-opus-5.5). Cerrado y solo por API: Anthropic no libera los pesos, así que no hay opción de autohospedaje. Ventana de contexto de 1 millón de tokens y salida de hasta 128K.

Dos decisiones de diseño relevantes para quien lo vaya a usar en producción:

  • El thinking no se puede desactivar. Es un cambio respecto a versiones anteriores y afecta a la latencia y al coste por tarea.
  • Las salidas llevan watermarking para cumplimiento del EU AI Act.

Rendimiento: nivel Fable 5.1 a un 40% menos de coste

La afirmación central de Anthropic es que Opus 5.5 rinde al nivel de Fable 5.1 en la mayoría del trabajo pero con un coste de ejecución un 40% menor que Opus 5 en workloads típicos con la configuración por defecto.

En los benchmarks publicados por Anthropic (con adaptive thinking a máximo esfuerzo y salvaguardas de producción activadas; Terminal-Bench 4.0 reportado a esfuerzo xhigh y GPT-6 Astra a high según OpenAI):

Benchmark Opus 5.5 Fable 5.1 Opus 5 GPT-6 Astra GPT-5.6 Sol
Terminal-Bench 4.0 66.4% 55.8% 52.3% 57.9% 37.3%
FrontierCode v1.1 54.4% 50.3% 48.0% 53.3% 47.5%
CursorBench 4.0 57.8% 51.8% 46.6% 41.7%
GDPval-AA v2.1 (Elo) 1846 1735 1708 1542 1588
OSWorld 2.0 81.8% 80.7% 74.0%
Terminal-Bench-Science 0.1 58.7% 52.6% 29.0% 64.6% 22.4%
AutomationBench 40.0% 31.4% 26.9% 41.4% 28.8%
Humanity's Last Exam (con tools) 67.7% 65.6% 63.6% 57.2%
Chartography (gráficos, con tools) 89.0% 88.4% 83.4%

Matiz importante: GPT-6 Astra sigue ganando en Terminal-Bench-Science y AutomationBench. Y el propio Anthropic avisa de que las diferencias de benchmark son cada vez una guía menos fiable: su brecha respecto a Fable 5.1 es más estrecha de lo que sugieren las puntuaciones.

Lo interesante para el coste por tarea es el modo medio (por defecto): ahí Opus 5.5 marca 54.6% en FrontierCode, superando el máximo de GPT-6 Astra (53.3%) a aproximadamente una quinta parte del coste, y 52.5% en CursorBench, once puntos por encima de GPT-5.6 Sol a un tercio del coste.

Precios y velocidad

Por millón de tokens:

Opus 5.5 Opus 5
Entrada $4 $5
Salida $20 $25
Lecturas de caché $0.20 $0.50
Escrituras de caché $5 $6.25

La lectura de caché baja un 60%. Sumado a que el modelo usa menos tokens por tarea, es lo que permite la reducción del 40%. Además, genera salida más de un 30% más rápido que Opus 5. Claude Code y Claude Platform añaden un modo rápido: hasta 2.5x de velocidad a $8 de entrada y $40 de salida por millón.

Anthropic también sube los límites de uso de cinco horas en los planes Pro, Max, Team y Enterprise.

Qué importa para equipos de agentes IA

Los primeros informes de testers (recogidos en el anuncio de Anthropic) apuntan a casos de uso de agentic coding:

  • Una migración de 680.000 líneas de código en menos de un día, trabajo que habría llevado semanas a un equipo de ingeniería.
  • Auditoría y corrección de una base de 200.000 líneas en menos de 3 horas, donde Opus 5 tardó más de 20 horas y usó 2.5x los tokens.
  • Un port interno de C a Rust de HAProxy: 9.5 horas frente a las 12 de Fable 5.1, con un 51% menos de coste.
  • Deloitte: con el esfuerzo más bajo, Opus 5.5 detectó el 72% de los bugs de revisión conocidos; Opus 5 a esfuerzo alto, el 56%, con menos falsas alarmas.
  • En investigación financiera: 16 de 18 informes de Opus 5.5 sobre una empresa con resultados difíciles de localizar superaron el control de calidad; ni Fable 5.1 ni Opus 5 lo lograron en ningún intento.

También hay un cambio de estilo notable: Opus 5.5 pone la información clave al principio, usa menos jerga y sigue mejor las reglas de escritura que se le dan, algo que los testers notaron en sesiones largas ("escribe como escribo yo").

Para los equipos que construyen pipelines de agentes autónomos con llamadas encadenadas, la economía cambia directamente: si el coste por decisión baja un 40% manteniendo el techo de calidad de Fable 5.1, el umbral de lo que es rentable automatizar baja con él. Las agencias de automatización con IA que diseñan estos sistemas tienen aquí un argumento más para revisar el modelo que usan en cada capa.

La disponibilidad es multicloud: Claude Platform, AWS Bedrock, Google Cloud Vertex AI y Microsoft Azure/Foundry. También con retención de datos cero, como en los Opus anteriores. Anthropic anuncia que Claude Sonnet 5.5 y Haiku 5.5 llegarán en las próximas semanas con mejoras similares.

Seguridad: el primer modelo Opus con salvaguardas de clase Fable

Anthropic sitúa el lanzamiento en el contexto de "pacing the frontier" de Dario Amodei y lo presenta como el primer modelo Opus que lanza con una clase de salvaguardas similar a Fable 5.1 en ciberseguridad, biología y destilación. Antes de publicarlo, el modelo pasó por evaluadores externos (METR y Frontier Design) y logró su mejor puntuación en la auditoría de comportamiento automatizada, con casi 2.000 escenarios.

Dos novedades de seguridad relevantes para empresas:

  • Clasificador por acción: Opus 5.5 tiene un clasificador que examina cada acción antes de ejecutarse, un sandbox open-source auditable y revisión de código que detecta vulnerabilidades antes del merge. Es lo que lo convierte, según Anthropic, en "el agente de código más seguro".
  • Contención: en una evaluación nueva diseñada para probar la propensión a cruzar límites, Opus 5.5 intentó eludirlos un 85% menos que Opus 5 o Claude Mythos 5.1.

En ciberseguridad, la mayoría de las tareas se redirigen a Opus 4.8 (el modelo puede identificar y arreglar bugs en el ciclo normal de desarrollo), y Anthropic ampliará el Cyber Verification Program a Opus 5.5. Las organizaciones verificadas pueden solicitar acceso al Life Sciences Verification Program para investigación en biología. La protección anti-destilación "preserved thinking" se aplica a cuentas API creadas a partir del 31 de agosto de 2026. Los detalles completos están en el Opus 5.5 System Card.

El movimiento que importa

Anthropic ya no compite solo por techo de capacidad: ahora vende economía de frontera. Un modelo que rinde como el mejor de hace unos meses a un 40% menos de coste es exactamente el patrón que veíamos con los System One Models de TypeSafe o los open source chinos: la frontera se convierte en commodity más rápido de lo esperado.

Para las empresas españolas que evalúan arquitecturas de agentes, la lectura práctica es clara: si mantienes el mismo presupuesto, obtienes más throughput; si mantienes el throughput, el coste operativo baja. Los equipos de consultoría de IA que auditan arquitecturas LLM tienen aquí un nuevo candidato a recomendar para las capas de decisión crítica de los pipelines.

Preguntas frecuentes sobre Claude Opus 5.5

¿Claude Opus 5.5 es mejor que Fable 5.1?

Según Anthropic, rinde al nivel de Fable 5.1 en la mayoría del trabajo y lo supera en casi todos los benchmarks publicados. Pero la propia empresa matiza que la brecha es más estrecha de lo que sugieren las puntuaciones. Son afirmaciones del fabricante a la espera de evaluaciones independientes.

¿Cuánto cuesta Claude Opus 5.5?

$4 por millón de tokens de entrada y $20 por millón de salida, con lecturas de caché a $0.20 (60% menos que Opus 5). Anthropic afirma que un workload típico cuesta un 40% menos que con Opus 5.

¿Dónde está disponible Claude Opus 5.5?

Por API en Claude Platform, AWS Bedrock, Google Cloud Vertex AI y Microsoft Azure/Foundry. También vía OpenRouter. No hay pesos abiertos: solo se consume por API.

¿Se puede desactivar el thinking en Claude Opus 5.5?

No. A diferencia de versiones anteriores, el thinking no se puede desactivar en Opus 5.5. Las salidas además llevan watermarking para cumplimiento del EU AI Act.

Temas relacionados en agentes.ai

Si quieres aplicar lo que lees en tu empresa, estos son puntos de partida útiles dentro de agentes.ai:

Posts relacionados