Claude Opus 5.5: análisis de parámetros, precio y posición en el sector

A partir de fuentes de primera mano, este texto ordena los parámetros públicos y el precio de lista de Claude Opus 5.5, cómo leer los benchmarks frente a Fable 5.1, Opus 5 y GPT-6 Astra, y los grupos públicos y precios de usuario del catálogo de Modelflare el 30 de septiembre de 2026.

Claude Opus 5.5 se publicó el 22 de septiembre de 2026. El contrato público está en la página del modelo y en la nota de novedades: el ID de la API es claude-opus-5-5, el contexto es de 1M tokens, la salida máxima es de 128K, el pensamiento adaptativo permanece activado, el effort predeterminado es medium y el precio de lista es de $4 por millón de tokens de entrada y $20 por millón de tokens de salida. Esas páginas de Anthropic no dan un número de parámetros ni una cifra de cómputo de entrenamiento. Este artículo solo usa la especificación publicada, la tabla de precios publicada y la tabla de benchmarks publicada.

Conclusión verificada: según el precio de lista del sitio de Anthropic, Opus 5.5 es el nivel Opus actual. Por token, es más barato que Opus 5 y mucho más barato que Fable 5.1. En las filas de programación y de trabajo de conocimiento que Anthropic imprimió, sus puntuaciones van por delante de Fable 5.1 y de Opus 5, y en la mayoría de esas filas también por delante de GPT-6 Astra. Dos filas impresas van en sentido contrario: Astra lidera Terminal-Bench-Science 0.1 y el AutomationBench de Zapier. La API de precios de Modelflare, leída el 30 de septiembre de 2026, ya incluye claude-opus-5-5, y los precios unitarios coinciden con los oficiales de $4 / $20. Los grupos públicos abiertos en esa fila son claude-award 0.25, claude-stable 0.315 y claude-premium 0.5. La clave de este nivel debe enviar claude-opus-5-5. Las tarifas en vivo están en la página de precios.

El comportamiento oficial que sigue se cita de la página del modelo de Opus 5.5, la nota de novedades y la página de lanzamiento. Los detalles de migración de Fable 5.1 están en la evaluación de Fable 5.1 que ya tiene este blog.

Parámetros ya publicados

Concepto Claude Opus 5.5
ID de modelo, Claude API claude-opus-5-5
ID de Amazon Bedrock anthropic.claude-opus-5-5
ID de Google Cloud y Microsoft Foundry claude-opus-5-5
Fecha de publicación 22 de septiembre de 2026
Ventana de contexto 1M tokens, el valor predeterminado ya es el máximo
Salida máxima 128K tokens
Pensamiento Adaptativo, siempre activado
Effort predeterminado medium
Clase de latencia en la página del modelo Moderada
Corte de conocimiento fiable junio de 2026
Número de parámetros La página pública del modelo no lo da

«Corte de conocimiento fiable» es el nombre que Anthropic da a la fecha hasta la que el conocimiento ya almacenado del modelo es más amplio. Es distinto de la ventana de contexto. Un archivo adjunto en la solicitud sigue estando en este contexto.

Fast mode es un interruptor de velocidad en el mismo ID de modelo, y la documentación lo marca como una vista previa de investigación disponible solo en la Claude API. La solicitud usa speed: "fast" y lleva la cabecera beta fast-mode-2026-02-01. Anthropic fija el precio de este modo en $8 / $40 por millón de tokens y escribe la velocidad de salida como hasta unas 2.5×. La nota de novedades deja claro que Amazon Bedrock, Claude Platform on AWS, Google Cloud y Microsoft Foundry no tienen este fast mode.

La misma página escribe la escala de effort como el control de la profundidad del pensamiento: low, medium, high, xhigh y max. Indicar a mano un presupuesto de pensamiento se rechaza. La longitud mínima de un prompt que se puede guardar en caché es de 512 tokens.

Precios

Precios de lista oficiales

Las cifras son dólares estadounidenses por millón de tokens. La caché, el batch y el fast mode de Opus 5.5 vienen de la sección de precios de la nota de novedades. La celda de escritura de caché de Opus 5 es ese único número de "cache writes" de la tabla de comparación de la página de lanzamiento, y esa tabla no separa los tramos de 5 minutos y de 1 hora. La lectura de caché de Fable 5.1 reutiliza la cifra oficial que ya usó la evaluación de Fable 5.1 de este blog. Los precios de entrada y de salida de Sonnet 5 y de Haiku 4.5 vienen de la fila de comparación en la página del modelo de Opus 5.5. Un guion largo significa que este artículo no tomó esa celda de una fila de precios de primera mano.

Precio por 1M de tokens Opus 5.5 Opus 5 Fable 5.1 Sonnet 5 Haiku 4.5
Entrada $4 $5 $10 $2 $1
Salida $20 $25 $50 $10 $5
Lectura de caché $0.20 $0.50 $0.25 — —
Escritura de caché 5 minutos $5; 1 hora $8 $6.25 — — —
Entrada / salida de batch $2 / $10 — — — —
Entrada / salida de fast mode $8 / $40 — — — —

Frente a Opus 5, el precio de lista de la entrada y la salida nuevas bajó un 20%, de $5 / $25 a $4 / $20. La lectura de caché, que pesa más en los bucles largos de agente, baja de $0.50 a $0.20. Eso es un 60% menos que el precio de lectura de caché de Opus 5, y también queda por debajo de la lectura de caché de $0.25 de Fable 5.1. Anthropic tiene además una afirmación de carga de trabajo: con la configuración predeterminada, una tarea típica cuesta alrededor de un 40% menos que con Opus 5, porque el modelo también gasta menos tokens. Ese 40% describe su propio banco de pruebas. Una factura real sigue dependiendo del effort, de la tasa de aciertos de caché y de las rondas de herramientas.

El procesamiento por lotes es la mitad del nuevo precio de lista. Fast mode es el doble del nuevo precio de lista, y solo está en la Claude API.

Catálogo de Modelflare el 30 de septiembre de 2026

GET https://modelflare.dev/api/pricing, leído el 30 de septiembre de 2026, incluye claude-opus-5-5. La misma respuesta incluye también claude-opus-5, claude-fable-5-1, claude-sonnet-5, claude-sonnet-5-5, claude-haiku-4-5, gpt-6-astra y gpt-5.6-sol. No hay un ID de Haiku 5.5.

Los precios unitarios de la tabla de abajo son, en esa respuesta, los precios por token antes de multiplicar por el multiplicador de grupo. Estas filas de Claude coinciden con el precio de lista oficial. Astra y Sol van por tramos: cuando el contexto de entrada supera los 272,000 tokens se usa el segundo par de precios, y el precio de salida del contexto largo es el precio de salida de ese propio tramo. En la columna de ejemplo, las filas de Claude se multiplican por claude-stable 0.315 y las de OpenAI por openai-stable 0.08. Los multiplicadores de Claude en esta lectura son claude-premium 0.5, claude-stable 0.315 y claude-award 0.25. Los de OpenAI son openai-premium 0.13, openai-stable 0.08 y openai-award 0.03. Opus 5.5 solo habilita los tres grupos de Claude de arriba. claude-tmp-cheap es un grupo público de Claude, y esta fila no lo habilita.

Modelo ID de catálogo Entrada / salida unitaria Precio de usuario en el grupo stable
Opus 5.5 claude-opus-5-5 $4 / $20 $1.26 / $6.30
Opus 5 claude-opus-5 $5 / $25 $1.575 / $7.875
Fable 5.1 claude-fable-5-1 $10 / $50 $3.15 / $15.75
Sonnet 5 claude-sonnet-5 $2 / $10 $0.63 / $3.15
GPT-6 Astra gpt-6-astra $10 / $50, después $20 / $75 $0.80 / $4.00, después $1.60 / $6.00
GPT-5.6 Sol gpt-5.6-sol $5 / $30, después $10 / $45 $0.40 / $2.40, después $0.80 / $3.60

Opus 5.5 en claude-stable es $4 × 0.315 y $20 × 0.315. Para comparar Opus 5.5 con otros laboratorios, mire la tabla oficial. Para leer una factura de Modelflare que hoy se puede enviar, mire la tabla del catálogo.

Haiku 4.5 también está en el mismo catálogo, con un precio unitario de $1 / $5. En claude-stable eso es $0.315 / $1.575. La comparación de la página del modelo sigue dando a Haiku un contexto de 200K y una salida máxima de 64K. La respuesta del 30 de septiembre de 2026 no incluye Haiku 5.5. Haiku 4.5 sigue siendo el extremo de precio bajo de la línea Claude que de verdad está listada.

Los multiplicadores de caché en las filas del catálogo son una fracción del precio unitario de entrada: 0.05 para Opus 5.5, así que la lectura de caché del catálogo es $0.20 y la escritura de caché del catálogo es $5. Ese precio de escritura corresponde al tramo oficial de 5 minutos. La escritura oficial de 1 hora es $8, y el catálogo no tiene ese tramo por separado. Opus 5 y Sonnet 5 usan 0.1, y Fable 5.1 usa 0.025. La caché, el contexto largo y los tramos de prioridad se rigen por la página de precios y por el registro de uso una vez terminado.

Qué cambió frente a Opus 5 y Fable 5.1

Comportamiento Opus 5.5 Opus 5 Fable 5.1
ID de la API claude-opus-5-5 claude-opus-5 claude-fable-5-1
Contexto / salida máxima 1M / 128K 1M / 128K 1M / 128K
Pensamiento Siempre activado. disabled y un presupuesto manual devuelven 400 Activado de forma predeterminada. disabled solo se acepta con effort high o inferior Siempre activado
Valor predeterminado al omitir effort medium high high
Corte de conocimiento fiable junio de 2026 mayo de 2026 junio de 2026
Entrada / salida de lista $4 / $20 $5 / $25 $10 / $50
Lectura de caché $0.20 $0.50 $0.25
Elección forzada de herramienta any y tool devuelven 400 Consta como cambio que rompe la compatibilidad respecto de Opus 5 Devuelve 400 igual que Opus 5.5
Salvaguarda de ciberseguridad Entrega la tarea a Opus 4.8 La nota de lanzamiento no pone este retroceso en Opus 5 Salvaguardas de nivel Fable
Salvaguarda de biología y de LLM de frontera Entrega la tarea a Opus 5 La nota de lanzamiento escribe este retroceso junto a Opus 5.5 La misma clase de salvaguarda

Opus 5.5 puede leer los bloques de pensamiento que producen Opus 5 y los Opus, Sonnet y Haiku anteriores. No lee los bloques de pensamiento que producen Fable o Mythos. En la Claude API, Fable 5.1 y Mythos 5.1 pueden leer los bloques de pensamiento de Opus 5.5; la nota de novedades deja claro que los demás modelos actuales no pueden. Un bloque que el modelo de destino no puede leer se descarta antes de que el modelo lo vea, y un bloque descartado no se factura.

Las cuentas creadas el 31 de agosto de 2026 o después tienen una comprobación más estricta: si el prompt de sistema, la lista de herramientas o un mensaje anterior cambió después de producirse un bloque de pensamiento de Opus 5.5, reproducir ese bloque devuelve 400. El camino que da la guía de migración es un historial de solo añadidos; cuando las instrucciones tienen que cambiar, use un mensaje de sistema a mitad de la conversación. La página de lanzamiento también escribe que Opus 5.5 trae el control de pensamiento preservado que introdujo Fable 5.1, la marca de agua de la Ley de IA de la UE y la retención cero de datos, en línea con los Opus anteriores.

Cómo hay que leer las puntuaciones de inteligencia

La tabla de abajo es exactamente la que imprimió la página de lanzamiento. Anthropic dice que, salvo que una nota al pie diga otra cosa, Opus 5.5 usó pensamiento adaptativo con effort max. Terminal-Bench 4.0 es esa nota: Opus 5.5 con xhigh, GPT-6 Astra con high, cada uno con la puntuación más alta publicada de ese modelo. Las cifras de Astra y de Sol se citan según el informe de OpenAI. Las salvaguardas de producción estaban activadas. Cuando intervenían, las tareas de ciberseguridad las completaba Opus 4.8, y las de biología y de desarrollo de LLM de frontera las completaba Opus 5. Anthropic dice que eso baja las puntuaciones de Opus 5.5.

Benchmark Opus 5.5 Fable 5.1 Opus 5 GPT-6 Astra GPT-5.6 Sol
Terminal-Bench 4.0 66.4% 55.8% 52.3% 57.9% 37.3%
FrontierCode v1.1 (Main) 54.4% 50.3% 48.0% 53.3% 47.5%
CursorBench 4.0 57.8% 51.8% 46.6% — 41.7%
GDPval-AA v2.1 1846 1735 1708 1542 1588
AutomationBench 40.0% 31.4% 26.9% 41.4% 28.8%
Humanity's Last Exam, con herramientas 67.7% 65.6% 63.6% 57.2% —
Terminal-Bench-Science 0.1 58.7% 52.6% 29.0% 64.6% 22.4%
OSWorld 2.0, partial 81.8% 80.7% 74.0% — —
Chartography, con herramientas 89.0% 88.4% 83.4% — —

Ponga las distancias junto a los errores que publicaron. En Terminal-Bench 4.0, Opus 5.5 es de ±2.6 puntos y los demás modelos Claude van de ±1.6 a ±2 puntos. De 66.4% al 57.9% de Astra, y al 55.8% de Fable, la distancia es más ancha que esos errores. Terminal-Bench-Science es de ±3.5 a ±5 puntos por modelo. El 64.6% de Astra frente al 58.7% de Opus 5.5 se acerca a la anchura de esos errores, y en la estimación puntual Astra va por delante.

AutomationBench lo ejecutó Zapier. Como esa ejecución no tenía un modelo de retroceso, las intervenciones de la salvaguarda contaron como fallos. Anthropic dice que la puntuación real sería más alta. El 40.0% impreso frente al 41.4% de Astra es un resultado publicado muy cercano, y en la estimación puntual Astra va por delante. GDPval-AA v2.1 es un Elo de tareas profesionales reales que cubre 44 ocupaciones: 1846 para Opus 5.5, 1735 para Fable 5.1, 1708 para Opus 5, 1588 para Sol y 1542 para Astra.

En los gráficos de coste de la misma página de lanzamiento hay un segundo conjunto de puntuaciones, tomado con el effort predeterminado medium: FrontierCode 54.6% y CursorBench 52.5%. La tabla de comparación imprime 54.4% y 57.8%. Trátelos como dos cifras de Anthropic en dos ajustes de effort. El pie del gráfico también dice que, con effort medium, FrontierCode supera la puntuación máxima de Astra, 53.3%, a aproximadamente una quinta parte del coste por tarea, y que Terminal-Bench empata con Astra a aproximadamente el 40% del coste. Son afirmaciones de coste por tarea sobre el propio banco de pruebas de Anthropic.

La frase bajo la tabla es la que más vale conservar: en el propio uso de Anthropic, la distancia entre Opus 5.5 y Fable 5.1 es más estrecha de lo que las puntuaciones hacen parecer, y los márgenes de benchmark a este nivel orientan peor una tarea real. Las citas de clientes en la página de lanzamiento son testimonios seleccionados. Pueden indicar qué conviene reproducir. No pertenecen a la tabla de puntuaciones.

Su lugar en el panorama actual de modelos

El mismo día se concretaron tres cambios que se pueden comprobar.

El trabajo que Anthropic describe como «la mayoría de las tareas alcanza el nivel de Fable 5.1» ahora tiene una tarjeta de precios de Opus. El precio de lista es $4 / $20, y Fable 5.1 es $10 / $50. La lectura de caché es $0.20, la de Fable es $0.25 y la de Opus 5 es $0.50. Si la reproducción del propio equipo coincide con ese juicio, Fable 5.1 se reserva para las tareas que aún fallan y el bucle en sí se deja a Opus 5.5. Si la reproducción no coincide, la tabla ya escribe las excepciones publicadas: las tareas de agente científico y los flujos de trabajo de negocio de Zapier, donde Astra lidera los números impresos.

El valor predeterminado se movió junto con el precio. La configuración de modelos de Claude Code, actualizada a la vez que esta publicación, pone a Opus 5.5 como modelo predeterminado de Pro, Max, Team, Enterprise y la Anthropic API, y también de Claude Platform on AWS, Amazon Bedrock y Google Cloud's Agent Platform. Un valor predeterminado dentro del producto de agente mueve más tráfico que una fila más en el selector de modelos.

El límite de la salvaguarda bajó hasta Opus. Los Opus anteriores recibían el tráfico que un clasificador de Fable no quería responder. Opus 5.5 se publica con un conjunto parecido de salvaguardas: las tareas de ciberseguridad las completa Opus 4.8, y las de biología y de desarrollo de LLM de frontera las completa Opus 5. En el registro, el ID solicitado puede quedar como claude-opus-5-5 y el resultado completado puede venir de otro modelo. Los rechazos se devuelven con HTTP 200 y stop_reason: "refusal".

Sonnet 5.5 ya está en el catálogo del 30 de septiembre de 2026, con el mismo precio unitario de $2 / $10 que Sonnet 5. Esa respuesta no incluye Haiku 5.5. Las tarjetas Claude más baratas que ya están listadas son Sonnet 5.5, Sonnet 5 a $2 / $10 y Haiku 4.5 a $1 / $5. Haiku 4.5 sigue en una ventana de 200K. Los grupos de Sonnet 5.5 están en la evaluación de Sonnet 5.5.

Esta es una posición que se puede auditar desde los documentos: el precio de lista, el modelo predeterminado de Claude Code, qué modelo responde cuando se dispara una salvaguarda y qué filas de la tabla del propio proveedor sigue liderando Astra. Aquí no hay una afirmación de cuota de mercado.

Restricciones al integrar

Solicitudes que devuelven 400 de inmediato

Un cliente que solo sustituye la cadena del modelo sigue chocando con cuatro cambios que rompen la compatibilidad, documentados para el código que corría en Opus 5. Los tres primeros también se aplican a Fable 5.1. La forma de abajo es la que la nota de migración pide enviar. Los comentarios marcan las variantes que devuelven invalid_request_error.

model: claude-opus-5-5
thinking: {"type": "adaptive"}
tool_choice: {"type": "auto"}
output_config.effort: medium
# 400: el tipo de thinking es disabled, o enabled y lleva budget_tokens
# 400: tool_choice es any, o tool_choice es tool
# 400, limitado a la Claude API y a Google Cloud: tipo de herramienta computer_20251124

La profundidad sustituye al antiguo interruptor de pensamiento. Omita thinking, o envíe adaptive. El effort hay que fijarlo de forma explícita. tool_choice auto y none siguen siendo válidos, también en el punto de entrada que cuenta tokens. Para obtener JSON válido según el schema, la nota de migración apunta al uso estricto de herramientas o a las salidas estructuradas, y a escribir en el prompt cuándo hay que llamar a la herramienta.

En la Claude API y en Google Cloud, sustituya computer_20251124 por el conjunto de herramientas computer_toolset_20260801 y quite la antigua cabecera beta de uso del ordenador. Opus 5.5 en Amazon Bedrock sigue aceptando computer_20251124. Las integraciones de uso del navegador que ya usan ese conjunto no tienen que cambiar el código por este cambio que rompe la compatibilidad.

En las cuentas creadas el 31 de agosto de 2026 o después, si al reproducir se modifica el prefijo que va delante de un bloque de pensamiento de Opus 5.5, esa es la cuarta causa de 400. Mantenga la conversación solo con añadidos.

La solicitud tiene éxito y el comportamiento igual cambia

Omitir effort ahora se ejecuta en medium. La misma omisión en Opus 5 se ejecutaba en high. Con el effort alineado, Opus 5.5 suele pensar más en cada turno que Opus 5, sobre todo en xhigh y max. Un valor de effort copiado de una configuración de Opus 5 es un punto de coste nuevo. max_tokens tiene que dejar espacio a los bloques de pensamiento.

El texto escrito entre llamadas a herramientas vuelve dentro de los bloques de pensamiento. Cuando el valor predeterminado de display es omitted, esos bloques están vacíos. Una interfaz que antes transmitía ese texto en flujo se queda en silencio, y la solicitud sigue teniendo éxito. Cuando el producto necesita esas líneas de progreso, fije un valor de display.

Un clasificador de biología corre junto al clasificador de ciberseguridad. Un prompt que empuja al modelo a «copiar el razonamiento en la respuesta visible» puede rechazarse bajo reasoning_extraction. La guía de prompts dice que los gráficos y las capturas ya se leen con más precisión antes de añadir cualquier herramienta de visión, así que los prompts antiguos, usados para compensar una lectura de gráficos más débil, merecen reproducirse por separado.

Qué cargas conviene evaluar primero

Reproduzca Opus 5.5 en los trabajos que la página de lanzamiento describe con concreción: un cambio en varios archivos, una migración con las pruebas del propio repositorio, un memorando de investigación puntuado contra sus fuentes y un flujo de uso del ordenador que se pueda ejecutar dos veces. Anote el modelo solicitado, el modelo que de verdad respondió, el effort, los tokens de entrada, los tokens de lectura de caché, los tokens de salida, el tiempo de reloj, los reintentos y las ediciones humanas. El «alrededor de un 40% menos» y el «alrededor de una quinta parte del coste» de Anthropic hablan de su propio banco de pruebas, y no sustituyen esta hoja de registro.

En las tareas que la reproducción todavía pierde, siga usando Fable 5.1, o un retroceso explícito. El tráfico que la salvaguarda de ciberseguridad va a entregar, prepárelo como Opus 4.8; el de biología y de desarrollo de modelos de frontera que la salvaguarda va a entregar, prepárelo como Opus 5. Cuando la tarea cabe en la tarjeta de $2 / $10 y no necesita el bucle de Opus, siga usando Sonnet 5.5 o Sonnet 5.

En Modelflare, este nivel envía claude-opus-5-5. La fila del 30 de septiembre de 2026 habilita tres grupos públicos: claude-premium a 0.5 cuando un fallo sale caro, claude-stable a 0.315 para la producción ordinaria y claude-award a 0.25 cuando la llamada se puede reintentar. claude-tmp-cheap no está habilitado en este modelo. En claude-stable el precio de usuario es de $1.26 por millón de tokens de entrada y $6.30 por millón de tokens de salida.

Fuentes