Claude Sonnet 5.5: especificaciones, precio y acceso en Modelflare
Relato basado en fuentes de claude-sonnet-5-5: especificaciones publicadas, precios oficiales por token, cómo leer la tabla de benchmarks del 28 de septiembre de 2026 y los grupos y precios de usuario de Modelflare devueltos el 30 de septiembre de 2026.
Anthropic publicó Claude Sonnet 5.5 el 28 de septiembre de 2026. El ID de modelo de la API es claude-sonnet-5-5. Es el segundo modelo de la familia Claude 5.5. Anthropic lo sitúa junto a Opus 5.5: las tareas cotidianas de alcance claro, las correcciones de bugs y los documentos, diapositivas y hojas de cálculo van aquí; el trabajo complejo, abierto y que necesita un juicio sostenido sigue en Opus 5.5. El precio de lista coincide con el de Sonnet 5: $2 por millón de tokens de entrada, $10 por millón de tokens de salida y $0.20 por millón de tokens de lectura de caché.
Este artículo mantiene separadas tres capas. La especificación y los cambios que rompen compatibilidad vienen de la página del modelo, la página de novedades y la guía de migración. La tabla de benchmarks está copiada de la página de lanzamiento. Modelflare no volvió a ejecutar esas evaluaciones. Los grupos y los precios de usuario vienen de GET https://modelflare.dev/api/pricing, leído el 30 de septiembre de 2026. Afirmaciones del proveedor como «hasta un 30% menos» y «más de un 30% más rápido» describen el propio harness de Anthropic.
Qué respaldan las fuentes
Con el precio de lista publicado, Sonnet 5.5 es la misma tarjeta que Sonnet 5. La entrada y la salida son la mitad de Opus 5.5. En las filas de programación y de trabajo de conocimiento impresas en la página de lanzamiento, queda claramente por encima de Sonnet 5. Terminal-Bench 4.0, con 70.6%, está por encima del 66.4% que esa página imprime para Opus 5.5. CursorBench 4.0, con 55.5%, y GDPval-AA v2.1, con 1844, quedan junto a Opus 5.5 y por debajo de él. Anthropic también dice que, en su propio uso y en pruebas externas, Opus 5.5 sigue siendo más fuerte en el trabajo complejo, abierto y que necesita un juicio sostenido.
El 30 de septiembre de 2026, la respuesta de precios de Modelflare ya contenía claude-sonnet-5-5. Los precios unitarios coinciden con las tarifas oficiales de entrada, salida, lectura de caché y escritura de caché de 5 minutos. Los grupos públicos son claude-award, claude-stable, claude-premium y claude-tmp-cheap. El aviso del sitio principal del 29 de septiembre de 2026 nombraba los grupos abiertos ese día, claude-award y claude-stable. En esta lectura, la lista pública ya incluía también los dos últimos.
Especificación publicada
| Concepto | Claude Sonnet 5.5 |
|---|---|
| ID de la Claude API | claude-sonnet-5-5 |
| ID de Amazon Bedrock | anthropic.claude-sonnet-5-5 |
| Google Cloud, Microsoft Foundry, Claude Platform on AWS | claude-sonnet-5-5 |
| Fecha de publicación | 28 de septiembre de 2026 |
| Compromiso de retirada | No antes del 28 de septiembre de 2027 |
| Contexto / salida máxima síncrona | 1M / 128K tokens |
| Salida máxima de la Batch API | 300K tokens, cabecera beta output-300k-2026-03-24 |
| Entrada a salida | Texto e imágenes a texto |
| Pensamiento | Adaptativo, activado de forma predeterminada |
| Effort predeterminado en la Claude API | high |
| Effort predeterminado en las apps de Claude y en Claude Code | medium |
| Valores de effort | low, medium, high, xhigh, max |
| Corte de conocimiento fiable | junio de 2026 |
| Prompt mínimo cacheable | 512 tokens |
| Tokenizador | El mismo que Sonnet 5, así que el mismo texto tiene el mismo número de tokens |
La página del modelo etiqueta la latencia como Fast. Es una comparación dentro de la línea actual de Claude, no una cifra medida de tokens por segundo. El ajuste más bajo que apaga el pensamiento previo es thinking: {"type": "between_tools"}, aceptado solo en low, medium y high. xhigh y max vuelven al pensamiento adaptativo. Fijar temperature, top_p o top_k fuera del valor predeterminado devuelve 400.
La página de lanzamiento dice que Haiku 5.5 llegará en las semanas siguientes. Este artículo no pone precio a un ID que todavía no está disponible.
Precios oficiales
Las cantidades son dólares estadounidenses por millón de tokens. La columna de Sonnet 5.5 es la página del modelo. La columna de Opus 5.5 es la tabla de comparación de la misma página de lanzamiento. La página de novedades dice que Sonnet 5.5 tiene los mismos precios que Sonnet 5, incluido el caché de prompts y el procesamiento Batch. El descuento de Batch es el 50% en la entrada y en la salida.
| Por 1M de tokens | Sonnet 5.5 | Opus 5.5 en la página de lanzamiento |
|---|---|---|
| Entrada | $2 | $4 |
| Salida | $10 | $20 |
| Lectura de caché | $0.20 | $0.20 |
| Escritura de caché | 5 minutos $2.50; 1 hora $4 | $5 |
| Entrada / salida de Batch | 50% del precio de lista | No figura en esa tabla |
La página de lanzamiento imprime una sola cifra de escritura de caché de Opus 5.5, $5, sin separar 5 minutos y 1 hora. La página del modelo de Sonnet 5.5 separa las dos. Frente a la entrada y la salida de Opus 5.5, esta tarjeta es la mitad. La lectura de caché es $0.20 en las dos.
Anthropic publica además dos afirmaciones de carga de trabajo: el mismo trabajo suele gastar menos tokens, y la mayoría de las tareas cuesta hasta un 30% menos; la generación de salida es más de un 30% más rápida que Sonnet 5. Los gráficos de coste añaden comparaciones por tarea de alrededor de una décima parte, una quinta parte y una quinceava parte. Esos resultados pertenecen a su harness. Una factura real sigue dependiendo del effort, de los aciertos de caché, de las rondas de herramientas y de si la llamada usó Batch.
Cómo leer los benchmarks
La tabla de abajo es la que imprime la página de lanzamiento. Un guion es una celda vacía de esa página. Los gráficos de coste de Terminal-Bench 4.0 y de CursorBench 4.0 usan GPT-5.6 Sol porque OpenAI no había publicado GPT-6 Sol en esas dos. Este artículo no copia un punto del gráfico de GPT-5.6 Sol en la columna de GPT-6 Sol. Modelflare no volvió a ejecutar las pruebas.
| Benchmark | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 70.6% | 10.3% | 66.4% | — |
| FrontierCode v1.1, Main | 46.2% (max); 52.1% (xhigh) | 42.4% | 54.4% | 49.3% |
| CursorBench 4.0 | 55.5% | 34.1% | 57.8% | — |
| GDPval-AA v2.1 | 1844 | 1449 | 1846 | 1487 |
| AA-Briefcase v1.1 | 1811 | 1359 | 1822 | 1483 |
| Humanity's Last Exam, con herramientas | 64.5% | 54.9% | 67.7% | — |
| OSWorld 2.1, partial | 80.1% | 57.0% | 81.8% | — |
| Chartography, sin herramientas | 61.6% | 15.6% | 64.4% | 53.6% |
Las notas al pie van junto a las puntuaciones. Opus 5.5 en Terminal-Bench 4.0 está en xhigh, que la página de lanzamiento llama la puntuación más alta de ese modelo. En FrontierCode, Sonnet 5.5 en max puntúa por debajo de xhigh. La página de lanzamiento explica que max ejecuta más a menudo una revisión de código y que, al repartirla entre varios subagentes, aparecieron tiempos de espera y también modificaciones fuera del alcance de la tarea, que esta evaluación penaliza. Artificial Analysis ejecutó GDPval-AA y AA-Briefcase en un despliegue previo a la publicación que tenía un defecto capaz de rebajar las salidas estructuradas. La página de lanzamiento dice que el defecto se corrigió después y que, si hubo efecto, la dirección fue subestimar Sonnet 5.5. Las celdas de GPT-6 Sol para GDPval-AA, AA-Briefcase y Chartography llevan otra nota: OpenAI había corregido un defecto que dañaba la comprensión de imágenes, y esas puntuaciones externas quizá todavía no se habían actualizado.
Los gráficos de coste de la misma página son otra lectura. El effort Medium es el valor predeterminado en las apps de Claude. En varios benchmarks, Sonnet 5.5 en Low o Medium supera la mejor puntuación de Sonnet 5 a alrededor de una décima parte del coste por tarea. El effort High es el valor predeterminado en la Claude Platform. La página de lanzamiento dice que, en FrontierCode en High, puntúa unos 10 puntos por encima de Sonnet 5 en el mismo ajuste, a alrededor de una quinceava parte del coste por tarea, y que iguala la mejor puntuación de GPT-6 Sol a alrededor de una quinta parte del coste. En CursorBench en Low supera la mejor puntuación de Sonnet 5 a menos de una décima parte del coste. En AA-Briefcase en Medium supera la mejor puntuación de Sonnet 5 a alrededor de una novena parte del coste. El 55.5% y el 1844 impresos son los puntos de la tabla. Las frases de coste son otro harness. Las citas de clientes seleccionadas en la página de lanzamiento pueden indicar qué conviene reproducir. No forman parte de esta tabla.
La página de lanzamiento también dice que esta es la primera Sonnet que supera Pokémon Red solo con capturas de pantalla. Es la narración de producto del proveedor, no una fila de la tabla de arriba.
Precios y grupos en Modelflare
En la respuesta de precios del 30 de septiembre de 2026, claude-sonnet-5-5 tiene input_price 2 y completion_ratio 5, así que la salida es $10. cache_ratio es 0.1, así que una lectura de caché es $0.20. create_cache_ratio es 1.25, así que la escritura de caché del catálogo es $2.50. La fila no tiene billing_mode ni un precio aparte de escritura de 1 hora. No multiplique los $4 oficiales de 1 hora, ni el medio precio de Batch, por un multiplicador de grupo y trate el producto como el cargo contabilizado. El registro de uso es el cargo.
Los tipos de endpoint son anthropic y openai. El grupo se elige en la clave de API. Los cuatro grupos públicos llaman al mismo ID de modelo.
Tabla de precios
| Grupo | Multiplicador | Entrada / 1M | Lectura de caché / 1M | Escritura de caché del catálogo / 1M | Salida / 1M | Descripción del catálogo ese día |
|---|---|---|---|---|---|---|
claude-award |
0.25 | $0.50 | $0.05 | $0.625 | $2.50 | Enrutamiento con prioridad de precio para desarrollo, pruebas y cargas flexibles, sensibles al presupuesto y que admiten reintento |
claude-stable |
0.315 | $0.63 | $0.063 | $0.7875 | $3.15 | Desarrollo individual, proyectos de mayor duración y aplicaciones de producción donde importa la estabilidad |
claude-premium |
0.5 | $1.00 | $0.10 | $1.25 | $5.00 | Prioridad a la continuidad y al éxito de la solicitud, al 50% del precio de lista oficial |
claude-tmp-cheap |
0.06 | $0.12 | $0.012 | $0.15 | $0.60 | Ruta promocional por tiempo limitado |
La aritmética es el precio unitario del catálogo por el multiplicador del grupo. En claude-stable, $0.63 es $2 × 0.315, y la escritura de caché de $0.7875 es $2.50 × 0.315. La descripción es el texto de la definición del grupo. No es un acuerdo medido de disponibilidad.
La misma respuesta también lista el claude-first-topup no público, con multiplicador 0.03, descrito como desbloqueado cuando una sola recarga alcanza $50. No es un grupo público seleccionable, así que no tiene fila arriba. Cuando una clave tiene además grupos de fallback, una solicitud que sale del grupo de la campaña se factura en el grupo que la atiende.
Tres ejemplos
Cada forma son 100,000 tokens de la clase de entrada indicada más 5,000 tokens de salida. Las filas de caché suponen que el registro de uso clasifica de verdad esos tokens como lectura o como escritura. Con importes pequeños, el redondeo de la cuota puede mover la cifra contabilizada.
| Solicitud | Precio de lista | claude-award |
claude-stable |
claude-premium |
claude-tmp-cheap |
|---|---|---|---|---|---|
| 100,000 de entrada sin caché, 5,000 de salida | $0.2500 | $0.0625 | $0.07875 | $0.1250 | $0.0150 |
| 100,000 de lectura de caché, 5,000 de salida | $0.0700 | $0.0175 | $0.02205 | $0.0350 | $0.0042 |
| 100,000 de escritura de caché del catálogo, 5,000 de salida | $0.3000 | $0.0750 | $0.0945 | $0.1500 | $0.0180 |
El precio de lista de la primera fila es 0.1 × $2 + 0.005 × $10. Cada celda de grupo es esos $0.25 por el multiplicador. La tercera fila usa el precio de escritura del catálogo de $2.50, el tramo oficial de 5 minutos, y no los $4 de 1 hora. La página en vivo es la página de precios de claude-sonnet-5-5. El catálogo completo es Modelos y precios.
Cuando un fallo sale caro, el catálogo describe claude-premium como la ruta de continuidad. Para la producción cotidiana y los proyectos más largos, el catálogo describe claude-stable como ese tipo de valor predeterminado. El desarrollo y las pruebas que admiten reintento usan claude-award. claude-tmp-cheap es la ruta promocional por tiempo limitado, con multiplicador 0.06. Elija el grupo por el coste del fallo y lea el multiplicador junto con esa descripción, no solo el multiplicador.
Cómo llamarlo en Modelflare
Cree una clave en uno de los cuatro grupos de la tabla. Envíe el ID de modelo claude-sonnet-5-5 exactamente. La URL base canónica es https://modelflare.dev/v1. La misma API también está publicada en https://cf.modelflare.dev/v1 y en https://origin.modelflare.dev/v1. El dominio raíz es el sitio canónico.
La Messages API es la entrada que fija el effort. La solicitud de abajo deja el pensamiento en adaptativo y fija el effort en medium. max_tokens tiene que dejar sitio a los bloques de pensamiento.
export MODELFLARE_API_KEY="YOUR_MODELFLARE_API_KEY"
curl -sS https://modelflare.dev/v1/messages \
-H "x-api-key: $MODELFLARE_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-sonnet-5-5",
"max_tokens": 1024,
"thinking": {"type": "adaptive"},
"output_config": {"effort": "medium"},
"messages": [
{
"role": "user",
"content": "Revise este plan de migración y enumere las tres hipótesis que más necesitan una prueba."
}
]
}'
Chat Completions también figura en este ID. Este ejemplo envía solo texto y no fija reasoning_effort.
curl -sS https://modelflare.dev/v1/chat/completions \
-H "Authorization: Bearer $MODELFLARE_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-sonnet-5-5",
"messages": [
{
"role": "user",
"content": "Revise este plan de migración y enumere las tres hipótesis que más necesitan una prueba."
}
]
}'
Para elegir un effort, use la solicitud de Messages de arriba. La pasarela convierte hoy el reasoning_effort de Chat Completions en un presupuesto manual de pensamiento con budget_tokens, y Sonnet 5.5 rechaza un presupuesto manual. Cuando se omite el effort, el valor predeterminado de la Claude API es high. La diferencia entre las dos entradas está en Responses API frente a Chat Completions. Cómo el uso se corresponde con la factura está en seguimiento del coste de la API de IA.
Migrar desde Sonnet 5
La página de novedades lista cinco cambios que hacen que el código que ya corría en Sonnet 5 devuelva 400, más un cambio que deja la solicitud correcta y cambia la forma de la respuesta.
Solicitudes que devuelven 400
thinking: {"type": "disabled"}
thinking: {"type": "enabled", "budget_tokens": N}
thinking: {"type": "between_tools"} con effort xhigh o max
tool_choice: {"type": "any"}
tool_choice: {"type": "tool", "name": "..."}
temperature, top_p o top_k fuera del valor predeterminado
tipo de herramienta computer_20251124 en la Claude API y en Google Cloud
herramienta advisor que usa Opus 4.8, Opus 4.7 o Sonnet 5 como advisor
Para apagar el pensamiento previo, envíe between_tools y mantenga el effort en high o por debajo. Mantenga tool_choice en auto o none. Para obtener una entrada de herramienta válida frente al schema, active strict, o pase el schema a salidas estructuradas, y diga en el prompt cuándo se aplica la herramienta. En la Claude API y en Google Cloud, el uso de ordenador pasa a computer_toolset_20260801. Amazon Bedrock sigue aceptando computer_20251124. La herramienta advisor acepta Mythos 5.1, Fable 5.1, Mythos 5, Fable 5, Opus 5.5, Opus 5, o el propio Sonnet 5.5. El contenido del advisor vuelve cifrado, y el cliente no puede leer el texto.
Las cuentas creadas el 31 de agosto de 2026 a las 00:00 UTC o después tienen un 400 más en la Claude API, Amazon Bedrock y Google Cloud: reproducir un bloque de pensamiento de Sonnet 5.5 después de un cambio en el prompt de sistema, en la lista de herramientas o en un mensaje anterior falla. Mantenga la conversación de solo adición. Cuando las instrucciones deban cambiar, use un mensaje de sistema a mitad de la conversación.
Comportamiento que cambia en una respuesta correcta
Cuando se omite el effort, la API corre en high. La misma palabra no compra la misma cantidad de pensamiento que compraba en Sonnet 5. La página de novedades dice que hay que volver a barrer el effort, en lugar de copiar el ajuste antiguo. Un bucle de herramientas de alcance claro puede empezar en medium, y uno más largo o más difícil puede subir a high. Un chat sensible a la latencia puede empezar en medium o en low.
El texto de progreso de más de una frase o dos entre llamadas a herramientas vuelve dentro de los bloques de pensamiento. Con el display predeterminado en omitted, el texto de esos bloques está vacío, así que la interfaz se queda en silencio entre herramientas mientras la solicitud sigue teniendo éxito. Fije display cuando el producto necesite esas líneas. Con between_tools, ese texto vuelve.
Un bloque de pensamiento registra el modelo que lo produjo. Sonnet 5.5 lee bloques de pensamiento de Sonnet 5, Opus 4.8, Haiku 4.5 y de modelos anteriores. No lee bloques de Opus 5, Opus 5.5, Fable ni Mythos. Ningún otro modelo lee los bloques de pensamiento de Sonnet 5.5. Un bloque que el modelo de destino no puede leer se descarta antes de que el modelo lo vea, y un bloque descartado no se factura. Un bloque que produce Sonnet 5.5 queda además ligado a la cuenta que lo produjo. Reproducirlo desde una cuenta no vinculada descarta el bloque, y la solicitud sigue teniendo éxito.
Rechazo y retroceso
Una solicitud rechazada devuelve HTTP 200 con stop_reason en "refusal". Las categorías nombradas en la página de novedades son cyber, bio, frontier_llm, reasoning_extraction y general_harms. La página de lanzamiento dice que su capacidad de ciberseguridad se acerca a Opus 5, así que esta es la primera Sonnet que sale con esa clase de protecciones de ciberseguridad. Las tareas de ciberseguridad de mayor riesgo retroceden a Sonnet 5. Las protecciones biológicas coinciden con las de Sonnet 5. El desarrollo de software habitual y la mayor parte del trabajo de ciencias de la vida quedan fuera de esas dos protecciones estrechas.
La página de novedades dice que el fallback predeterminado de la beta de la Claude API reintenta cyber y frontier_llm en Sonnet 5, y no reintenta bio, reasoning_extraction ni general_harms. Ese es el comportamiento documentado por Anthropic. Si esta ruta de Modelflare hace el mismo fallback lo responde el nombre del modelo en la respuesta. Cuente los rechazos aparte de los fallos de transporte. Si un rechazo se factura depende de su categoría. La página de lanzamiento también dice que Sonnet 5.5 está disponible con retención de datos cero.
Comprobaciones antes de mover el tráfico
- Fije
claude-sonnet-5-5. Compruebe también el nombre del modelo en el resultado completado. Un fallback de la protección puede responder como Sonnet 5. - Confirme que el grupo de la clave es uno de los cuatro grupos públicos de la tabla, y elíjalo por el coste del fallo.
- Reproduzca un conjunto sin datos sensibles en
low,medium,high,xhighymax. Registre el éxito, la latencia, la entrada, las lecturas de caché, las escrituras de caché, la salida y el cargo. - Ponga el effort en
output_config.effortde la solicitud de Messages. No use elreasoning_effortde Chat Completions para fijar el nivel de pensamiento de este modelo. - Cambie los clientes que todavía envían
disabled, una elección forzada de herramienta, un presupuesto manual de pensamiento ocomputer_20251124antes de subir el volumen. - Mantenga de solo adición las conversaciones que reproducen bloques de pensamiento.
- Cuente los rechazos HTTP 200 aparte de los fallos de transporte.
- Calcule el precio de un prompt corto y de un prompt que debería acertar la caché, y después lea la cifra contabilizada. El precio oficial de escritura de 1 hora y el medio precio de Batch siguen el registro de uso.
- Deje el trabajo complejo, abierto y que necesita un juicio sostenido en
claude-opus-5-5.claude-sonnet-5sigue disponible.
Fuentes
Comprobado el 30 de septiembre de 2026. Modelflare no reprodujo de forma independiente los benchmarks.
- Página de lanzamiento, 28 de septiembre de 2026: https://www.anthropic.com/claude-sonnet-5-5
- Página del modelo: https://platform.claude.com/docs/en/models/sonnet-5-5/overview
- Novedades: https://platform.claude.com/docs/en/models/sonnet-5-5/whats-new-sonnet-5-5
- Guía de migración: https://platform.claude.com/docs/en/models/sonnet-5-5/migration-guide
- API de precios de Modelflare: https://modelflare.dev/api/pricing
- Página de precios: https://modelflare.dev/pricing/claude-sonnet-5-5