Claude Opus 5.5: análise de parâmetros, preço e lugar no setor
A partir de fontes de primeira mão, este texto organiza os parâmetros públicos e o preço de tabela do Claude Opus 5.5, como ler os benchmarks face ao Fable 5.1, ao Opus 5 e ao GPT-6 Astra, e os grupos públicos e preços de utilizador do catálogo da Modelflare em 30 de setembro de 2026.
O Claude Opus 5.5 foi lançado em 22 de setembro de 2026. O contrato público está na página do modelo e na nota de novidades: o ID da API é claude-opus-5-5, o contexto é de 1M tokens, a saída máxima é de 128K, o pensamento adaptativo permanece ligado, o effort predefinido é medium e o preço de tabela é de $4 por milhão de tokens de entrada e $20 por milhão de tokens de saída. Essas páginas da Anthropic não dão um número de parâmetros nem um valor de computação de treino. Este artigo usa apenas a especificação publicada, a tabela de preços publicada e a tabela de benchmarks publicada.
Conclusão verificada: pelo preço de tabela do site da Anthropic, o Opus 5.5 é o nível Opus atual. Por token, é mais barato do que o Opus 5 e muito mais barato do que o Fable 5.1. Nas linhas de programação e de trabalho de conhecimento que a Anthropic imprimiu, as pontuações ficam à frente do Fable 5.1 e do Opus 5 e, na maioria dessas linhas, também à frente do GPT-6 Astra. Duas linhas impressas vão no sentido contrário: o Astra lidera o Terminal-Bench-Science 0.1 e o AutomationBench da Zapier. A API de preços da Modelflare, lida em 30 de setembro de 2026, já inclui claude-opus-5-5, e os preços unitários coincidem com os oficiais de $4 / $20. Os grupos públicos abertos nessa linha são claude-award 0.25, claude-stable 0.315 e claude-premium 0.5. A chave deste nível deve enviar claude-opus-5-5. As tarifas em tempo real estão na página de preços.
O comportamento oficial que se segue cita-se da página do modelo do Opus 5.5, da nota de novidades e da página de lançamento. Os detalhes de migração do Fable 5.1 estão na avaliação do Fable 5.1 que este blog já tem.
Parâmetros já publicados
| Item | Claude Opus 5.5 |
|---|---|
| ID do modelo, Claude API | claude-opus-5-5 |
| ID do Amazon Bedrock | anthropic.claude-opus-5-5 |
| ID do Google Cloud e do Microsoft Foundry | claude-opus-5-5 |
| Data de lançamento | 22 de setembro de 2026 |
| Janela de contexto | 1M tokens, o valor predefinido já é o máximo |
| Saída máxima | 128K tokens |
| Pensamento | Adaptativo, sempre ligado |
| Effort predefinido | medium |
| Classe de latência na página do modelo | Moderada |
| Corte de conhecimento fiável | junho de 2026 |
| Número de parâmetros | A página pública do modelo não o dá |
"Corte de conhecimento fiável" é o nome que a Anthropic dá à data até à qual o conhecimento já guardado do modelo é mais extenso. É distinto da janela de contexto. Um ficheiro anexado no pedido continua neste contexto.
Fast mode é um interruptor de velocidade no mesmo ID de modelo, e a documentação marca-o como uma pré-visualização de investigação disponível apenas na Claude API. O pedido usa speed: "fast" e leva o cabeçalho beta fast-mode-2026-02-01. A Anthropic fixa o preço deste modo em $8 / $40 por milhão de tokens e escreve a velocidade de saída como até cerca de 2.5×. A nota de novidades deixa claro que o Amazon Bedrock, o Claude Platform on AWS, o Google Cloud e o Microsoft Foundry não têm este fast mode.
A mesma página escreve a escala de effort como o controlo da profundidade do pensamento: low, medium, high, xhigh e max. Indicar à mão um orçamento de pensamento é rejeitado. O comprimento mínimo de um prompt que pode ir para cache é de 512 tokens.
Preços
Preços de tabela oficiais
Os valores são dólares dos Estados Unidos por milhão de tokens. A cache, o batch e o fast mode do Opus 5.5 vêm da secção de preços da nota de novidades. A célula de escrita de cache do Opus 5 é aquele único número de "cache writes" da tabela de comparação da página de lançamento, e essa tabela não separa os escalões de 5 minutos e de 1 hora. A leitura de cache do Fable 5.1 reutiliza o valor oficial já usado na avaliação do Fable 5.1 deste blog. Os preços de entrada e de saída do Sonnet 5 e do Haiku 4.5 vêm da linha de comparação na página do modelo do Opus 5.5. Um travessão significa que este artigo não tirou essa célula de uma linha de preços de primeira mão.
| Preço por 1M de tokens | Opus 5.5 | Opus 5 | Fable 5.1 | Sonnet 5 | Haiku 4.5 |
|---|---|---|---|---|---|
| Entrada | $4 | $5 | $10 | $2 | $1 |
| Saída | $20 | $25 | $50 | $10 | $5 |
| Leitura de cache | $0.20 | $0.50 | $0.25 | — | — |
| Escrita de cache | 5 minutos $5; 1 hora $8 | $6.25 | — | — | — |
| Entrada / saída de batch | $2 / $10 | — | — | — | — |
| Entrada / saída de fast mode | $8 / $40 | — | — | — | — |
Face ao Opus 5, o preço de tabela da entrada e da saída novas desceu 20%, de $5 / $25 para $4 / $20. A leitura de cache, que pesa mais nos ciclos longos de agente, desce de $0.50 para $0.20. Isso é 60% menos do que o preço de leitura de cache do Opus 5, e também fica abaixo da leitura de cache de $0.25 do Fable 5.1. A Anthropic tem ainda uma afirmação de carga de trabalho: na configuração predefinida, uma tarefa típica custa cerca de 40% menos do que com o Opus 5, porque o modelo também gasta menos tokens. Esses 40% descrevem o próprio banco de testes deles. Uma fatura real continua a depender do effort, da taxa de acertos de cache e das rondas de ferramentas.
O processamento em lote é metade do novo preço de tabela. Fast mode é o dobro do novo preço de tabela, e só existe na Claude API.
Catálogo da Modelflare em 30 de setembro de 2026
GET https://modelflare.dev/api/pricing, lido em 30 de setembro de 2026, inclui claude-opus-5-5. A mesma resposta inclui também claude-opus-5, claude-fable-5-1, claude-sonnet-5, claude-sonnet-5-5, claude-haiku-4-5, gpt-6-astra e gpt-5.6-sol. Não há um ID de Haiku 5.5.
Os preços unitários da tabela abaixo são, nessa resposta, os preços por token antes de multiplicar pelo rácio de grupo. Estas linhas da Claude coincidem com o preço de tabela oficial. O Astra e o Sol vão por escalões: quando o contexto de entrada passa de 272,000 tokens usa-se o segundo par de preços, e o preço de saída do contexto longo é o preço de saída desse próprio escalão. Na coluna de exemplo, as linhas da Claude multiplicam-se por claude-stable 0.315 e as da OpenAI por openai-stable 0.08. Os rácios da Claude nesta leitura são claude-premium 0.5, claude-stable 0.315 e claude-award 0.25. Os da OpenAI são openai-premium 0.13, openai-stable 0.08 e openai-award 0.03. O Opus 5.5 só ativa os três grupos Claude de cima. claude-tmp-cheap é um grupo público da Claude, e esta linha não o ativa.
| Modelo | ID de catálogo | Entrada / saída unitária | Preço de utilizador no grupo stable |
|---|---|---|---|
| Opus 5.5 | claude-opus-5-5 |
$4 / $20 | $1.26 / $6.30 |
| Opus 5 | claude-opus-5 |
$5 / $25 | $1.575 / $7.875 |
| Fable 5.1 | claude-fable-5-1 |
$10 / $50 | $3.15 / $15.75 |
| Sonnet 5 | claude-sonnet-5 |
$2 / $10 | $0.63 / $3.15 |
| GPT-6 Astra | gpt-6-astra |
$10 / $50, depois $20 / $75 | $0.80 / $4.00, depois $1.60 / $6.00 |
| GPT-5.6 Sol | gpt-5.6-sol |
$5 / $30, depois $10 / $45 | $0.40 / $2.40, depois $0.80 / $3.60 |
O Opus 5.5 em claude-stable é $4 × 0.315 e $20 × 0.315. Para comparar o Opus 5.5 com outros laboratórios, veja a tabela oficial. Para ler uma fatura da Modelflare que hoje se pode enviar, veja a tabela do catálogo.
O Haiku 4.5 também está no mesmo catálogo, com um preço unitário de $1 / $5. Em claude-stable isso é $0.315 / $1.575. A comparação da página do modelo continua a dar ao Haiku um contexto de 200K e uma saída máxima de 64K. A resposta de 30 de setembro de 2026 não inclui o Haiku 5.5. O Haiku 4.5 continua a ser a ponta de preço baixo da linha Claude que está de facto listada.
Os rácios de cache nas linhas do catálogo são uma fração do preço unitário de entrada: 0.05 para o Opus 5.5, portanto a leitura de cache do catálogo é $0.20 e a escrita de cache do catálogo é $5. Esse preço de escrita corresponde ao escalão oficial de 5 minutos. A escrita oficial de 1 hora é $8, e o catálogo não tem esse escalão em separado. O Opus 5 e o Sonnet 5 usam 0.1, e o Fable 5.1 usa 0.025. A cache, o contexto longo e os escalões de prioridade regem-se pela página de preços e pelo registo de utilização depois de concluído.
O que mudou face ao Opus 5 e ao Fable 5.1
| Comportamento | Opus 5.5 | Opus 5 | Fable 5.1 |
|---|---|---|---|
| ID da API | claude-opus-5-5 |
claude-opus-5 |
claude-fable-5-1 |
| Contexto / saída máxima | 1M / 128K | 1M / 128K | 1M / 128K |
| Pensamento | Sempre ligado. disabled e um orçamento manual devolvem 400 |
Ligado por predefinição. disabled só é aceite com effort high ou inferior |
Sempre ligado |
| Valor predefinido ao omitir effort | medium |
high |
high |
| Corte de conhecimento fiável | junho de 2026 | maio de 2026 | junho de 2026 |
| Entrada / saída de tabela | $4 / $20 | $5 / $25 | $10 / $50 |
| Leitura de cache | $0.20 | $0.50 | $0.25 |
| Escolha forçada de ferramenta | any e tool devolvem 400 |
Consta como alteração que quebra a compatibilidade face ao Opus 5 | Devolve 400 tal como o Opus 5.5 |
| Salvaguarda de cibersegurança | Entrega a tarefa ao Opus 4.8 | A nota de lançamento não põe este retrocesso no Opus 5 | Salvaguardas de nível Fable |
| Salvaguarda de biologia e de LLM de fronteira | Entrega a tarefa ao Opus 5 | A nota de lançamento escreve este retrocesso junto do Opus 5.5 | A mesma classe de salvaguarda |
O Opus 5.5 pode ler os blocos de pensamento produzidos pelo Opus 5 e pelos Opus, Sonnet e Haiku anteriores. Não lê os blocos de pensamento produzidos pelo Fable ou pelo Mythos. Na Claude API, o Fable 5.1 e o Mythos 5.1 podem ler os blocos de pensamento do Opus 5.5; a nota de novidades deixa claro que os outros modelos atuais não podem. Um bloco que o modelo de destino não consegue ler é descartado antes de o modelo o ver, e um bloco descartado não é faturado.
As contas criadas em 31 de agosto de 2026 ou depois têm uma verificação mais estrita: se o prompt de sistema, a lista de ferramentas ou uma mensagem anterior mudou depois de produzido um bloco de pensamento do Opus 5.5, reproduzir esse bloco devolve 400. O caminho que o guia de migração indica é um histórico só de acréscimos; quando as instruções têm de mudar, use uma mensagem de sistema a meio da conversa. A página de lançamento também escreve que o Opus 5.5 traz o controlo de pensamento preservado introduzido no Fable 5.1, a marca de água do Regulamento Europeu da IA e a retenção zero de dados, em linha com os Opus anteriores.
Como ler as pontuações de inteligência
A tabela abaixo é exatamente a que a página de lançamento imprimiu. A Anthropic diz que, salvo se uma nota de rodapé disser outra coisa, o Opus 5.5 usou pensamento adaptativo com effort max. O Terminal-Bench 4.0 é essa nota: o Opus 5.5 com xhigh, o GPT-6 Astra com high, cada um com a pontuação mais alta publicada desse modelo. Os números do Astra e do Sol citam-se segundo o relatório da OpenAI. As salvaguardas de produção estavam ligadas. Quando intervinham, as tarefas de cibersegurança eram concluídas pelo Opus 4.8, e as de biologia e de desenvolvimento de LLM de fronteira eram concluídas pelo Opus 5. A Anthropic diz que isso baixa as pontuações do Opus 5.5.
| Benchmark | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra | GPT-5.6 Sol |
|---|---|---|---|---|---|
| Terminal-Bench 4.0 | 66.4% | 55.8% | 52.3% | 57.9% | 37.3% |
| FrontierCode v1.1 (Main) | 54.4% | 50.3% | 48.0% | 53.3% | 47.5% |
| CursorBench 4.0 | 57.8% | 51.8% | 46.6% | — | 41.7% |
| GDPval-AA v2.1 | 1846 | 1735 | 1708 | 1542 | 1588 |
| AutomationBench | 40.0% | 31.4% | 26.9% | 41.4% | 28.8% |
| Humanity's Last Exam, com ferramentas | 67.7% | 65.6% | 63.6% | 57.2% | — |
| Terminal-Bench-Science 0.1 | 58.7% | 52.6% | 29.0% | 64.6% | 22.4% |
| OSWorld 2.0, partial | 81.8% | 80.7% | 74.0% | — | — |
| Chartography, com ferramentas | 89.0% | 88.4% | 83.4% | — | — |
Ponha as distâncias ao lado dos erros que publicaram. No Terminal-Bench 4.0, o Opus 5.5 é de ±2.6 pontos e os outros modelos Claude vão de ±1.6 a ±2 pontos. De 66.4% aos 57.9% do Astra, e aos 55.8% do Fable, a distância é mais larga do que esses erros. O Terminal-Bench-Science é de ±3.5 a ±5 pontos por modelo. Os 64.6% do Astra face aos 58.7% do Opus 5.5 aproximam-se da largura desses erros, e na estimativa pontual o Astra vai à frente.
O AutomationBench foi executado pela Zapier. Como essa execução não tinha um modelo de retrocesso, as intervenções da salvaguarda contaram como falhas. A Anthropic diz que a pontuação real seria mais alta. Os 40.0% impressos face aos 41.4% do Astra são um resultado publicado muito próximo, e na estimativa pontual o Astra vai à frente. O GDPval-AA v2.1 é um Elo de tarefas profissionais reais que cobre 44 profissões: 1846 para o Opus 5.5, 1735 para o Fable 5.1, 1708 para o Opus 5, 1588 para o Sol e 1542 para o Astra.
Nos gráficos de custo da mesma página de lançamento há um segundo conjunto de pontuações, tirado com o effort predefinido medium: FrontierCode 54.6% e CursorBench 52.5%. A tabela de comparação imprime 54.4% e 57.8%. Trate-os como dois números da Anthropic em dois ajustes de effort. A legenda do gráfico também diz que, com effort medium, o FrontierCode supera a pontuação máxima do Astra, 53.3%, a cerca de um quinto do custo por tarefa, e que o Terminal-Bench empata com o Astra a cerca de 40% do custo. São afirmações de custo por tarefa sobre o próprio banco de testes da Anthropic.
A frase por baixo da tabela é a que mais vale guardar: no próprio uso da Anthropic, a distância entre o Opus 5.5 e o Fable 5.1 é mais estreita do que as pontuações fazem parecer, e as margens de benchmark a este nível orientam pior uma tarefa real. As citações de clientes na página de lançamento são testemunhos selecionados. Podem indicar o que convém reproduzir. Não pertencem à tabela de pontuações.
O seu lugar no panorama atual dos modelos
No mesmo dia concretizaram-se três mudanças que se podem verificar.
O trabalho que a Anthropic descreve como "a maioria das tarefas chega ao nível do Fable 5.1" tem agora uma ficha de preços Opus. O preço de tabela é $4 / $20, e o Fable 5.1 é $10 / $50. A leitura de cache é $0.20, a do Fable é $0.25 e a do Opus 5 é $0.50. Se a reprodução da própria equipa concordar com esse juízo, o Fable 5.1 fica para as tarefas que ainda falham e o ciclo em si fica com o Opus 5.5. Se a reprodução não concordar, a tabela já escreve as exceções publicadas: as tarefas de agente científico e os fluxos de trabalho de negócio da Zapier, em que o Astra lidera os números impressos.
O valor predefinido moveu-se junto com o preço. A configuração de modelos do Claude Code, atualizada ao mesmo tempo que este lançamento, põe o Opus 5.5 como modelo predefinido de Pro, Max, Team, Enterprise e da Anthropic API, e também do Claude Platform on AWS, do Amazon Bedrock e do Google Cloud's Agent Platform. Um valor predefinido dentro do produto de agente move mais tráfego do que mais uma linha no seletor de modelos.
O limite da salvaguarda desceu até ao Opus. Os Opus anteriores recebiam o tráfego que um classificador do Fable não queria responder. O Opus 5.5 chega com um conjunto parecido de salvaguardas: as tarefas de cibersegurança são concluídas pelo Opus 4.8, e as de biologia e de desenvolvimento de LLM de fronteira são concluídas pelo Opus 5. No registo, o ID pedido pode ficar como claude-opus-5-5 e o resultado concluído pode vir de outro modelo. As recusas devolvem-se com HTTP 200 e stop_reason: "refusal".
O Sonnet 5.5 já está no catálogo de 30 de setembro de 2026, com o mesmo preço unitário de $2 / $10 que o Sonnet 5. Essa resposta não inclui o Haiku 5.5. As fichas Claude mais baratas que já estão listadas são o Sonnet 5.5, o Sonnet 5 a $2 / $10 e o Haiku 4.5 a $1 / $5. O Haiku 4.5 continua numa janela de 200K. Os grupos do Sonnet 5.5 estão na avaliação do Sonnet 5.5.
Esta é uma posição que se pode auditar a partir dos documentos: o preço de tabela, o modelo predefinido do Claude Code, que modelo responde quando uma salvaguarda dispara e que linhas da tabela do próprio fornecedor o Astra ainda lidera. Aqui não há uma afirmação de quota de mercado.
Restrições ao integrar
Pedidos que devolvem 400 de imediato
Um cliente que apenas substitui a cadeia do modelo continua a bater em quatro alterações que quebram a compatibilidade, documentadas para o código que corria no Opus 5. As três primeiras também se aplicam ao Fable 5.1. A forma abaixo é a que a nota de migração manda enviar. Os comentários marcam as variantes que devolvem invalid_request_error.
model: claude-opus-5-5
thinking: {"type": "adaptive"}
tool_choice: {"type": "auto"}
output_config.effort: medium
# 400: o tipo de thinking é disabled, ou enabled e leva budget_tokens
# 400: tool_choice é any, ou tool_choice é tool
# 400, limitado à Claude API e ao Google Cloud: tipo de ferramenta computer_20251124
A profundidade substitui o antigo interruptor de pensamento. Omita thinking, ou envie adaptive. O effort tem de ser definido de forma explícita. tool_choice auto e none continuam válidos, também no ponto de entrada que conta tokens. Para obter JSON válido segundo o schema, a nota de migração aponta para o uso estrito de ferramentas ou para as saídas estruturadas, e para escrever no prompt quando se deve chamar a ferramenta.
Na Claude API e no Google Cloud, substitua computer_20251124 pelo conjunto de ferramentas computer_toolset_20260801 e retire o antigo cabeçalho beta de uso do computador. O Opus 5.5 no Amazon Bedrock continua a aceitar computer_20251124. As integrações de uso do navegador que já usam esse conjunto não têm de mudar o código por esta alteração que quebra a compatibilidade.
Nas contas criadas em 31 de agosto de 2026 ou depois, se ao reproduzir se alterar o prefixo que está à frente de um bloco de pensamento do Opus 5.5, essa é a quarta causa de 400. Mantenha a conversa só com acréscimos.
O pedido tem sucesso e o comportamento muda na mesma
Omitir o effort executa-se agora em medium. A mesma omissão no Opus 5 executava-se em high. Com o effort alinhado, o Opus 5.5 costuma pensar mais em cada turno do que o Opus 5, sobretudo em xhigh e max. Um valor de effort copiado de uma configuração do Opus 5 é um ponto de custo novo. max_tokens tem de deixar espaço aos blocos de pensamento.
O texto escrito entre chamadas de ferramentas volta dentro dos blocos de pensamento. Quando o valor predefinido de display é omitted, esses blocos estão vazios. Uma interface que antes transmitia esse texto em fluxo fica em silêncio, e o pedido continua a ter sucesso. Quando o produto precisa dessas linhas de progresso, defina um valor de display.
Um classificador de biologia corre ao lado do classificador de cibersegurança. Um prompt que empurra o modelo a "copiar o raciocínio para a resposta visível" pode ser recusado sob reasoning_extraction. O guia de prompts diz que os gráficos e as capturas de ecrã já se leem com mais precisão antes de se acrescentar qualquer ferramenta de visão, por isso os prompts antigos, usados para compensar uma leitura de gráficos mais fraca, merecem ser reproduzidos à parte.
Que cargas convém avaliar primeiro
Reproduza o Opus 5.5 nos trabalhos que a página de lançamento descreve de forma concreta: uma alteração em vários ficheiros, uma migração com os testes do próprio repositório, um memorando de investigação pontuado face às suas fontes e um fluxo de uso do computador que se possa executar duas vezes. Registe o modelo pedido, o modelo que de facto respondeu, o effort, os tokens de entrada, os tokens de leitura de cache, os tokens de saída, o tempo de relógio, as novas tentativas e as edições humanas. O "cerca de 40% menos" e o "cerca de um quinto do custo" da Anthropic falam do próprio banco de testes, e não substituem esta folha de registo.
Nas tarefas que a reprodução ainda perde, continue a usar o Fable 5.1, ou um retrocesso explícito. O tráfego que a salvaguarda de cibersegurança vai entregar, prepare-o como Opus 4.8; o de biologia e de desenvolvimento de modelos de fronteira que a salvaguarda vai entregar, prepare-o como Opus 5. Quando a tarefa cabe na ficha de $2 / $10 e não precisa do ciclo do Opus, continue a usar o Sonnet 5.5 ou o Sonnet 5.
Na Modelflare, este nível envia claude-opus-5-5. A linha de 30 de setembro de 2026 ativa três grupos públicos: claude-premium a 0.5 quando uma falha sai cara, claude-stable a 0.315 para a produção corrente e claude-award a 0.25 quando a chamada pode ser repetida. claude-tmp-cheap não está ativado neste modelo. Em claude-stable o preço de utilizador é de $1.26 por milhão de tokens de entrada e $6.30 por milhão de tokens de saída.
Fontes
- Página de lançamento, 22 de setembro de 2026: https://www.anthropic.com/claude-opus-5-5
- Página do modelo, especificação e a linha de comparação atual: https://platform.claude.com/docs/en/models/opus-5-5/overview
- Nota de novidades, alterações que quebram a compatibilidade e a ficha de preços: https://platform.claude.com/docs/en/models/opus-5-5/whats-new-opus-5-5
- Configuração de modelos do Claude Code, modelo predefinido: https://code.claude.com/docs/en/model-config
- API de preços da Modelflare, lida em 30 de setembro de 2026: https://modelflare.dev/api/pricing
- Avaliação do Fable 5.1 neste blog: avaliação do Fable 5.1