Claude Opus 5.5 深度分析:参数、价格与行业位置

依据一手资料梳理 Claude Opus 5.5 的公开参数、官网价格,以及相对 Fable 5.1、Opus 5 和 GPT-6 Astra 的基准读法,并记录 2026-09-30 Modelflare 目录中的公开分组与用户价格。

Claude Opus 5.5 于 2026 年 9 月 22 日发布。公开契约写在模型页和更新说明里:API 标识是 claude-opus-5-5,上下文 1M tokens,最大输出 128K,自适应思考保持开启,默认 effort 为 medium,标价是每百万输入 token $4、每百万输出 token $20。Anthropic 的这些页面没有给出参数量,也没有给出训练算力。本文只使用已公开的规格、价格表和基准表。

核查后的结论: 按 Anthropic 官网标价,Opus 5.5 是当前的 Opus 档。按 token 计,它比 Opus 5 便宜,也比 Fable 5.1 便宜很多。在 Anthropic 印出的编程和知识工作行上,它的分数领先 Fable 5.1、Opus 5,并且在其中大多数行上领先 GPT-6 Astra。有两行方向相反:Astra 领先 Terminal-Bench-Science 0.1 和 Zapier 的 AutomationBench。Modelflare 的价格接口在 2026 年 9 月 30 日已经包含 claude-opus-5-5,单位价格与官网的 $4 / $20 一致。这一行开放的公开分组是 claude-award 0.25、claude-stable 0.315 和 claude-premium 0.5。这个档位的 Key 应发送 claude-opus-5-5。实时价格见价格页。

下文的官方行为引自 Opus 5.5 模型页、更新说明 和发布页。Fable 5.1 的迁移细节见本博客已有的 Fable 5.1 评测。

已经公开的参数

项目 Claude Opus 5.5
模型 ID,Claude API claude-opus-5-5
Amazon Bedrock ID anthropic.claude-opus-5-5
Google Cloud 与 Microsoft Foundry ID claude-opus-5-5
发布日期 2026 年 9 月 22 日
上下文窗口 1M tokens,默认即最大
最大输出 128K tokens
思考 自适应,始终开启
默认 effort medium
模型页上的延迟档 中等
可靠知识截止 2026 年 6 月
参数量 公开模型页未提供

“可靠知识截止”是 Anthropic 对模型既有知识最充分所及日期的叫法。它和上下文窗口是两件事。请求里附上的文件仍然在这次上下文中。

Fast mode 是同一模型 ID 上的速度开关,文档把它标成仅 Claude API 可用的研究预览。请求使用 speed: "fast",并带上 beta 头 fast-mode-2026-02-01。Anthropic 给这个模式的价格是每百万 token $8 / $40,并把输出速度写成最高约 2.5 倍。更新说明写明:Amazon Bedrock、Claude Platform on AWS、Google Cloud 和 Microsoft Foundry 没有这个 fast mode。

同一页把 effort 阶梯写成思考深度的控制项:low、medium、high、xhigh、max。手工指定思考预算会被拒绝。可缓存提示词的最短长度是 512 tokens。

价格

官网标价

单位是美元 / 每百万 tokens。Opus 5.5 的缓存、批量和 fast mode 来自更新说明的价格一节。Opus 5 的缓存写入格,是发布页对比表里的那一个 “cache writes” 数字,该表没有把 5 分钟和 1 小时档拆开。Fable 5.1 的缓存读取沿用本博客 Fable 5.1 评测里已经使用的官网数字。Sonnet 5 和 Haiku 4.5 的输入、输出价格来自 Opus 5.5 模型页上的对比行。破折号表示本文没有从一份一手价格行里取这一格。

每 1M tokens 的价格 Opus 5.5 Opus 5 Fable 5.1 Sonnet 5 Haiku 4.5
输入 $4 $5 $10 $2 $1
输出 $20 $25 $50 $10 $5
缓存读取 $0.20 $0.50 $0.25 — —
缓存写入 5 分钟 $5;1 小时 $8 $6.25 — — —
批量输入 / 输出 $2 / $10 — — — —
Fast mode 输入 / 输出 $8 / $40 — — — —

相对 Opus 5,新鲜输入和输出的标价降了 20%,从 $5 / $25 到 $4 / $20。长 Agent 循环里占比更高的缓存读取,从 $0.50 降到 $0.20。这是比 Opus 5 的缓存读取价低 60%,也低于 Fable 5.1 的 $0.25。Anthropic 另有一条工作负载说法:默认设置下,典型任务的花费大约比 Opus 5 低 40%,因为模型用掉的 token 也更少。这 40% 描述的是他们自己的测试装置。真实账单仍取决于 effort、缓存命中率和工具轮次。

批量处理是新标价的一半。Fast mode 是新标价的两倍,而且只在 Claude API 上。

2026 年 9 月 30 日的 Modelflare 目录

2026 年 9 月 30 日读取的 GET https://modelflare.dev/api/pricing 包含 claude-opus-5-5,同一份响应里还有 claude-opus-5、claude-fable-5-1、claude-sonnet-5、claude-sonnet-5-5、claude-haiku-4-5、gpt-6-astra 和 gpt-5.6-sol。其中没有 Haiku 5.5 的 ID。

下表的单位价格是该响应里、乘上分组倍率之前的 token 价格。Claude 这几行与官网标价一致。Astra 和 Sol 分档:输入上下文超过 272,000 tokens 时用第二组价格,长上下文的输出价是该档自己的输出价。示例列里,Claude 行乘的是 claude-stable 0.315,OpenAI 行乘的是 openai-stable 0.08。这次读取的 Claude 倍率是 claude-premium 0.5、claude-stable 0.315、claude-award 0.25。OpenAI 倍率是 openai-premium 0.13、openai-stable 0.08、openai-award 0.03。Opus 5.5 只启用上面三个 Claude 分组。claude-tmp-cheap 是公开的 Claude 分组,这一行没有启用它。

模型 目录 ID 单位输入 / 输出 stable 分组上的用户价格
Opus 5.5 claude-opus-5-5 $4 / $20 $1.26 / $6.30
Opus 5 claude-opus-5 $5 / $25 $1.575 / $7.875
Fable 5.1 claude-fable-5-1 $10 / $50 $3.15 / $15.75
Sonnet 5 claude-sonnet-5 $2 / $10 $0.63 / $3.15
GPT-6 Astra gpt-6-astra $10 / $50,其后 $20 / $75 $0.80 / $4.00,其后 $1.60 / $6.00
GPT-5.6 Sol gpt-5.6-sol $5 / $30,其后 $10 / $45 $0.40 / $2.40,其后 $0.80 / $3.60

Opus 5.5 在 claude-stable 上是 $4 × 0.315 和 $20 × 0.315。拿 Opus 5.5 和其他实验室比较时看官网表。看今天就能发出的 Modelflare 账单时看目录表。

Haiku 4.5 也在同一份目录里,单位价格 $1 / $5。在 claude-stable 上是 $0.315 / $1.575。模型页的对比仍给 Haiku 200K 上下文和 64K 最大输出。2026 年 9 月 30 日的响应里没有 Haiku 5.5。Haiku 4.5 仍是目前确实列出来的 Claude 产品线低价端。

目录行上的缓存倍率是输入单位价格的一个分数:Opus 5.5 为 0.05,所以目录缓存读取是 $0.20,目录缓存写入是 $5。这个写入价对应官网的 5 分钟档。官网的 1 小时写入是 $8,目录没有单独的这一档。Opus 5 和 Sonnet 5 为 0.1,Fable 5.1 为 0.025。缓存、长上下文和优先档以价格页以及完成后的用量记录为准。

相对 Opus 5 和 Fable 5.1 改了什么

行为 Opus 5.5 Opus 5 Fable 5.1
API ID claude-opus-5-5 claude-opus-5 claude-fable-5-1
上下文 / 最大输出 1M / 128K 1M / 128K 1M / 128K
思考 始终开启。disabled 和手工预算返回 400 默认开启。仅在 effort 为 high 或更低时接受 disabled 始终开启
省略 effort 时的默认值 medium high high
可靠知识截止 2026 年 6 月 2026 年 5 月 2026 年 6 月
标价输入 / 输出 $4 / $20 $5 / $25 $10 / $50
缓存读取 $0.20 $0.50 $0.25
强制工具选择 any 和 tool 返回 400 被列为相对 Opus 5 的破坏性变更 与 Opus 5.5 同样返回 400
网络安全防护 把任务交给 Opus 4.8 发布说明没有把这条回退放在 Opus 5 上 Fable 级别的防护
生物与前沿 LLM 防护 把任务交给 Opus 5 发布说明把这条回退和 Opus 5.5 写在一起 同一类防护

Opus 5.5 能读 Opus 5 以及更早的 Opus、Sonnet、Haiku 产生的思考块。它不读 Fable 或 Mythos 产生的思考块。在 Claude API 上,Fable 5.1 和 Mythos 5.1 能读 Opus 5.5 的思考块;更新说明写明,其他当前模型不能。目标模型读不了的块会在模型看到之前被丢掉,丢掉的块不计费。

2026 年 8 月 31 日及之后创建的账号检查更严:如果系统提示词、工具列表或更早的消息在 Opus 5.5 思考块产生之后被改过,重放这个块会返回 400。迁移指南给出的做法是只追加的历史;指令必须改时,用对话中途的系统消息。发布页还写到,Opus 5.5 带有 Fable 5.1 引入的保留思考控制、欧盟 AI 法案水印,以及与此前 Opus 一致的零数据保留。

智力分数应该怎么读

下表就是发布页印出的那一张。Anthropic 说,除非脚注另有说明,Opus 5.5 使用自适应思考、effort 为 max。Terminal-Bench 4.0 是那个脚注:Opus 5.5 用 xhigh,GPT-6 Astra 用 high,各自取该模型公布的最高分。Astra 和 Sol 的数字按 OpenAI 的报告引用。生产防护是打开的。防护介入时,网络安全任务由 Opus 4.8 完成,生物和前沿 LLM 开发任务由 Opus 5 完成。Anthropic 说这会把 Opus 5.5 的分数拉低。

基准 Opus 5.5 Fable 5.1 Opus 5 GPT-6 Astra GPT-5.6 Sol
Terminal-Bench 4.0 66.4% 55.8% 52.3% 57.9% 37.3%
FrontierCode v1.1(Main) 54.4% 50.3% 48.0% 53.3% 47.5%
CursorBench 4.0 57.8% 51.8% 46.6% — 41.7%
GDPval-AA v2.1 1846 1735 1708 1542 1588
AutomationBench 40.0% 31.4% 26.9% 41.4% 28.8%
Humanity's Last Exam,使用工具 67.7% 65.6% 63.6% 57.2% —
Terminal-Bench-Science 0.1 58.7% 52.6% 29.0% 64.6% 22.4%
OSWorld 2.0,partial 81.8% 80.7% 74.0% — —
Chartography,使用工具 89.0% 88.4% 83.4% — —

把差距和他们公布的误差放在一起看。Terminal-Bench 4.0 上,Opus 5.5 为 ±2.6 分,其他 Claude 模型为 ±1.6 到 ±2 分。从 66.4% 到 Astra 的 57.9%、到 Fable 的 55.8%,都宽于这些误差。Terminal-Bench-Science 每个模型是 ±3.5 到 ±5 分。Astra 的 64.6% 对 Opus 5.5 的 58.7%,幅度接近这些误差的宽度,点估计上 Astra 在前。

AutomationBench 由 Zapier 运行。因为该次运行没有回退模型,防护介入算作失败。Anthropic 说实际分数会更高。印出的 40.0% 对 Astra 的 41.4% 是一个很接近的公布结果,点估计上 Astra 在前。GDPval-AA v2.1 是覆盖 44 个职业的真实专业任务 Elo:Opus 5.5 为 1846,Fable 5.1 为 1735,Opus 5 为 1708,Sol 为 1588,Astra 为 1542。

同一发布页的成本图上还有第二组分数,取的是默认 effort medium:FrontierCode 54.6%,CursorBench 52.5%。对比表印的是 54.4% 和 57.8%。把它们当成 Anthropic 在两种 effort 下的两个数字。图注还说,medium effort 下 FrontierCode 以大约五分之一的单任务成本超过 Astra 的最高分 53.3%,Terminal-Bench 则以大约 40% 的成本打平 Astra。这些是关于 Anthropic 自己测试装置的单任务成本说法。

表下那句话更值得留下:在 Anthropic 自己的使用里,Opus 5.5 和 Fable 5.1 的差距比分数看起来更窄,这个水平上的基准分差对真实任务的指导也更弱。发布页上的客户引语是挑选过的证词。它们可以提示该重放什么,不属于分数表。

它在当前模型格局里的位置

同一天落地了三件可以核对的变化。

Anthropic 说成“大多数任务达到 Fable 5.1 水平”的那类工作,现在有了一张 Opus 价格卡。标价是 $4 / $20,Fable 5.1 是 $10 / $50。缓存读取是 $0.20,Fable 是 $0.25,Opus 5 是 $0.50。团队自己的重放若同意这个判断,Fable 5.1 留给仍然失败的任务,循环本身交给 Opus 5.5。重放若不同意,表里已经写出公布的例外:科学 Agent 任务和 Zapier 的业务工作流,印出的数字由 Astra 领先。

默认值跟着价格一起动了。与这次发布同时更新的 Claude Code 模型配置,把 Opus 5.5 设为 Pro、Max、Team、Enterprise 和 Anthropic API 的默认模型,也是 Claude Platform on AWS、Amazon Bedrock 和 Google Cloud Agent Platform 的默认模型。Agent 产品里的默认值,比模型选择器里多一行更能带动流量。

防护边界下移到了 Opus。早先的 Opus 承接的是 Fable 分类器不愿回答的流量。Opus 5.5 带着一套相近的防护发布:网络安全任务由 Opus 4.8 完成,生物和前沿 LLM 开发任务由 Opus 5 完成。日志里请求 ID 记成 claude-opus-5-5,完成结果仍可能来自另一个模型。拒绝以 HTTP 200 返回,stop_reason 为 "refusal"。

Sonnet 5.5 已经在 2026 年 9 月 30 日的目录里,单位价格与 Sonnet 5 同为 $2 / $10。该响应没有 Haiku 5.5。已经列出来的更便宜 Claude 卡是 Sonnet 5.5、Sonnet 5 的 $2 / $10,以及 Haiku 4.5 的 $1 / $5。Haiku 4.5 仍是 200K 窗口。Sonnet 5.5 的分组见 Sonnet 5.5 评测。

这是一份可以从文档里审计的位置:标价、Claude Code 的默认模型、防护触发时由谁作答,以及厂商自己的表里仍由 Astra 领先的行。这里没有市场份额的说法。

接入时的约束

会直接返回 400 的请求

只替换模型字符串的客户端,仍会撞上文档为“跑在 Opus 5 上的代码”列出的四处破坏性变更。前三处同样适用于 Fable 5.1。下面是迁移说明要求发送的形状。注释标出返回 invalid_request_error 的变体。

model: claude-opus-5-5
thinking: {"type": "adaptive"}
tool_choice: {"type": "auto"}
output_config.effort: medium
# 400: thinking 类型为 disabled,或 enabled 且带 budget_tokens
# 400: tool_choice 为 any,或 tool_choice 为 tool
# 400,限于 Claude API 与 Google Cloud:工具类型 computer_20251124

深度取代了过去的思考开关。省略 thinking,或发送 adaptive。effort 要显式设置。tool_choice 的 auto 和 none 仍然有效,计数 token 的端点也一样。要得到符合 schema 的 JSON,迁移说明指向严格工具调用或结构化输出,并在提示词里写明何时调用工具。

在 Claude API 和 Google Cloud 上,用 computer_toolset_20260801 工具集替换 computer_20251124,并去掉旧的计算机使用 beta 头。Amazon Bedrock 上的 Opus 5.5 仍接受 computer_20251124。已经使用该工具集的浏览器操作集成,不必为这一处破坏性变更改代码。

2026 年 8 月 31 日及之后创建的账号,若重放时改了 Opus 5.5 思考块前面的前缀,就是第四处 400。对话保持只追加。

请求成功、行为仍然变了

省略 effort 现在会跑在 medium。同样的省略在 Opus 5 上跑的是 high。effort 对齐之后,Opus 5.5 每一轮往往比 Opus 5 思考得更多,在 xhigh 和 max 上尤其明显。从 Opus 5 配置里抄过来的 effort 值是一个新的成本点。max_tokens 要给思考块留出空间。

工具调用之间写下的文字,回到思考块里。默认 display 值是 omitted 时,这些块是空的。过去会把这段文字流式展示出来的界面会变静,请求本身仍然成功。产品需要这些进度行时,设置一个 display 值。

生物分类器和网络安全分类器一起运行。把模型推向“把推理抄进可见回答”的提示,可能以 reasoning_extraction 被拒绝。提示指南说,图表和截图在加上视觉工具之前就已经读得更准,因此过去用来弥补读图偏弱的提示词,值得单独重放。

哪些负载值得先评测

把 Opus 5.5 放在发布页写得很具体的工作上重放:跨多个文件的修改、带着仓库自己测试的迁移、按来源评分的研究备忘录,以及可以跑两遍的计算机操作流程。记下请求的模型、实际作答的模型、effort、输入 token、缓存读取 token、输出 token、墙钟时间、重试和人工修改。Anthropic 的“大约低 40%”和“大约五分之一成本”说的是他们的测试装置,替代不了这张记录表。

重放仍然输掉的任务,继续用 Fable 5.1,或一条明确的回退。网络安全防护会移交的流量,按 Opus 4.8 来准备;生物和前沿模型开发上防护会移交的流量,按 Opus 5 来准备。任务适合 $2 / $10 这张卡、又不需要 Opus 循环时,继续用 Sonnet 5.5 或 Sonnet 5。

在 Modelflare 上,这个档位发送 claude-opus-5-5。2026 年 9 月 30 日这一行启用三个公开分组:失败代价高时用 claude-premium 0.5,日常生产用 claude-stable 0.315,调用可以重试时用 claude-award 0.25。claude-tmp-cheap 没有启用在这个模型上。claude-stable 的用户价格是每百万输入 token $1.26、每百万输出 token $6.30。

资料来源