Claude Opus 5.5: thông số, giá và vị trí trong ngành

Bản ghi có nguồn về Claude Opus 5.5: thông số đã công bố, giá token chính thức, cách đọc bảng benchmark so với Fable 5.1, Opus 5 và GPT-6 Astra, cùng nhóm công khai và giá người dùng trong danh mục Modelflare ngày 30 tháng 9 năm 2026.

Claude Opus 5.5 được phát hành vào ngày 22 tháng 9 năm 2026. Hợp đồng công khai nằm trên trang mô hình và trong phần cập nhật: ID API là claude-opus-5-5, ngữ cảnh 1M token, đầu ra tối đa 128K, suy nghĩ thích ứng luôn bật, effort mặc định là medium, giá niêm yết là $4 cho mỗi một triệu token đầu vào và $20 cho mỗi một triệu token đầu ra. Các trang của Anthropic không đưa số tham số, cũng không đưa lượng tính toán huấn luyện. Bài viết này chỉ dùng thông số đã công bố, bảng giá đã công bố và bảng benchmark đã công bố.

Kết luận sau khi đối chiếu: theo giá niêm yết trên trang Anthropic, Opus 5.5 là bậc Opus hiện tại. Tính theo token, nó rẻ hơn Opus 5, và rẻ hơn nhiều so với Fable 5.1. Trên các dòng lập trình và công việc tri thức mà Anthropic in ra, điểm của nó dẫn Fable 5.1, Opus 5, và trên hầu hết các dòng đó cũng dẫn GPT-6 Astra. Hai dòng in ra đi ngược lại: Astra dẫn Terminal-Bench-Science 0.1 và AutomationBench của Zapier. API giá của Modelflare, đọc ngày 30 tháng 9 năm 2026, đã có claude-opus-5-5, đơn giá khớp mức chính thức $4 / $20. Dòng này mở các nhóm công khai claude-award 0.25, claude-stable 0.315 và claude-premium 0.5. Key của bậc này nên gửi claude-opus-5-5. Giá thời gian thực xem trang giá.

Hành vi chính thức bên dưới được trích từ trang mô hình Opus 5.5, phần cập nhật và trang ra mắt. Chi tiết migration của Fable 5.1 xem bài đã có trên blog này: Bài đánh giá Fable 5.1.

Thông số đã công bố

Hạng mục Claude Opus 5.5
ID mô hình, Claude API claude-opus-5-5
ID Amazon Bedrock anthropic.claude-opus-5-5
ID Google Cloud và Microsoft Foundry claude-opus-5-5
Ngày phát hành 22 tháng 9 năm 2026
Cửa sổ ngữ cảnh 1M token, mặc định cũng là mức tối đa
Đầu ra tối đa 128K token
Suy nghĩ Thích ứng, luôn bật
Effort mặc định medium
Hạng độ trễ trên trang mô hình Trung bình
Mốc kiến thức đáng tin Tháng 6 năm 2026
Số tham số Trang mô hình công khai không nêu

“Mốc kiến thức đáng tin” là cách Anthropic gọi ngày mà kiến thức đã có của mô hình phủ đầy nhất. Nó và cửa sổ ngữ cảnh là hai việc khác nhau. Tệp đính kèm trong yêu cầu vẫn nằm trong ngữ cảnh của lần này.

Fast mode là công tắc tốc độ trên cùng một ID mô hình; tài liệu gắn nó là bản xem trước nghiên cứu chỉ có trên Claude API. Yêu cầu dùng speed: "fast" và kèm header beta fast-mode-2026-02-01. Anthropic định giá chế độ này $8 / $40 mỗi một triệu token, và viết tốc độ đầu ra nhanh hơn tới khoảng 2.5 lần. Phần cập nhật nói rõ: Amazon Bedrock, Claude Platform on AWS, Google Cloud và Microsoft Foundry không có fast mode này.

Cùng trang đó ghi thang effort là mục điều khiển độ sâu suy nghĩ: low, medium, high, xhigh và max. Ngân sách suy nghĩ chỉ định tay sẽ bị từ chối. Prompt có thể cache phải dài ít nhất 512 token.

Giá

Giá niêm yết chính thức

Đơn vị là đô la Mỹ cho mỗi một triệu token. Các dòng cache, batch và fast mode của Opus 5.5 lấy từ mục giá trong phần cập nhật. Ô ghi cache của Opus 5 là con số “cache writes” duy nhất trên bảng so sánh của trang ra mắt; bảng đó không tách bậc 5 phút và bậc 1 giờ. Đọc cache của Fable 5.1 dùng số chính thức đã có trong bài đánh giá Fable 5.1 trên blog này. Giá đầu vào và đầu ra của Sonnet 5 và Haiku 4.5 lấy từ dòng so sánh trên trang mô hình Opus 5.5. Dấu gạch dài nghĩa là bài viết này không lấy ô đó từ một dòng giá nguồn.

Giá mỗi 1M token Opus 5.5 Opus 5 Fable 5.1 Sonnet 5 Haiku 4.5
Đầu vào $4 $5 $10 $2 $1
Đầu ra $20 $25 $50 $10 $5
Đọc cache $0.20 $0.50 $0.25 — —
Ghi cache 5 phút $5; 1 giờ $8 $6.25 — — —
Đầu vào / đầu ra batch $2 / $10 — — — —
Đầu vào / đầu ra fast mode $8 / $40 — — — —

So với Opus 5, giá niêm yết của đầu vào và đầu ra mới giảm 20%, từ $5 / $25 xuống $4 / $20. Đọc cache, phần chiếm tỷ trọng cao hơn trong vòng lặp agent dài, giảm từ $0.50 xuống $0.20. Đó là thấp hơn 60% so với giá đọc cache của Opus 5, và cũng nằm dưới mức đọc cache $0.25 của Fable 5.1. Anthropic còn một nhận định về tải: ở thiết lập mặc định, một tác vụ điển hình tốn ít hơn khoảng 40% so với Opus 5, vì mô hình cũng dùng ít token hơn. Mức 40% đó mô tả thiết bị thử của chính họ. Hóa đơn thật vẫn phụ thuộc effort, tỷ lệ trúng cache và số vòng công cụ.

Xử lý batch bằng một nửa giá niêm yết mới. Fast mode bằng hai lần giá niêm yết mới, và chỉ có trên Claude API.

Danh mục Modelflare ngày 30 tháng 9 năm 2026

GET https://modelflare.dev/api/pricing đọc ngày 30 tháng 9 năm 2026 có claude-opus-5-5. Cùng phản hồi đó còn có claude-opus-5, claude-fable-5-1, claude-sonnet-5, claude-sonnet-5-5, claude-haiku-4-5, gpt-6-astra và gpt-5.6-sol. Trong đó không có ID của Haiku 5.5.

Đơn giá trong bảng dưới là giá token trong phản hồi đó, trước khi nhân hệ số nhóm. Các dòng Claude khớp giá niêm yết chính thức. Astra và Sol chia bậc: khi ngữ cảnh đầu vào vượt 272,000 token thì dùng cặp giá thứ hai, và giá đầu ra của ngữ cảnh dài là giá đầu ra riêng của bậc đó. Ở cột ví dụ, dòng Claude nhân claude-stable 0.315, dòng OpenAI nhân openai-stable 0.08. Hệ số Claude ở lần đọc này là claude-premium 0.5, claude-stable 0.315 và claude-award 0.25. Hệ số OpenAI là openai-premium 0.13, openai-stable 0.08 và openai-award 0.03. Opus 5.5 chỉ bật ba nhóm Claude ở trên. claude-tmp-cheap là một nhóm Claude công khai, và dòng mô hình này không bật nó.

Mô hình ID danh mục Đầu vào / đầu ra đơn vị Giá người dùng trên nhóm stable
Opus 5.5 claude-opus-5-5 $4 / $20 $1.26 / $6.30
Opus 5 claude-opus-5 $5 / $25 $1.575 / $7.875
Fable 5.1 claude-fable-5-1 $10 / $50 $3.15 / $15.75
Sonnet 5 claude-sonnet-5 $2 / $10 $0.63 / $3.15
GPT-6 Astra gpt-6-astra $10 / $50, sau đó $20 / $75 $0.80 / $4.00, sau đó $1.60 / $6.00
GPT-5.6 Sol gpt-5.6-sol $5 / $30, sau đó $10 / $45 $0.40 / $2.40, sau đó $0.80 / $3.60

Opus 5.5 trên claude-stable là $4 × 0.315 và $20 × 0.315. Khi so với các lab khác thì xem bảng chính thức. Khi đọc hóa đơn Modelflare có thể gửi ngay hôm nay thì xem bảng danh mục.

Haiku 4.5 cũng nằm trong cùng danh mục, đơn giá $1 / $5. Trên claude-stable là $0.315 / $1.575. Phần so sánh trên trang mô hình vẫn cho Haiku ngữ cảnh 200K và đầu ra tối đa 64K. Phản hồi ngày 30 tháng 9 năm 2026 không có Haiku 5.5. Haiku 4.5 vẫn là đầu giá thấp của dòng Claude đang thực sự được liệt kê.

Hệ số cache trên các dòng danh mục là một phân số của đơn giá đầu vào: Opus 5.5 là 0.05, nên đọc cache trong danh mục là $0.20 và ghi cache trong danh mục là $5. Mức ghi này khớp bậc 5 phút chính thức. Mức ghi 1 giờ chính thức là $8, và danh mục không có giá riêng cho bậc đó. Opus 5 và Sonnet 5 dùng 0.1, Fable 5.1 dùng 0.025. Cache, ngữ cảnh dài và bậc ưu tiên lấy theo trang giá cùng bản ghi sử dụng sau khi hoàn tất.

Đã đổi gì so với Opus 5 và Fable 5.1

Hành vi Opus 5.5 Opus 5 Fable 5.1
ID API claude-opus-5-5 claude-opus-5 claude-fable-5-1
Ngữ cảnh / đầu ra tối đa 1M / 128K 1M / 128K 1M / 128K
Suy nghĩ Luôn bật. disabled và ngân sách đặt tay trả về 400 Bật theo mặc định. Chỉ nhận disabled khi effort là high hoặc thấp hơn Luôn bật
Mặc định khi bỏ trường effort medium high high
Mốc kiến thức đáng tin Tháng 6 năm 2026 Tháng 5 năm 2026 Tháng 6 năm 2026
Đầu vào / đầu ra niêm yết $4 / $20 $5 / $25 $10 / $50
Đọc cache $0.20 $0.50 $0.25
Chọn công cụ bắt buộc any và tool trả về 400 Được liệt kê là thay đổi phá vỡ tương thích so với Opus 5 Cùng trả về 400 như Opus 5.5
Bảo vệ an ninh mạng Giao tác vụ cho Opus 4.8 Ghi chú phát hành không đặt fallback này lên Opus 5 Bảo vệ cấp Fable
Bảo vệ sinh học và LLM frontier Giao tác vụ cho Opus 5 Ghi chú phát hành viết fallback này cùng với Opus 5.5 Cùng loại bảo vệ

Opus 5.5 đọc được khối suy nghĩ do Opus 5 cùng các Opus, Sonnet và Haiku sớm hơn tạo ra. Nó không đọc khối suy nghĩ do Fable hoặc Mythos tạo ra. Trên Claude API, Fable 5.1 và Mythos 5.1 đọc được khối suy nghĩ của Opus 5.5; phần cập nhật viết rõ rằng các mô hình hiện tại khác thì không. Khối mà mô hình đích không đọc được sẽ bị bỏ trước khi mô hình nhìn thấy, và khối bị bỏ không bị tính phí.

Tài khoản tạo từ ngày 31 tháng 8 năm 2026 trở đi bị kiểm tra chặt hơn: nếu system prompt, danh sách công cụ hoặc một tin nhắn sớm hơn bị sửa sau khi khối suy nghĩ của Opus 5.5 đã được tạo, phát lại khối đó sẽ trả về 400. Cách trong hướng dẫn migration là lịch sử chỉ được nối thêm; khi chỉ dẫn bắt buộc phải đổi, dùng một system message ở giữa cuộc hội thoại. Trang ra mắt còn viết rằng Opus 5.5 có điều khiển giữ suy nghĩ được đưa vào từ Fable 5.1, thủy ấn theo Đạo luật AI của EU, và không lưu giữ dữ liệu, nhất quán với các Opus trước.

Cách đọc điểm trí tuệ

Bảng dưới đây chính là bảng được in trên trang ra mắt. Anthropic nói, trừ khi chú thích nói khác, Opus 5.5 dùng suy nghĩ thích ứng và effort là max. Terminal-Bench 4.0 là chú thích đó: Opus 5.5 dùng xhigh, GPT-6 Astra dùng high, mỗi bên lấy điểm cao nhất đã công bố của mô hình đó. Số của Astra và Sol được trích theo báo cáo của OpenAI. Bảo vệ trên sản xuất đang bật. Khi bảo vệ can thiệp, tác vụ an ninh mạng do Opus 4.8 hoàn thành, còn tác vụ sinh học và phát triển LLM frontier do Opus 5 hoàn thành. Anthropic nói điều đó kéo điểm của Opus 5.5 xuống.

Benchmark Opus 5.5 Fable 5.1 Opus 5 GPT-6 Astra GPT-5.6 Sol
Terminal-Bench 4.0 66.4% 55.8% 52.3% 57.9% 37.3%
FrontierCode v1.1 (Main) 54.4% 50.3% 48.0% 53.3% 47.5%
CursorBench 4.0 57.8% 51.8% 46.6% — 41.7%
GDPval-AA v2.1 1846 1735 1708 1542 1588
AutomationBench 40.0% 31.4% 26.9% 41.4% 28.8%
Humanity's Last Exam, có công cụ 67.7% 65.6% 63.6% 57.2% —
Terminal-Bench-Science 0.1 58.7% 52.6% 29.0% 64.6% 22.4%
OSWorld 2.0, partial 81.8% 80.7% 74.0% — —
Chartography, có công cụ 89.0% 88.4% 83.4% — —

Đặt khoảng cách cạnh sai số họ đã công bố. Trên Terminal-Bench 4.0, Opus 5.5 là ±2.6 điểm, các mô hình Claude khác là ±1.6 đến ±2 điểm. Từ 66.4% tới 57.9% của Astra, và tới 55.8% của Fable, đều rộng hơn các sai số đó. Terminal-Bench-Science mỗi mô hình là ±3.5 đến ±5 điểm. 64.6% của Astra so với 58.7% của Opus 5.5 có độ lớn gần bằng bề rộng của các sai số này, và trên ước lượng điểm đã in thì Astra đứng trước.

AutomationBench do Zapier chạy. Vì lần chạy đó không có mô hình fallback, việc bảo vệ can thiệp được tính là thất bại. Anthropic nói điểm thực tế sẽ cao hơn. 40.0% đã in so với 41.4% của Astra là một kết quả công bố rất sát, và trên ước lượng điểm thì Astra đứng trước. GDPval-AA v2.1 là Elo của các tác vụ chuyên môn thật trên 44 nghề: Opus 5.5 là 1846, Fable 5.1 là 1735, Opus 5 là 1708, Sol là 1588, Astra là 1542.

Cùng trang ra mắt, biểu đồ chi phí còn in một cặp điểm thứ hai, lấy ở effort mặc định medium: FrontierCode 54.6% và CursorBench 52.5%. Bảng so sánh in 54.4% và 57.8%. Hãy coi chúng là hai con số của Anthropic ở hai mức effort. Chú thích hình còn nói, ở medium effort, FrontierCode vượt điểm cao nhất 53.3% của Astra với khoảng một phần năm chi phí mỗi tác vụ, còn Terminal-Bench hòa Astra với khoảng 40% chi phí. Đó là các nhận định chi phí mỗi tác vụ về thiết bị thử của chính Anthropic.

Câu dưới bảng đáng giữ hơn: trong cách Anthropic tự dùng, khoảng cách giữa Opus 5.5 và Fable 5.1 hẹp hơn mức điểm cho thấy, và chênh benchmark ở mức này cũng dẫn đường yếu hơn cho một tác vụ thật. Lời khách hàng trên trang ra mắt là chứng từ đã được chọn. Chúng có thể gợi ý nên phát lại gì, và không thuộc bảng điểm.

Vị trí của nó giữa các mô hình hiện tại

Cùng ngày đã có ba thay đổi có thể đối chiếu.

Loại việc mà Anthropic gọi là “hầu hết tác vụ đạt mức Fable 5.1” nay có một thẻ giá Opus. Giá niêm yết là $4 / $20, còn Fable 5.1 là $10 / $50. Đọc cache là $0.20, Fable là $0.25, Opus 5 là $0.50. Nếu lần phát lại của chính đội ngũ đồng ý nhận định này, hãy để Fable 5.1 cho các tác vụ vẫn thất bại, và giao vòng lặp cho Opus 5.5. Nếu lần phát lại không đồng ý, bảng đã ghi các ngoại lệ đã công bố: tác vụ agent khoa học và quy trình nghiệp vụ của Zapier, nơi số đã in do Astra dẫn.

Giá trị mặc định đi cùng với giá. Cấu hình mô hình của Claude Code, cập nhật cùng lần phát hành này, đặt Opus 5.5 làm mô hình mặc định cho Pro, Max, Team, Enterprise và Anthropic API, và cũng là mặc định của Claude Platform on AWS, Amazon Bedrock và Google Cloud Agent Platform. Mặc định bên trong sản phẩm agent kéo lưu lượng nhiều hơn là thêm một dòng trong bộ chọn mô hình.

Ranh giới bảo vệ dịch xuống Opus. Các Opus trước nhận lưu lượng mà bộ phân loại Fable không chịu trả lời. Opus 5.5 ra mắt với một bộ bảo vệ gần giống: tác vụ an ninh mạng do Opus 4.8 hoàn thành, tác vụ sinh học và phát triển LLM frontier do Opus 5 hoàn thành. Trong nhật ký, ID yêu cầu được ghi là claude-opus-5-5, nhưng kết quả hoàn thành vẫn có thể đến từ một mô hình khác. Từ chối trả về HTTP 200 với stop_reason: "refusal".

Sonnet 5.5 đã có trong danh mục ngày 30 tháng 9 năm 2026, đơn giá cùng Sonnet 5 là $2 / $10. Phản hồi đó không có Haiku 5.5. Các thẻ Claude rẻ hơn đã được liệt kê là Sonnet 5.5, Sonnet 5 ở $2 / $10, và Haiku 4.5 ở $1 / $5. Haiku 4.5 vẫn ở cửa sổ 200K. Nhóm của Sonnet 5.5 xem bài đánh giá Sonnet 5.5.

Đây là một vị trí có thể kiểm từ tài liệu: giá niêm yết, mô hình mặc định của Claude Code, mô hình nào trả lời khi bảo vệ kích hoạt, và những dòng nào trên bảng của nhà cung cấp vẫn do Astra dẫn. Ở đây không có nhận định về thị phần.

Ràng buộc khi tích hợp

Yêu cầu trả về 400 ngay

Client chỉ thay chuỗi mô hình vẫn đụng bốn chỗ phá vỡ tương thích mà tài liệu liệt kê cho “mã đang chạy trên Opus 5”. Ba chỗ đầu cũng áp dụng cho Fable 5.1. Hình dạng bên dưới là hình dạng phần migration yêu cầu gửi. Chú thích đánh dấu các biến thể trả về invalid_request_error.

model: claude-opus-5-5
thinking: {"type": "adaptive"}
tool_choice: {"type": "auto"}
output_config.effort: medium
# 400: kiểu thinking là disabled, hoặc enabled kèm budget_tokens
# 400: tool_choice là any, hoặc tool_choice là tool
# 400, chỉ trên Claude API và Google Cloud: loại công cụ computer_20251124

Độ sâu thay cho công tắc suy nghĩ bật tắt trước đây. Bỏ thinking, hoặc gửi adaptive. Effort phải đặt tường minh. auto và none của tool_choice vẫn hợp lệ, kể cả trên endpoint đếm token. Để có JSON đúng schema, phần migration chỉ tới strict tool use hoặc structured outputs, và viết trong prompt khi nào thì gọi công cụ.

Trên Claude API và Google Cloud, thay computer_20251124 bằng bộ công cụ computer_toolset_20260801, và bỏ header beta computer-use cũ. Opus 5.5 trên Amazon Bedrock vẫn nhận computer_20251124. Tích hợp thao tác trình duyệt đã dùng bộ công cụ này không cần sửa mã cho chỗ phá vỡ này.

Với tài khoản tạo từ ngày 31 tháng 8 năm 2026 trở đi, nếu lúc phát lại mà sửa tiền tố đứng trước khối suy nghĩ của Opus 5.5, đó là chỗ 400 thứ tư. Giữ hội thoại chỉ được nối thêm.

Lời gọi thành công nhưng hành vi vẫn đổi

Bỏ effort giờ sẽ chạy ở medium. Cùng cách bỏ đó trên Opus 5 chạy ở high. Sau khi khớp effort, mỗi lượt Opus 5.5 thường suy nghĩ nhiều hơn Opus 5, nhất là ở xhigh và max. Giá trị effort chép từ cấu hình Opus 5 là một điểm chi phí mới. max_tokens phải chừa chỗ cho các khối suy nghĩ.

Chữ viết giữa các lần gọi công cụ quay về trong khối suy nghĩ. Khi giá trị display mặc định là omitted, các khối đó trống. Giao diện từng phát trực tiếp đoạn chữ đó sẽ im, còn yêu cầu vẫn thành công. Khi sản phẩm cần các dòng tiến độ, hãy đặt một giá trị display.

Bộ phân loại sinh học chạy cùng bộ phân loại an ninh mạng. Prompt đẩy mô hình tới chỗ “chép suy luận vào câu trả lời nhìn thấy được” có thể bị từ chối dưới reasoning_extraction. Hướng dẫn prompt nói biểu đồ và ảnh chụp màn hình đã được đọc chính xác hơn trước khi thêm bất kỳ công cụ thị giác nào, nên những prompt cũ từng dùng để bù phần đọc biểu đồ yếu đáng được phát lại riêng.

Nên đánh giá tải nào trước

Hãy phát lại Opus 5.5 trên những việc trang ra mắt viết rất cụ thể: sửa đổi trải nhiều tệp, một migration mang theo test của chính kho, một bản ghi nhớ nghiên cứu được chấm theo nguồn, và một quy trình thao tác máy tính có thể chạy hai lần. Ghi lại mô hình được yêu cầu, mô hình thực sự trả lời, effort, token đầu vào, token đọc cache, token đầu ra, thời gian đồng hồ tường, số lần thử lại và sửa tay. “Thấp hơn khoảng 40%” và “khoảng một phần năm chi phí” của Anthropic nói về thiết bị thử của họ, không thay được tờ ghi này.

Với tác vụ mà lần phát lại vẫn thua, tiếp tục dùng Fable 5.1, hoặc một fallback rõ ràng. Lưu lượng mà bảo vệ an ninh mạng sẽ chuyển giao thì chuẩn bị theo Opus 4.8; lưu lượng sinh học và phát triển mô hình frontier mà bảo vệ sẽ chuyển giao thì chuẩn bị theo Opus 5. Khi tác vụ hợp thẻ $2 / $10 và không cần vòng lặp Opus, tiếp tục dùng Sonnet 5.5 hoặc Sonnet 5.

Trên Modelflare, bậc này gửi claude-opus-5-5. Dòng ngày 30 tháng 9 năm 2026 bật ba nhóm công khai: dùng claude-premium 0.5 khi một lời gọi thất bại thì đắt, dùng claude-stable 0.315 cho sản xuất hằng ngày, và dùng claude-award 0.25 khi lời gọi có thể thử lại. claude-tmp-cheap không được bật trên mô hình này. Trên claude-stable, giá người dùng là $1.26 cho mỗi một triệu token đầu vào và $6.30 cho mỗi một triệu token đầu ra.

Nguồn