Grok 4.6 正式發布:API、價格、500K 上下文與開發者指南

依官方資料核對 Grok 4.6 的精確模型 ID、500K 上下文、Token 價格、推理層級、API 範例、發布基準與正式環境遷移清單。

xAI 於 2026 年 8 月 12 日發布 Grok 4.6官方開發者指南列出的 API 模型 ID 是 grok-4.6,上下文視窗為 500,000 Token,支援文字與圖片輸入、文字輸出,並提供 low、medium、high(預設)和 xhigh 四種推理強度。

對開發者而言,重要的不只是發布基準。Grok 4.6 同時支援 Responses API 與 Chat Completions;當 Prompt 達到 200,000 Token 時會進入長上下文計價;長時間運行的 Agent 還需要明確設定快取親和性並管理上下文。

本文嚴格區分 xAI 官方規格、供應商自行發布的基準結果,以及 Modelflare 目前的模型可用性。價格和可用性可能改變,下列時效性資訊核對於 2026 年 8 月 13 日。

Grok 4.6 核心規格

項目 官方資訊
發布日期 2026 年 8 月 12 日
API 模型 ID grok-4.6
上下文視窗 500,000 Token
知識截止日期 2026 年 2 月 1 日
模態 文字與圖片輸入;文字輸出
文字輸出限制 xAI 標示為沒有固定文字輸出上限
推理強度 low、medium、high(預設)、xhigh
API 格式 Responses API、Chat Completions
文件列出的能力 函式呼叫、結構化輸出、網頁搜尋、X 搜尋、程式碼執行

「沒有固定文字輸出上限」是模型頁面的說明,並不代表任意 SDK、閘道、帳號或單次請求都能無限輸出。用戶端逾時、帳號限額、路由政策和可用上下文仍然有效。

相較 Grok 4.5 有哪些變化

xAI 將 Grok 4.6 定位為一次增量式前沿模型更新,重點提升長時間運行的 Agent,以及更複雜的互動與視覺工作。官方發布文介紹了更長的補充訓練、重新生成的監督微調軌跡,以及涵蓋知識工作、程式設計、網頁開發、核心最佳化與 CAD 的 Agent 強化學習。

實際遷移時值得評估的變化包括:

  • 推理強度在 low、medium、high 之外新增 xhigh
  • xAI 表示模型在多步驟研究、跨程式碼庫工作和迭代式應用建構中具有更好的連續性;
  • 模型支援圖片與文字輸入,並輸出文字;
  • 500K 上下文級別和標準 $2 輸入 / $6 輸出的起始價格不變,但 Grok 4.6 快取輸入目前為每百萬 Token $0.50,而 Grok 4.5 為 $0.30;
  • xAI 建議長 Agent 迴圈使用會話級快取親和性與上下文壓縮。

這些變化代表應該進行受控遷移,而不是直接無條件替換 Grok 4.5。請在自己的工作負載上比較成功任務完成率、延遲、總 Token、工具呼叫次數和成本。

Grok 4.6 API 價格

xAI 價格頁面目前列出的標準美元價格如下,單位均為每百萬 Token:

Prompt 大小 輸入 快取輸入 輸出
低於 200K Prompt Token $2.00 $0.50 $6.00
達到或超過 200K Prompt Token $4.00 $1.00 $12.00

xAI 表示,一旦 Prompt 達到 200K Token,該請求中的全部 Token 都按長上下文價格計算。三個例子可以具體呈現這個邊界:

  • 100K 輸入加 5K 輸出,按短上下文標準價格約為 $0.23
  • 若 100K 輸入全部命中快取,相同輸出約為 $0.08
  • 220K 輸入加 10K 輸出跨過計價邊界,按所列長上下文價格約為 $1.00

以上範例不包含伺服器端工具。xAI 目前對網頁搜尋、X 搜尋和程式碼執行另外收取每 1,000 次 $5。發布文還提到按標準價格兩倍計費的快速版本。制定預算前,請在 xAI 控制台確認精確模型、服務等級、地區可用性和即時價格。

如需完整成本方法,可閱讀如何計算 LLM Token 成本AI API 成本追蹤

透過 Responses 或 Chat Completions 呼叫 Grok 4.6

下列請求使用 xAI 官方 API 端點,因為本文是模型發布指南,不代表該模型已在所有閘道中啟用。

Responses API:

export XAI_API_KEY="<YOUR_XAI_API_KEY>"

curl -sS https://api.x.ai/v1/responses \
  -H "Authorization: Bearer $XAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-4.6",
    "input": "Review this migration plan, identify the three highest-risk assumptions, and propose verification steps.",
    "prompt_cache_key": "grok-46-migration-review"
  }'

Chat Completions:

curl -sS https://api.x.ai/v1/chat/completions \
  -H "Authorization: Bearer $XAI_API_KEY" \
  -H "Content-Type: application/json" \
  -H "x-grok-conv-id: grok-46-migration-review" \
  -d '{
    "model": "grok-4.6",
    "messages": [
      {
        "role": "user",
        "content": "Review this migration plan, identify the three highest-risk assumptions, and propose verification steps."
      }
    ]
  }'

Responses 使用 prompt_cache_key,Chat Completions 使用 x-grok-conv-id 請求標頭,以提高同一會話的快取親和性。請把這些識別碼當作營運中繼資料:在單一會話內保持穩定,不寫入金鑰或個人資料,也不要讓無關使用者共用同一值。

若你還在選擇兩種傳輸格式,可以閱讀 Responses API 與 Chat Completions 比較

Prompt 快取與長 Agent 迴圈

500K 上下文視窗代表容量,不代表目標。每一輪都傳送完整歷史會增加延遲,也可能使整個請求進入長上下文價格層級。

對於持續運行的工作流程:

  1. 把穩定指令和可重用上下文放在 Prompt 開頭;
  2. 每個會話使用穩定的快取親和性識別碼;
  3. 分開記錄命中與未命中快取的輸入量;
  4. 在 Prompt 接近 200K Token 前壓縮或摘要舊輪次;
  5. 保留仍然權威的工具結果,移除重複的傳輸雜訊;
  6. 明確指定推理強度並比較任務成功率,不要預設 xhigh 一定更好;
  7. 按成功任務記錄狀態、延遲、輸入、快取輸入、輸出、工具呼叫和總成本。

上下文壓縮會改變模型看到的資訊。必須用原始狀態核對摘要,並保留權威 ID、約束、已作出的決定和尚未解決的錯誤。

正確理解發布基準

xAI 在發布公告中提供了以下 Grok 4.6 High 結果:

評測 xAI 公布的 Grok 4.6 分數
Artificial Analysis Intelligence Index 61
GDPVal-AA v2 1753
CursorBench v3.2 69.9%
DeepSWE v1.1 65.9%
FrontierCode v1.1 Extended 61.3%
APEX-Agents 57.5%

這些是供應商發布的首發結果,並非 Modelflare 獨立測試。評測工具、推理設定、工具權限、時間限制和評分版本都會影響可比性。可以用這張表篩選值得實測的工作負載,但不能將其解讀為通用品質排名或正式環境效果保證。

正式環境遷移檢查清單

在把正式流量切換至 Grok 4.6 之前:

  1. 使用精確的 grok-4.6 模型 ID,並拒絕靜默別名替換;
  2. 確認目標帳號、地區、API 格式和服務等級已啟用該模型;
  3. 使用固定且不含隱私資料的評測集同時回放 Grok 4.5 與 Grok 4.6;
  4. 依業務實際使用範圍,分別測試文字輸入、圖片輸入、函式呼叫、結構化輸出、串流、拒絕路徑與取消;
  5. 比較 low、medium、high、xhigh 的成功任務成本與延遲;
  6. 分別測試剛低於和剛高於 200K Prompt 邊界的請求;
  7. 核對快取命中、上下文壓縮、工具呼叫次數、重試行為和重複副作用保護;
  8. 保留回復路由,並記錄每個請求最終使用的模型、路由、用量、延遲和費用。

HTTP 200 只證明某一次請求完成,不能證明功能完全相容、延遲穩定、工具行為正確或成本可接受。路由級檢查可參考 OpenAI 相容 API 符合性測試可靠的 AI API 路由

Grok 4.6 在 Modelflare 可用嗎

可以使用。在 2026 年 8 月 13 日的生產環境複核中,Modelflare 公開模型與價格目錄已列出精確模型 ID grok-4.6,可選 grok-awardgrok-stable 群組;目錄顯示支援 OpenAI 相容的 Chat Completions 和 Responses API 路由。

當時頁面顯示的群組倍率為:grok-award 0.03x、grok-stable 0.06x。群組權限、路由、價格和可用性都可能改變。由於 xAI 另有長上下文價格層級,不要把一個宣傳倍率或短上下文範例直接套用到所有請求。請以即時價格頁面和已完成請求的費用記錄為目前真相。

請建立或更新 API Key 並選擇可用群組,使用精確的 grok-4.6 ID,先完成一次真實且不含敏感資訊的請求,再遷移正式流量。目錄上架證明公開設定已存在,但不代表 Modelflare 的獨立品質測試,也不保證每個 API Key 都有權限。

官方來源與更新記錄

主要來源:

更新記錄:

  • 2026 年 8 月 13 日: 首次發布。已核對官方規格、價格、API 格式、發布基準和 Modelflare 模型目錄可用性。