Grok 4.6 正式發布:API、價格、500K 上下文與開發者指南
依官方資料核對 Grok 4.6 的精確模型 ID、500K 上下文、Token 價格、推理層級、API 範例、發布基準與正式環境遷移清單。
xAI 於 2026 年 8 月 12 日發布 Grok 4.6。官方開發者指南列出的 API 模型 ID 是 grok-4.6,上下文視窗為 500,000 Token,支援文字與圖片輸入、文字輸出,並提供 low、medium、high(預設)和 xhigh 四種推理強度。
對開發者而言,重要的不只是發布基準。Grok 4.6 同時支援 Responses API 與 Chat Completions;當 Prompt 達到 200,000 Token 時會進入長上下文計價;長時間運行的 Agent 還需要明確設定快取親和性並管理上下文。
本文嚴格區分 xAI 官方規格、供應商自行發布的基準結果,以及 Modelflare 目前的模型可用性。價格和可用性可能改變,下列時效性資訊核對於 2026 年 8 月 13 日。
Grok 4.6 核心規格
| 項目 | 官方資訊 |
|---|---|
| 發布日期 | 2026 年 8 月 12 日 |
| API 模型 ID | grok-4.6 |
| 上下文視窗 | 500,000 Token |
| 知識截止日期 | 2026 年 2 月 1 日 |
| 模態 | 文字與圖片輸入;文字輸出 |
| 文字輸出限制 | xAI 標示為沒有固定文字輸出上限 |
| 推理強度 | low、medium、high(預設)、xhigh |
| API 格式 | Responses API、Chat Completions |
| 文件列出的能力 | 函式呼叫、結構化輸出、網頁搜尋、X 搜尋、程式碼執行 |
「沒有固定文字輸出上限」是模型頁面的說明,並不代表任意 SDK、閘道、帳號或單次請求都能無限輸出。用戶端逾時、帳號限額、路由政策和可用上下文仍然有效。
相較 Grok 4.5 有哪些變化
xAI 將 Grok 4.6 定位為一次增量式前沿模型更新,重點提升長時間運行的 Agent,以及更複雜的互動與視覺工作。官方發布文介紹了更長的補充訓練、重新生成的監督微調軌跡,以及涵蓋知識工作、程式設計、網頁開發、核心最佳化與 CAD 的 Agent 強化學習。
實際遷移時值得評估的變化包括:
- 推理強度在 low、medium、high 之外新增
xhigh; - xAI 表示模型在多步驟研究、跨程式碼庫工作和迭代式應用建構中具有更好的連續性;
- 模型支援圖片與文字輸入,並輸出文字;
- 500K 上下文級別和標準 $2 輸入 / $6 輸出的起始價格不變,但 Grok 4.6 快取輸入目前為每百萬 Token $0.50,而 Grok 4.5 為 $0.30;
- xAI 建議長 Agent 迴圈使用會話級快取親和性與上下文壓縮。
這些變化代表應該進行受控遷移,而不是直接無條件替換 Grok 4.5。請在自己的工作負載上比較成功任務完成率、延遲、總 Token、工具呼叫次數和成本。
Grok 4.6 API 價格
xAI 價格頁面目前列出的標準美元價格如下,單位均為每百萬 Token:
| Prompt 大小 | 輸入 | 快取輸入 | 輸出 |
|---|---|---|---|
| 低於 200K Prompt Token | $2.00 | $0.50 | $6.00 |
| 達到或超過 200K Prompt Token | $4.00 | $1.00 | $12.00 |
xAI 表示,一旦 Prompt 達到 200K Token,該請求中的全部 Token 都按長上下文價格計算。三個例子可以具體呈現這個邊界:
- 100K 輸入加 5K 輸出,按短上下文標準價格約為 $0.23。
- 若 100K 輸入全部命中快取,相同輸出約為 $0.08。
- 220K 輸入加 10K 輸出跨過計價邊界,按所列長上下文價格約為 $1.00。
以上範例不包含伺服器端工具。xAI 目前對網頁搜尋、X 搜尋和程式碼執行另外收取每 1,000 次 $5。發布文還提到按標準價格兩倍計費的快速版本。制定預算前,請在 xAI 控制台確認精確模型、服務等級、地區可用性和即時價格。
如需完整成本方法,可閱讀如何計算 LLM Token 成本和AI API 成本追蹤。
透過 Responses 或 Chat Completions 呼叫 Grok 4.6
下列請求使用 xAI 官方 API 端點,因為本文是模型發布指南,不代表該模型已在所有閘道中啟用。
Responses API:
export XAI_API_KEY="<YOUR_XAI_API_KEY>"
curl -sS https://api.x.ai/v1/responses \
-H "Authorization: Bearer $XAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-4.6",
"input": "Review this migration plan, identify the three highest-risk assumptions, and propose verification steps.",
"prompt_cache_key": "grok-46-migration-review"
}'
Chat Completions:
curl -sS https://api.x.ai/v1/chat/completions \
-H "Authorization: Bearer $XAI_API_KEY" \
-H "Content-Type: application/json" \
-H "x-grok-conv-id: grok-46-migration-review" \
-d '{
"model": "grok-4.6",
"messages": [
{
"role": "user",
"content": "Review this migration plan, identify the three highest-risk assumptions, and propose verification steps."
}
]
}'
Responses 使用 prompt_cache_key,Chat Completions 使用 x-grok-conv-id 請求標頭,以提高同一會話的快取親和性。請把這些識別碼當作營運中繼資料:在單一會話內保持穩定,不寫入金鑰或個人資料,也不要讓無關使用者共用同一值。
若你還在選擇兩種傳輸格式,可以閱讀 Responses API 與 Chat Completions 比較。
Prompt 快取與長 Agent 迴圈
500K 上下文視窗代表容量,不代表目標。每一輪都傳送完整歷史會增加延遲,也可能使整個請求進入長上下文價格層級。
對於持續運行的工作流程:
- 把穩定指令和可重用上下文放在 Prompt 開頭;
- 每個會話使用穩定的快取親和性識別碼;
- 分開記錄命中與未命中快取的輸入量;
- 在 Prompt 接近 200K Token 前壓縮或摘要舊輪次;
- 保留仍然權威的工具結果,移除重複的傳輸雜訊;
- 明確指定推理強度並比較任務成功率,不要預設 xhigh 一定更好;
- 按成功任務記錄狀態、延遲、輸入、快取輸入、輸出、工具呼叫和總成本。
上下文壓縮會改變模型看到的資訊。必須用原始狀態核對摘要,並保留權威 ID、約束、已作出的決定和尚未解決的錯誤。
正確理解發布基準
xAI 在發布公告中提供了以下 Grok 4.6 High 結果:
| 評測 | xAI 公布的 Grok 4.6 分數 |
|---|---|
| Artificial Analysis Intelligence Index | 61 |
| GDPVal-AA v2 | 1753 |
| CursorBench v3.2 | 69.9% |
| DeepSWE v1.1 | 65.9% |
| FrontierCode v1.1 Extended | 61.3% |
| APEX-Agents | 57.5% |
這些是供應商發布的首發結果,並非 Modelflare 獨立測試。評測工具、推理設定、工具權限、時間限制和評分版本都會影響可比性。可以用這張表篩選值得實測的工作負載,但不能將其解讀為通用品質排名或正式環境效果保證。
正式環境遷移檢查清單
在把正式流量切換至 Grok 4.6 之前:
- 使用精確的
grok-4.6模型 ID,並拒絕靜默別名替換; - 確認目標帳號、地區、API 格式和服務等級已啟用該模型;
- 使用固定且不含隱私資料的評測集同時回放 Grok 4.5 與 Grok 4.6;
- 依業務實際使用範圍,分別測試文字輸入、圖片輸入、函式呼叫、結構化輸出、串流、拒絕路徑與取消;
- 比較 low、medium、high、xhigh 的成功任務成本與延遲;
- 分別測試剛低於和剛高於 200K Prompt 邊界的請求;
- 核對快取命中、上下文壓縮、工具呼叫次數、重試行為和重複副作用保護;
- 保留回復路由,並記錄每個請求最終使用的模型、路由、用量、延遲和費用。
HTTP 200 只證明某一次請求完成,不能證明功能完全相容、延遲穩定、工具行為正確或成本可接受。路由級檢查可參考 OpenAI 相容 API 符合性測試和可靠的 AI API 路由。
Grok 4.6 在 Modelflare 可用嗎
可以使用。在 2026 年 8 月 13 日的生產環境複核中,Modelflare 公開模型與價格目錄已列出精確模型 ID grok-4.6,可選 grok-award 與 grok-stable 群組;目錄顯示支援 OpenAI 相容的 Chat Completions 和 Responses API 路由。
當時頁面顯示的群組倍率為:grok-award 0.03x、grok-stable 0.06x。群組權限、路由、價格和可用性都可能改變。由於 xAI 另有長上下文價格層級,不要把一個宣傳倍率或短上下文範例直接套用到所有請求。請以即時價格頁面和已完成請求的費用記錄為目前真相。
請建立或更新 API Key 並選擇可用群組,使用精確的 grok-4.6 ID,先完成一次真實且不含敏感資訊的請求,再遷移正式流量。目錄上架證明公開設定已存在,但不代表 Modelflare 的獨立品質測試,也不保證每個 API Key 都有權限。
官方來源與更新記錄
主要來源:
更新記錄:
- 2026 年 8 月 13 日: 首次發布。已核對官方規格、價格、API 格式、發布基準和 Modelflare 模型目錄可用性。