Grok 4.6リリース:API料金、500Kコンテキスト、開発者ガイド
Grok 4.6の正確なモデルID、500Kコンテキスト、トークン料金、推論レベル、API例、公開ベンチマーク、本番移行チェックを公式情報で確認します。
xAIは2026年8月12日にGrok 4.6をリリースしました。公式開発者ガイドに記載されたAPIモデルIDはgrok-4.6です。コンテキストウィンドウは500,000トークンで、テキストと画像を入力し、テキストを出力します。推論強度はlow、medium、high(デフォルト)、xhighの4段階です。
開発者にとって重要なのは、公開ベンチマークだけではありません。Grok 4.6はResponses APIとChat Completionsの両方に対応し、プロンプトが200,000トークンに達すると長文コンテキスト料金へ移行します。長時間動くAgentでは、キャッシュのアフィニティとコンテキスト管理も明示的に設計する必要があります。
この記事では、xAIの公式仕様、プロバイダーが公開したベンチマーク、Modelflareにおける現在の利用可否を分けて説明します。料金と提供状況は変わる可能性があり、以下の変動情報は2026年8月13日に確認しました。
Grok 4.6の概要
| 項目 | 公式情報 |
|---|---|
| リリース日 | 2026年8月12日 |
| APIモデルID | grok-4.6 |
| コンテキストウィンドウ | 500,000トークン |
| 知識カットオフ | 2026年2月1日 |
| モダリティ | テキストと画像の入力、テキスト出力 |
| テキスト出力上限 | xAIは固定のテキスト出力上限なしと記載 |
| 推論強度 | low、medium、high(デフォルト)、xhigh |
| API形式 | Responses API、Chat Completions |
| 文書化された機能 | Function calling、Structured Outputs、Web検索、X検索、コード実行 |
「固定のテキスト出力上限なし」はモデルページの記述であり、すべてのSDK、ゲートウェイ、アカウント、リクエストで無制限に出力できるという保証ではありません。クライアントのタイムアウト、アカウント制限、ルートポリシー、利用可能なコンテキストは引き続き適用されます。
Grok 4.5から何が変わったか
xAIはGrok 4.6を、長時間稼働するAgentと、より高度なインタラクティブ・ビジュアル作業に重点を置いた段階的なフロンティアモデル更新と位置付けています。公式発表では、追加学習の延長、教師あり微調整トラジェクトリの再生成、ナレッジワーク、コーディング、Web開発、カーネル最適化、CADを含むAgent型強化学習が説明されています。
実際の移行で評価すべき変更点は次のとおりです。
- low、medium、highに加えて
xhigh推論が追加された。 - xAIは、複数段階の調査、コードベース全体の作業、反復的なアプリ構築で継続性が向上したと報告している。
- テキストに加えて画像を入力でき、出力はテキストである。
- 500Kコンテキスト区分と標準の入力$2/出力$6という開始価格は維持された一方、Grok 4.6のキャッシュ入力は100万トークン当たり$0.50で、現在掲載されているGrok 4.5の$0.30とは異なる。
- xAIは、長いAgentループで会話単位のキャッシュアフィニティとコンテキスト圧縮を推奨している。
これらは制御された移行を行う理由であり、Grok 4.5を無条件に置き換える理由ではありません。自社のワークロードで、タスク成功率、レイテンシ、総トークン、ツール呼び出し、コストを比較してください。
Grok 4.6 APIの料金
xAIの料金ページに掲載された標準の米ドル料金は、100万トークン当たり次のとおりです。
| プロンプトサイズ | 入力 | キャッシュ入力 | 出力 |
|---|---|---|---|
| 200Kプロンプトトークン未満 | $2.00 | $0.50 | $6.00 |
| 200Kプロンプトトークン以上 | $4.00 | $1.00 | $12.00 |
xAIによると、プロンプトが200Kトークンに達すると、そのリクエストの全トークンに長文コンテキスト料金が適用されます。境界を具体化する3つの計算例です。
- 入力100Kと出力5Kは、標準の短文コンテキスト料金で約**$0.23**です。
- 入力100Kがすべてキャッシュから返れば、同じ出力は約**$0.08**です。
- 入力220Kと出力10Kは境界を超え、掲載された長文コンテキスト料金で約**$1.00**です。
これらの例にサーバー側ツールは含まれません。xAIは現在、Web検索、X検索、コード実行をトークン料金に加えて1,000回当たり$5と掲載しています。発表では標準料金の2倍となる高速版にも言及しています。予算を決める前に、正確なモデル、サービス階層、地域での提供状況、最新料金をxAI Consoleで確認してください。
より一般的な計算方法は、LLMトークンコストの計算方法とAI APIコスト追跡を参照してください。
ResponsesまたはChat CompletionsでGrok 4.6を呼び出す
以下はxAIの公式APIエンドポイントを使います。この記事はリリースガイドであり、すべてのゲートウェイですでに有効という主張ではないためです。
Responses API:
export XAI_API_KEY="<YOUR_XAI_API_KEY>"
curl -sS https://api.x.ai/v1/responses \
-H "Authorization: Bearer $XAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-4.6",
"input": "Review this migration plan, identify the three highest-risk assumptions, and propose verification steps.",
"prompt_cache_key": "grok-46-migration-review"
}'
Chat Completions:
curl -sS https://api.x.ai/v1/chat/completions \
-H "Authorization: Bearer $XAI_API_KEY" \
-H "Content-Type: application/json" \
-H "x-grok-conv-id: grok-46-migration-review" \
-d '{
"model": "grok-4.6",
"messages": [
{
"role": "user",
"content": "Review this migration plan, identify the three highest-risk assumptions, and propose verification steps."
}
]
}'
Responsesではprompt_cache_key、Chat Completionsではx-grok-conv-idヘッダーを使い、同じ会話がキャッシュに到達しやすくします。これらは運用メタデータとして扱い、1会話内で安定させ、秘密情報や個人情報を含めず、無関係なユーザー間で同じ値を再利用しないでください。
2つの通信形式を選ぶ場合は、Responses APIとChat Completionsの比較も参照してください。
プロンプトキャッシュと長いAgentループ
500Kコンテキストウィンドウは容量であり、使い切る目標ではありません。毎回すべての履歴を送るとレイテンシが増え、リクエスト全体が長文コンテキスト料金へ移る可能性があります。
継続的なワークフローでは、次を実施します。
- 安定した指示と再利用するコンテキストをプロンプトの先頭に置く。
- 会話ごとに安定したキャッシュアフィニティ識別子を使う。
- キャッシュ済み入力と未キャッシュ入力を分けて測定する。
- プロンプトが200Kトークンに近づく前に古いターンを圧縮または要約する。
- 依然として正しいツール結果を保持し、重複した転送ノイズを除く。
- 推論強度を明示し、xhighが常に優れると仮定せずタスク成功率を比較する。
- 成功タスクごとにステータス、レイテンシ、入力、キャッシュ入力、出力、ツール呼び出し、総コストを記録する。
コンテキスト圧縮はモデルが見る情報を変えます。要約を元の状態と照合し、権威あるID、制約、決定事項、未解決エラーを保持してください。
公開ベンチマークを正しく読む
xAIは発表時に、Grok 4.6 Highについて次の結果を公開しました。
| 評価 | xAIが公開したGrok 4.6スコア |
|---|---|
| Artificial Analysis Intelligence Index | 61 |
| GDPVal-AA v2 | 1753 |
| CursorBench v3.2 | 69.9% |
| DeepSWE v1.1 | 65.9% |
| FrontierCode v1.1 Extended | 61.3% |
| APEX-Agents | 57.5% |
これはプロバイダーが公開したローンチ時の結果であり、Modelflareによる独立テストではありません。評価ハーネス、推論設定、ツールアクセス、時間制限、採点バージョンは比較可能性に影響します。テストすべきワークロードを選ぶ材料にはできますが、普遍的な品質順位や本番結果の保証にはできません。
本番移行チェックリスト
本番トラフィックをGrok 4.6へ切り替える前に:
- 正確な
grok-4.6モデルIDを使い、暗黙のエイリアス置換を拒否する。 - 対象アカウント、地域、API形式、サービス階層でモデルが有効か確認する。
- 固定かつプライバシーに配慮した評価セットをGrok 4.5とGrok 4.6で再実行する。
- 実際に使う範囲で、テキスト入力、画像入力、Function calling、Structured Outputs、ストリーミング、拒否経路、キャンセルを個別に試す。
- low、medium、high、xhighを、成功タスク当たりのコストとレイテンシで比較する。
- 200Kプロンプト境界の直前と直後をテストする。
- キャッシュヒット、コンテキスト圧縮、ツール呼び出し数、再試行、重複副作用の防止を確認する。
- ロールバック経路を残し、リクエストごとの最終モデル、ルート、使用量、レイテンシ、料金を記録する。
HTTP 200は1回のリクエストが完了したことしか証明しません。機能の同等性、安定したレイテンシ、正しいツール動作、許容できるコストの証明にはなりません。ルート単位の確認には、OpenAI互換APIの適合性テストと信頼できるAI APIルーティングを利用してください。
Grok 4.6はModelflareで利用できるか
利用できます。2026年8月13日の本番確認で、Modelflareの公開モデルと料金に正確なgrok-4.6モデルIDが掲載され、grok-awardとgrok-stableグループを選択できました。カタログにはOpenAI互換のChat CompletionsとResponses APIルートへの対応が表示されています。
確認時の表示倍率はgrok-awardが0.03x、grok-stableが0.06xでした。グループ権限、ルート、料金、提供状況は変わる可能性があります。xAIには別の長文コンテキスト料金もあるため、ひとつの訴求倍率や短文コンテキストの例をすべてのリクエストへ適用しないでください。最新の料金ページと完了したリクエストの費用記録を現在の正とします。
利用可能なグループでAPI Keyを作成または更新し、正確なgrok-4.6 IDを使い、機密情報を含まない実リクエストを1回完了してから本番トラフィックを移してください。カタログ掲載は公開設定の存在を示しますが、Modelflareによる独立品質評価でも、すべてのAPI Keyに対する保証でもありません。
公式情報源と更新履歴
一次情報:
更新履歴:
- 2026年8月13日: 初版公開。公式仕様、料金、API形式、公開ベンチマーク、Modelflareモデル一覧での利用可否を確認。