Grok 4.6 dirilis: API, harga, konteks 500K, dan panduan developer
Panduan Grok 4.6 yang diverifikasi dari ID model, konteks 500K, harga token, tingkat penalaran, contoh API, benchmark peluncuran, hingga daftar migrasi produksi.
xAI merilis Grok 4.6 pada 12 Agustus 2026. Panduan developer resmi mencantumkan ID model API grok-4.6, dengan jendela konteks 500.000 token, input teks dan gambar, output teks, serta empat tingkat upaya penalaran: low, medium, high (default), dan xhigh.
Bagi developer, detail terpenting bukan hanya skor peluncuran. Grok 4.6 bekerja dengan Responses API dan Chat Completions, memiliki batas harga konteks panjang pada 200.000 token prompt, serta membutuhkan afinitas cache dan pengelolaan konteks yang disengaja untuk agen yang berjalan lama.
Panduan ini memisahkan spesifikasi resmi xAI dari klaim benchmark yang diterbitkan penyedia dan dari ketersediaan saat ini di Modelflare. Harga dan ketersediaan dapat berubah; seluruh fakta yang mudah berubah di bawah ini diperiksa pada 13 Agustus 2026.
Ringkasan Grok 4.6
| Properti | Nilai resmi |
|---|---|
| Tanggal rilis | 12 Agustus 2026 |
| ID model API | grok-4.6 |
| Jendela konteks | 500.000 token |
| Batas pengetahuan | 1 Februari 2026 |
| Modalitas | Input teks dan gambar; output teks |
| Batas output teks | xAI mencantumkan tidak ada batas output teks tetap |
| Upaya penalaran | low, medium, high (default), xhigh |
| Format API | Responses API dan Chat Completions |
| Kemampuan terdokumentasi | Function calling, structured outputs, pencarian web, pencarian X, eksekusi kode |
“Tidak ada batas output teks tetap” adalah deskripsi pada halaman model, bukan janji bahwa setiap SDK, gateway, akun, atau permintaan dapat menghasilkan teks tanpa batas. Batas waktu klien, batas akun, kebijakan jalur, dan konteks yang tersedia tetap berlaku.
Perubahan dari Grok 4.5
xAI memosisikan Grok 4.6 sebagai pembaruan model frontier bertahap yang berfokus pada agen berdurasi panjang serta pekerjaan interaktif dan visual yang lebih ambisius. Pengumuman resmi menjelaskan pelatihan tambahan yang lebih lama, regenerasi lintasan supervised fine-tuning, dan reinforcement learning agentik untuk pekerjaan pengetahuan, coding, pengembangan web, optimasi kernel, dan CAD.
Perubahan praktis yang perlu dievaluasi adalah:
xhighditambahkan ke upaya penalaran low, medium, dan high;- xAI melaporkan kesinambungan yang lebih baik untuk riset bertahap, pekerjaan lintas codebase, dan pembangunan aplikasi secara iteratif;
- model menerima input gambar serta teks dan menghasilkan teks;
- kelas konteks 500K dan harga awal standar $2 input / $6 output tetap sama, tetapi harga cached input Grok 4.6 adalah $0,50 per satu juta token dibandingkan $0,30 yang kini tercantum untuk Grok 4.5;
- xAI menyarankan afinitas cache per percakapan dan pemadatan konteks untuk loop agen yang panjang.
Perubahan tersebut adalah alasan untuk menjalankan migrasi terkendali, bukan mengganti Grok 4.5 secara membabi buta. Bandingkan keberhasilan tugas, latensi, total token, panggilan alat, dan biaya pada beban kerja Anda sendiri.
Harga API Grok 4.6
Halaman harga xAI mencantumkan harga standar dalam dolar AS berikut per satu juta token:
| Ukuran prompt | Input | Cached input | Output |
|---|---|---|---|
| Di bawah 200K token prompt | $2.00 | $0.50 | $6.00 |
| 200K token prompt atau lebih | $4.00 | $1.00 | $12.00 |
Setelah prompt mencapai 200K token, xAI menyatakan harga konteks panjang berlaku untuk seluruh token dalam permintaan tersebut. Tiga perhitungan singkat menunjukkan batas ini:
- Input 100K ditambah output 5K pada harga konteks pendek standar berbiaya sekitar $0.23.
- Jika seluruh 100K token input disajikan dari cache, output yang sama berbiaya sekitar $0.08.
- Input 220K ditambah output 10K melewati batas dan berbiaya sekitar $1.00 pada harga konteks panjang yang tercantum.
Contoh ini belum termasuk alat sisi server. xAI saat ini mencantumkan pencarian web, pencarian X, dan eksekusi kode sebesar $5 per 1.000 panggilan di luar biaya token. Pengumumannya juga menyebut varian cepat dengan harga dua kali tarif standar. Konfirmasikan model yang tepat, tingkat layanan, ketersediaan wilayah, dan harga terbaru di konsol xAI sebelum menyusun anggaran.
Untuk metode biaya yang lebih luas, baca Cara Menghitung Biaya Token LLM dan Pelacakan Biaya API AI.
Memanggil Grok 4.6 dengan Responses atau Chat Completions
Permintaan berikut menggunakan endpoint API resmi xAI karena artikel ini adalah panduan rilis, bukan klaim bahwa model tersebut sudah aktif di setiap gateway.
Responses API:
export XAI_API_KEY="<YOUR_XAI_API_KEY>"
curl -sS https://api.x.ai/v1/responses \
-H "Authorization: Bearer $XAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-4.6",
"input": "Review this migration plan, identify the three highest-risk assumptions, and propose verification steps.",
"prompt_cache_key": "grok-46-migration-review"
}'
Chat Completions:
curl -sS https://api.x.ai/v1/chat/completions \
-H "Authorization: Bearer $XAI_API_KEY" \
-H "Content-Type: application/json" \
-H "x-grok-conv-id: grok-46-migration-review" \
-d '{
"model": "grok-4.6",
"messages": [
{
"role": "user",
"content": "Review this migration plan, identify the three highest-risk assumptions, and propose verification steps."
}
]
}'
Gunakan prompt_cache_key pada Responses atau header x-grok-conv-id pada Chat Completions untuk meningkatkan afinitas cache sebuah percakapan. Perlakukan ID ini sebagai metadata operasional: pertahankan nilainya untuk satu percakapan, jangan masukkan rahasia atau data pribadi, dan jangan pakai satu nilai untuk pengguna yang tidak terkait.
Jika Anda sedang memilih di antara kedua format wire tersebut, baca Responses API vs Chat Completions.
Cache prompt dan loop agen panjang
Jendela konteks 500K adalah kapasitas, bukan target. Mengirim seluruh riwayat pada setiap giliran dapat menambah latensi dan mendorong seluruh permintaan ke tingkat harga konteks panjang.
Untuk alur kerja yang berkelanjutan:
- letakkan instruksi stabil dan konteks yang dapat digunakan kembali di awal prompt;
- gunakan kunci afinitas cache yang stabil untuk setiap percakapan;
- ukur input cached dan uncached secara terpisah;
- padatkan atau rangkum giliran lama sebelum prompt mendekati 200K token;
- simpan hasil alat yang masih otoritatif dan buang derau transportasi yang berulang;
- tetapkan tingkat penalaran dan bandingkan keberhasilan tugas, jangan menganggap xhigh selalu lebih baik;
- catat status, latensi, input, cached input, output, panggilan alat, dan total biaya per tugas yang berhasil.
Pemadatan konteks mengubah informasi yang dilihat model. Validasi ringkasan terhadap keadaan asli dan pertahankan ID, batasan, keputusan, dan kesalahan yang belum terselesaikan yang bersifat otoritatif.
Membaca benchmark peluncuran dengan tepat
xAI memublikasikan hasil Grok 4.6 High berikut dalam pengumuman peluncurannya:
| Evaluasi | Skor Grok 4.6 yang dilaporkan xAI |
|---|---|
| Artificial Analysis Intelligence Index | 61 |
| GDPVal-AA v2 | 1753 |
| CursorBench v3.2 | 69.9% |
| DeepSWE v1.1 | 65.9% |
| FrontierCode v1.1 Extended | 61.3% |
| APEX-Agents | 57.5% |
Angka tersebut adalah hasil peluncuran yang diterbitkan penyedia, bukan pengujian independen Modelflare. Harness benchmark, pengaturan penalaran, akses alat, batas waktu, dan versi penilaian memengaruhi keterbandingan. Gunakan tabel untuk memilih beban kerja yang layak diuji, bukan sebagai peringkat kualitas universal atau jaminan hasil produksi.
Daftar periksa migrasi produksi
Sebelum mengarahkan trafik produksi ke Grok 4.6:
- gunakan ID model
grok-4.6yang tepat dan tolak penggantian alias secara diam-diam; - pastikan model aktif untuk akun, wilayah, format API, dan tingkat layanan yang dituju;
- putar ulang set evaluasi tetap yang aman dari data pribadi pada Grok 4.5 dan Grok 4.6;
- uji input teks, input gambar, function calling, structured outputs, streaming, jalur penolakan, dan pembatalan secara terpisah sesuai penggunaan aplikasi;
- bandingkan low, medium, high, dan xhigh berdasarkan biaya serta latensi per tugas berhasil;
- uji permintaan tepat di bawah dan di atas batas prompt 200K;
- verifikasi cache hit, pemadatan konteks, jumlah panggilan alat, perilaku retry, dan perlindungan dari efek samping ganda;
- pertahankan jalur rollback dan catat model akhir, jalur, penggunaan, latensi, dan biaya setiap permintaan.
HTTP 200 hanya membuktikan satu permintaan selesai. Itu tidak membuktikan kesetaraan fitur, latensi stabil, perilaku alat yang benar, atau biaya yang layak. Untuk pengujian tingkat jalur, gunakan Uji Kepatuhan API Kompatibel OpenAI dan Perutean API AI yang Andal.
Apakah Grok 4.6 tersedia di Modelflare?
Ya. Pada pemeriksaan produksi 13 Agustus 2026, katalog publik Model & Harga Modelflare mencantumkan ID tepat grok-4.6 pada grup grok-award dan grok-stable. Katalog menyatakan dukungan untuk jalur Chat Completions dan Responses API yang kompatibel dengan OpenAI.
Pengali grup yang tampil saat pemeriksaan adalah 0,03x untuk grok-award dan 0,06x untuk grok-stable. Akses grup, jalur, harga, dan ketersediaan dapat berubah. Karena xAI juga memiliki tingkat harga konteks panjang tersendiri, jangan terapkan satu pengali promosi atau contoh konteks pendek pada semua permintaan. Gunakan halaman harga langsung dan catatan biaya permintaan yang selesai sebagai sumber kebenaran saat ini.
Buat atau perbarui API Key dengan grup yang memenuhi syarat, gunakan ID grok-4.6 yang tepat, lalu selesaikan satu permintaan nyata tanpa data sensitif sebelum memindahkan trafik produksi. Pencantuman katalog membuktikan konfigurasi publik tersedia, tetapi bukan benchmark kualitas independen Modelflare atau jaminan untuk setiap API Key.
Sumber resmi dan catatan pembaruan
Sumber primer:
- xAI: Introducing Grok 4.6
- Panduan developer xAI: Grok 4.6
- Halaman model xAI: grok-4.6
- Harga API xAI
- Catatan rilis xAI
Catatan pembaruan:
- 13 Agustus 2026: Publikasi awal. Spesifikasi resmi, harga, format API, benchmark peluncuran, dan ketersediaan di katalog Modelflare telah diperiksa.