Grok 4.7: spesifikasi, kemampuan, benchmark, dan harga Modelflare

Panduan bersumber tentang Grok 4.7: spesifikasi yang dipublikasikan, tingkat penalaran, benchmark peluncuran, harga token resmi, serta tarif grok-award dan grok-stable Modelflare yang diperiksa pada 21 September 2026.

xAI merilis Grok 4.7 pada 21 September 2026. ID model pada API adalah grok-4.7. Ini adalah model unggulan xAI saat ini untuk pemrograman, penggunaan alat yang bersifat agen, dan pekerjaan pengetahuan. Modelflare mencantumkan ID yang sama di katalog harga publik pada hari yang sama.

Artikel ini memisahkan tiga lapisan. Spesifikasi adalah apa yang didokumentasikan xAI. Tabel benchmark adalah apa yang dilaporkan xAI saat peluncuran. Harga Modelflare adalah apa yang dikembalikan GET /api/pricing pada 21 September 2026. Skor vendor bukan pengujian Modelflare, dan satu baris katalog bukan janji bahwa setiap kunci, rute, atau prompt akan berperilaku dengan cara yang sama.

xAI belum menerbitkan jumlah parameter, jumlah lapisan, atau total token pelatihan untuk Grok 4.7. "Lebih besar daripada Grok 4.6" adalah deskripsi kualitatif perusahaan tentang model dasar yang baru. Perbandingan di bawah memakai angka yang benar-benar dipublikasikan: konteks, harga token, tingkat penalaran, modalitas, dan skor peluncuran.

Yang dipublikasikan

Tulisan peluncuran menggambarkan Grok 4.7 sebagai model dasar baru yang lebih besar daripada Grok 4.6, dilatih dengan proses pembelajaran penguatan yang lebih panjang. Campuran tugasnya lebih sulit dan dibobotkan ke masalah yang memakan waktu banyak jam. xAI mengatakan model ini lebih baik dalam memeriksa pekerjaannya sendiri dan dalam mengelola konteks panjang, serta dilatih untuk memahami harness Grok Bot yang dipakai untuk pekerjaan percakapan.

Dua kalimat dalam tulisan itu tidak boleh dijadikan satu. Judul mengatakan model ini "dua kali lebih cepat, dengan setengah harga model yang sebanding". Isi tulisan mengatakan model ini dilayani dengan harga yang sama dan kecepatan yang sama seperti Grok 4.6. Tabel token mendukung kalimat kedua terhadap Grok 4.6: keduanya mencantumkan $2 per satu juta token input dan $6 per satu juta token output. Judul itu adalah perbandingan dengan model lain dalam tabel tersebut, yang harga daftarnya lebih tinggi. xAI tidak menerbitkan angka token per detik di samping "dua kali lebih cepat", jadi artikel ini tidak memperlakukan frasa itu sebagai hasil latensi yang terukur.

grok-4.7 ada di API xAI, di Cursor, dan merupakan model bawaan di Grok Build. Jalur penyajian Fast yang terpisah hanya ada di Cursor dan Grok Build. Jalur itu tidak ada di API xAI publik, dan tidak ada dalam katalog Modelflare yang diperiksa untuk artikel ini.

Perbandingan spesifikasi

Harga di bawah adalah harga daftar yang diterbitkan xAI, dalam USD per satu juta token. "Pendek" berarti prompt di bawah 200,000 token. "Panjang" berarti prompt yang telah mencapai 200,000 token. Pada tabel harga, melewati garis itu menetapkan ulang harga setiap token dalam permintaan, bukan hanya token di luar garis.

Item grok-4.7 grok-4.6 grok-4.5
Jendela konteks 500,000 token 500,000 token 500,000 token
Input pendek / input cache / output $2.00 / $0.50 / $6.00 $2.00 / $0.50 / $6.00 $2.00 / $0.30 / $6.00
Input panjang / input cache / output $4.00 / $1.00 / $12.00 $4.00 / $1.00 / $12.00 $4.00 / $0.60 / $12.00
Upaya penalaran low, medium, high (bawaan), xhigh low, medium, high (bawaan), xhigh low, medium, high (bawaan)

Detail Grok 4.7 yang diperiksa di halaman model pada hari yang sama:

  • Input berupa teks dan gambar. Output berupa teks. Model ini tidak menghasilkan gambar.
  • Halaman tidak menyatakan batas output teks yang tetap. Timeout klien, batas akun, dan sisa jendela konteks tetap berlaku.
  • Batas pengetahuan adalah Mei 2026. Peristiwa yang lebih baru tidak terlihat kecuali alat pencarian diaktifkan.
  • Antarmuka yang didokumentasikan adalah Responses API dan Chat Completions.
  • Alat yang didokumentasikan mencakup function calling, pencarian web, pencarian X, dan eksekusi kode.
  • Penalaran tidak dapat dimatikan. Jika upaya dihilangkan, nilai bawaannya adalah high.
  • Pada Responses API, grok-4.7 mengembalikan reasoning.encrypted_content bahkan ketika permintaan tidak memintanya. Giliran berikutnya harus mengirim kembali item penalaran itu tanpa perubahan. Chat Completions tidak memperoleh perilaku ini.

Grok 4.5 berhenti di high. Grok 4.6 dan Grok 4.7 menambahkan xhigh. Harga daftar input cache juga berubah: Grok 4.5 adalah $0.30 pada prompt pendek dan $0.60 pada prompt panjang; Grok 4.6 dan Grok 4.7 adalah $0.50 dan $1.00. Harga daftar input standar dan output standar tidak berubah pada ketiga ID ini.

Dimensi kemampuan

Pemrograman dan pekerjaan agen yang panjang

Tulisan peluncuran mengarahkan Grok 4.7 ke pekerjaan yang berjalan lama: pemrograman banyak langkah, memeriksa hasil sebelum menyebutnya selesai, dan menahan konteks panjang agar tetap utuh. Semua skor pemrograman ini berasal dari tabel peluncuran xAI:

  • CursorBench 4.0, yang menekan tugas pemrograman yang lebih panjang: 46.3% pada xHigh. Grok 4.6 High adalah 40.4%, GPT-5.6 Sol Max adalah 41.7%, dan Fable 5.1 Max adalah 51.8%.
  • DeepSWE v1.1: 71.0%, ditandai xAI sebagai skor upaya tinggi, bukan xHigh. Grok 4.6 adalah 65.2%, Sol adalah 72.7%, dan Fable 5.1 adalah 70.0%.
  • Terminal-Bench 4.0: 38.0%. Grok 4.6 adalah 20.3%, Sol adalah 37.3%, dan Fable 5.1 adalah 57.9%.
  • EEBench, teknik elektro: 64.0%. Grok 4.6 adalah 53.0%, Sol adalah 39.4%, dan Fable 5.1 adalah 56.4%.

Bacalah baris-baris itu sebagai peta tempat vendor mengatakan model ini bergeser, bukan sebagai skor yang akan diperoleh repositori Anda. Pada CursorBench, xAI menyebut hasilnya sebagai rasio harga-kinerja kelas frontier: skornya di atas Sol dan Grok 4.6, di bawah Fable 5.1, dengan harga daftar yang jauh lebih rendah daripada Sol maupun Fable. DeepSWE dekat dengan Fable dan masih di bawah Sol, dan angka itu bukan angka xHigh. Pekerjaan terminal meningkat tajam dibandingkan Grok 4.6 dan berada di dekat Sol, sementara Fable 5.1 tetap jauh di depan pada baris itu. EEBench adalah keunggulan yang paling jelas dalam tabel.

Pekerjaan pengetahuan profesional

xAI juga melaporkan tugas kantor dan profesional:

  • AA Briefcase v1.1, pekerjaan kantor selama banyak jam: 1,657. Grok 4.6 adalah 1,546, Sol adalah 1,487, dan Fable 5.1 adalah 1,678.
  • Harvey Legal Agent Benchmark: 19.6%. Grok 4.6 adalah 15.8%, Sol adalah 2.5%, dan Fable 5.1 adalah 6.7%. Memimpin tabel ini tetap berarti sekitar satu dari lima item. Ini bukan bukti bahwa model dapat menangani pekerjaan hukum tanpa pengawasan.
  • HealthBench Professional, penalaran klinis: 56.7%. Grok 4.6 adalah 48.5%, Sol adalah 60.5%, dan Fable 5.1 adalah 62.1%. Pada baris ini Grok 4.7 berada di depan pendahulunya dan di belakang kedua model pembanding.

Tulisan itu mengatakan Grok 4.7 lebih baik pada dokumen dan presentasi, serta membaik dibandingkan Grok 4.6 pada GDPval sambil berada pada rentang yang sama dengan model frontier lain. Prosa tidak mencetak nilai titik GDPval, jadi artikel ini tidak menyediakan nilai apa pun.

Tidak ada satu indeks kecerdasan dalam teks peluncuran Grok 4.7. Tulisan Grok 4.6 yang lebih awal menerbitkan Artificial Analysis Intelligence Index. Peluncuran ini mengganti angka tunggal itu dengan tabel tugas di atas. Gunakan baris yang sesuai dengan pekerjaan. Sebuah model dapat memimpin teknik elektro dan tertinggal pada penalaran klinis dalam rilis yang sama.

Upaya penalaran

reasoning_effort menerima low, medium, high, dan xhigh. high adalah nilai bawaan. xAI menggambarkan low sebagai pengaturan yang lebih ringan, medium sebagai lebih banyak berpikir ketika latensi kurang peka, high sebagai pengaturan untuk masalah banyak langkah yang sulit, dan xhigh sebagai pengaturan terdalam, dengan latensi tertinggi, untuk masalah yang kualitas jawabannya mengalahkan waktu respons.

Lebih banyak upaya biasanya berarti lebih banyak token penalaran, dan token output adalah sisi mahal dari harga daftar. xhigh tidak otomatis menjadi bawaan produksi yang tepat. Bandingkan keberhasilan tugas, latensi, dan total token pada prompt Anda sendiri sebelum membiarkannya tetap menyala.

Untuk percakapan Responses banyak giliran, simpan item penalaran terenkripsi pada permintaan berikutnya. Membuangnya menghilangkan konteks yang dipakai model untuk mencapai jawaban sebelumnya. Chat Completions tidak mengembalikan bidang terenkripsi itu.

Alat, gambar, dan memori

Function calling adalah jalur alat yang Anda implementasikan. Anda menyatakan fungsi, model mengusulkan panggilan, aplikasi Anda menjalankannya, dan Anda mengirim hasilnya kembali. Pencarian web, pencarian X, dan eksekusi kode dihosting oleh xAI. Model dapat memanggilnya sendiri, dan setiap invokasi dihargai terpisah dari token.

Gambar dapat dikirim sebagai input. Ringkasan halaman model tidak mencantumkan harga gambar yang terpisah. Input gambar memakai konteks dan muncul dalam penggunaan token permintaan. Pembuatan gambar tetap pada model Grok Imagine, yang merupakan API yang berbeda.

Lima ratus ribu token adalah jendela, bukan anggaran yang harus Anda isi. xAI menyarankan prompt_cache_key yang stabil pada Responses API, dan header x-grok-conv-id pada Chat Completions langsung, agar percakapan lebih mungkin mendarat di server yang sama dan mengenai cache. Tanpa afinitas itu, server dengan cache dingin menagih harga input penuh. Loop panjang juga diharapkan memadatkan giliran yang lebih lama. Pemadatan mengubah apa yang dapat dilihat model. Periksa ringkasan terhadap batasan asli, ID, keputusan, dan kesalahan yang masih terbuka.

Batas Mei 2026 adalah batas keras pada pengetahuan yang dihafal. Apa pun yang lebih baru memerlukan alat pencarian, dan pencarian tidak termasuk dalam harga token.

Pengamanan

xAI mengatakan Grok 4.7 memakai tumpukan pengamanan yang baru dan merupakan model terkuat yang telah diujinya pada penolakan dan ketahanan terhadap jailbreak. Dua angka dicetak dalam tulisan peluncuran:

  • Benchmark biosekuriti LatchBio: 62.4%.
  • HackerBench v0.3, yang digambarkan xAI sebagai benchmark-nya untuk tugas siber yang berisiko dan berbahaya: 3.3% prompt penggunaan ganda yang berisiko diizinkan lolos. xAI juga mengatakan pekerjaan keamanan yang sah jarang diblokir.

Tulisan itu mengatakan mitra keamanan siber terpilih memiliki akses hanya dengan undangan ke kemampuan red team untuk riset pertahanan. Akses itu bukan bagian dari API publik grok-4.7 yang dijelaskan di sini.

Angka-angka ini adalah evaluasi vendor. Ini bukan audit independen, dan bukan alasan untuk melewati tinjauan manusia pada jawaban medis, hukum, keamanan, atau jawaban lain yang berisiko tinggi.

Harga resmi

Tarif token

Halaman harga xAI, diperiksa pada 21 September 2026, mencantumkan USD per satu juta token:

Ukuran prompt Input Input cache Output
Di bawah 200,000 token prompt $2.00 $0.50 $6.00
Pada atau di atas 200,000 token prompt $4.00 $1.00 $12.00

Tarif panjang mencakup seluruh permintaan setelah prompt mencapai ambang. 200,000 token pertama tidak mempertahankan tarif pendek.

Tiga contoh resmi

Biaya alat yang dihosting tidak termasuk.

Permintaan Dasar Aritmetika Total
100,000 input tanpa cache, 5,000 output Pendek 0.1 × $2 + 0.005 × $6 $0.230
100,000 input cache, 5,000 output Pendek 0.1 × $0.50 + 0.005 × $6 $0.080
220,000 input tanpa cache, 10,000 output Panjang 0.22 × $4 + 0.01 × $12 $1.000

Lompatan dari baris pertama ke baris ketiga bukanlah "sedikit lebih banyak teks". Melewati 200,000 token menggandakan setiap tarif, dan token tambahan ditagih pada tarif yang sudah digandakan. Prompt 100,000 token yang sepenuhnya berada di cache pada baris kedua berharga sekitar sepertiga dari prompt pendek tanpa cache, karena input cache adalah seperempat dari tarif input dan biaya output tidak berubah.

Alat yang dihosting, Fast, dan wilayah AS

Invokasi alat yang dihosting pada halaman harga yang sama:

  • Pencarian web (web_search): $5 per 1,000 panggilan.
  • Pencarian X (x_search): $5 per 1,000 panggilan pada saat pemeriksaan ini. Mulai 21 September 2026 pukul 12:00 PT, xAI mengganti harga per panggilan itu dengan $5 per 1,000 posting yang diambil dan $10 per 1,000 profil pengguna yang diambil. Setiap posting yang dikembalikan dihitung, termasuk induk dan kutipan. Setiap profil yang dikembalikan dihitung.
  • Eksekusi kode (code_execution dan code_interpreter): $5 per 1,000 panggilan.
  • Pencarian lampiran berkas: $10 per 1,000 panggilan.
  • Pencarian koleksi: $2.50 per 1,000 panggilan.

Model memilih berapa banyak panggilan yang dihosting yang dibuat. Jawaban yang berat pencarian dapat berbiaya lebih besar pada biaya alat daripada pada token.

Endpoint regional AS https://us.api.x.ai/v1 menahan inferensi di Amerika Serikat dan mengalikan input, input cache, serta output dengan 1.1, termasuk tarif konteks panjang. Untuk grok-4.7 itu adalah $2.20 / $0.55 / $6.60 di bawah 200,000 token prompt, dan $4.40 / $1.10 / $13.20 pada atau di atas garis itu.

Grok 4.7 Fast adalah model yang sama pada infrastruktur yang lebih cepat. Prosa xAI mengatakan model ini ditagih sebesar dua kali tarif token standar. Tabel harga mencetak $4.00 / $1.00 / $12.00 di bawah 200,000 token prompt, dan $6.00 / $1.50 / $18.00 pada atau di atas 200,000. Menggandakan baris konteks panjang standar sebesar $4 / $1 / $12 akan menjadi $8 / $2 / $24. Baris konteks panjang Fast yang dicetak tidak cocok dengan penggandaan itu. Susun anggaran dari tabel, dan periksa kembali halaman harga sebelum mengandalkan Fast. Fast dijual melalui Cursor dan Grok Build. Fast tidak ada di API xAI publik, tidak termasuk dalam tingkat gratis Grok Build, dan katalog Modelflare yang diperiksa pada 21 September 2026 tidak memiliki ID model Fast. ID Grok yang ada adalah grok-4.5, grok-4.6, dan grok-4.7.

Benchmark peluncuran

Skor di bawah disalin dari tulisan peluncuran xAI tanggal 21 September 2026. Folkbench membandingkan rute menurut ketersediaan, latensi, dan harga, serta menyimpan catatannya tentang model ini di folkbench.com/models/grok-4-7. Header kolom mempertahankan pengaturan upaya yang dicetak xAI. Skor model lain adalah skor yang ditempatkan xAI pada tabel yang sama. Modelflare tidak menjalankannya kembali.

Evaluasi Grok 4.7 xHigh Grok 4.6 High GPT-5.6 Sol Max Fable 5.1 Max
Harga daftar input, USD / 1M 2 2 4 10
Harga daftar output, USD / 1M 6 6 20 50
CursorBench 4.0 46.3% 40.4% 41.7% 51.8%
DeepSWE v1.1 71.0% (high, bukan xHigh) 65.2% 72.7% 70.0%
EEBench 64.0% 53.0% 39.4% 56.4%
AA Briefcase v1.1 1,657 1,546 1,487 1,678
Terminal-Bench 4.0 38.0% 20.3% 37.3% 57.9%
Harvey Legal Agent Benchmark 19.6% 15.8% 2.5% 6.7%
HealthBench Professional 56.7% 48.5% 60.5% 62.1%

Kolom Grok 4.7 bukan satu pengaturan upaya. DeepSWE secara eksplisit adalah skor upaya high. Sel Grok 4.7 yang lain berada di bawah header xHigh. Grok 4.6 adalah High. Sol dan Fable adalah Max. Skor yang lebih tinggi dapat berasal dari pengaturan penalaran yang lebih dalam dan lebih mahal. Hal itu perlu diketahui, dan ini bukan perbandingan yang disetarakan pada satu tingkat upaya.

Pada tabel ini Grok 4.7 memimpin EEBench dan benchmark Harvey. Model ini dekat dengan para pemimpin pada CursorBench, DeepSWE, AA Briefcase, dan pada Terminal-Bench terhadap Sol. Model ini tertinggal jauh dari Fable 5.1 pada Terminal-Bench, dan tertinggal dari Sol maupun Fable 5.1 pada HealthBench Professional.

Harga daftar input adalah setengah dari Sol dan seperlima dari Fable. Harga daftar output adalah 30% dari Sol dan 12% dari Fable. "Setengah harga" cocok dengan sel input Sol dan tidak cocok dengan setiap sel lain. Tabel inilah perbandingan yang tepat.

Harga Modelflare dan bagaimana grup berbeda

Pada 21 September 2026, respons harga publik Modelflare menyertakan grok-4.7. Tarif daftar katalog cocok dengan harga daftar konteks pendek xAI: input $2 per satu juta token, rasio penyelesaian 3 sehingga output adalah $6, dan rasio cache 0.25 sehingga input cache adalah $0.50. Baris itu tidak menerbitkan tingkat konteks panjang yang kedua. Jangan mengalikan tarif panjang xAI sebesar $4 / $1 / $12 dengan rasio grup Modelflare lalu memperlakukan hasil kalinya sebagai tagihan. Biaya yang tersimpan pada permintaan yang selesai adalah angka yang diterapkan.

Grup dipilih pada kunci API. Kedua grup memanggil ID model yang sama.

Tabel harga

Grup Rasio Input / 1M Input cache / 1M Output / 1M Deskripsi katalog
grok-award 0.03 $0.06 $0.015 $0.18 Perutean prioritas harga untuk pengembangan, pengujian, dan beban kerja fleksibel yang peka anggaran serta dapat diulang
grok-stable 0.11 $0.22 $0.055 $0.66 Pengembangan sehari-hari, proyek yang lebih panjang, dan aplikasi produksi bagi pengembang individu yang menginginkan stabilitas

Aritmetikanya adalah tarif daftar katalog dikali rasio grup. Award adalah $2.00 × 0.03, $0.50 × 0.03, dan $6.00 × 0.03. Stable adalah $2.00 × 0.11, $0.50 × 0.11, dan $6.00 × 0.11. Terhadap harga daftar konteks pendek, rasio itu adalah 3% dan 11%. Rasio itu bukan 3% atau 11% dari harga daftar konteks panjang, dari harga regional AS, atau dari biaya alat yang dihosting.

Teks katalog bahasa Tionghoa untuk grok-award menambahkan kalimat yang tidak ada pada deskripsi bahasa Inggris: harga yang sangat rendah tidak menjamin stabilitas atau kualitas model. Simpan kalimat itu di samping rasio 0.03. grok-stable adalah deskripsi katalog untuk pengembangan dan produksi biasa. Tidak satu pun kalimat itu merupakan perjanjian waktu aktif yang terukur, target latensi, atau klaim bahwa grup menjalankan bobot yang berbeda.

Tiga contoh Modelflare

Bentuk token cocok dengan contoh resmi. Harganya dihitung pada tarif tunggal katalog. Baris cache menganggap catatan penggunaan menghitung token input itu sebagai kena cache. Biaya yang sangat kecil juga dapat bergeser ketika kuota dibulatkan ke satuan penagihan, jadi log permintaan tetap menjadi faktur.

Permintaan grok-award grok-stable
100,000 input tanpa cache, 5,000 output $0.0069 $0.0253
100,000 input cache, 5,000 output $0.0024 $0.0088
220,000 input tanpa cache, 10,000 output, pada tarif katalog tunggal $0.0150 $0.0550

Baris 220,000 token sengaja bukan 0.03 × $1.00 atau 0.11 × $1.00. Satu dolar adalah biaya daftar konteks panjang xAI. Jika revisi katalog kemudian menambahkan tingkat konteks panjang, baris ini berhenti menjadi kutipan harga. Halaman langsungnya adalah halaman harga grok-4.7. Indeksnya adalah Model & Harga.

Memanggil model melalui Modelflare, alih-alih membuka akun xAI terpisah hanya untuk ID ini, berarti:

  • ID model tetap grok-4.7. Klien tidak menargetkan alias yang namanya diubah.
  • URL dasar kanonis adalah https://modelflare.dev/v1 yang kompatibel dengan OpenAI. SDK OpenAI biasanya membutuhkan URL dasar itu, kunci Modelflare, dan ID model.
  • Kunci ditempatkan di grok-award atau grok-stable. Akun yang sama dapat memanggil model katalog lain ketika grup kunci mengizinkannya.
  • Pembagian harga bersifat eksplisit. Award adalah rute murah untuk pekerjaan yang dapat Anda ulangi, dengan catatan stabilitas dan kualitas di atas. Stable adalah rute yang digambarkan katalog untuk pengembangan sehari-hari dan produksi.
  • Jenis endpoint yang tercantum untuk ID ini adalah Chat Completions, Responses, dan compaction Responses.

Harga ini tidak mencakup keunggulan latensi yang terukur dibanding memanggil xAI secara langsung, biaya pencarian atau eksekusi kode yang dihosting, tingkat penyajian Fast, atau tingkat layanan di luar deskripsi grup.

Cara memanggil Grok 4.7 di Modelflare

Buat kunci API dan pilih grok-award atau grok-stable. Grup berada pada kunci. Kunci pada grup yang tidak terkait dapat gagal pada grok-4.7 meskipun model tercantum secara publik. Kirim ID model dengan tepat. URL dasar kanonis adalah https://modelflare.dev/v1. API yang sama juga diterbitkan di https://cf.modelflare.dev/v1 dan https://origin.modelflare.dev/v1. Nama host akar adalah situs kanonis.

Chat Completions:

export MODELFLARE_API_KEY="YOUR_MODELFLARE_API_KEY"

curl -sS https://modelflare.dev/v1/chat/completions \
  -H "Authorization: Bearer $MODELFLARE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-4.7",
    "reasoning_effort": "high",
    "messages": [
      {
        "role": "user",
        "content": "Review this migration plan and list the three assumptions that most need a test."
      }
    ]
  }'

Responses:

curl -sS https://modelflare.dev/v1/responses \
  -H "Authorization: Bearer $MODELFLARE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-4.7",
    "reasoning": {"effort": "high"},
    "input": "Review this migration plan and list the three assumptions that most need a test."
  }'

Pada Chat Completions, reasoning_effort menerima low, medium, high, dan xhigh. Pada Responses, atur reasoning.effort ke nilai yang sama. Input gambar memakai array konten OpenAI biasa pada pesan pengguna. Fungsi Anda sendiri memakai bidang tools biasa. POST /v1/responses/compact tercantum untuk model ini dan diteruskan sebagai compaction pada grok-4.7, bukan sebagai ID model lain. Alat xAI yang dihosting, termasuk pencarian web, adalah perilaku penyedia. Cobalah pada rute yang benar-benar akan Anda pakai, dan baca catatan penggunaan, sebelum bergantung pada alat itu atau pada biaya invokasi xAI.

Untuk perbedaan antara dua bentuk permintaan, lihat Responses API vs Chat Completions. Untuk metode biaya di balik tabel, lihat Cara Menghitung Biaya Token LLM dan Pelacakan Biaya API AI.

Pemeriksaan sebelum mengalihkan trafik

  1. Sematkan grok-4.7. Jangan menerima penggantian diam-diam menjadi Grok 4.6 atau Grok 4.5.
  2. Pastikan grup kunci adalah grok-award atau grok-stable, dan pilih berdasarkan toleransi pengulangan, bukan hanya dari rasio.
  3. Jalankan ulang satu set tetap yang tidak sensitif pada low, medium, high, dan xhigh. Catat keberhasilan, latensi, token input, input cache, token output, dan biaya.
  4. Jalankan Grok 4.6 pada set yang sama sebelum Anda menggantinya. Harga daftarnya serupa. Tabel skor tidak seragam.
  5. Hitung harga satu prompt tepat di bawah 200,000 token dan satu tepat di atasnya, lalu baca biaya yang tercatat. Lembar xAI dan baris katalog Modelflare saat ini tidak menerbitkan aturan konteks panjang yang sama.
  6. Jika alur kerja membutuhkan gambar, panggilan fungsi, streaming, atau pembatalan, uji jalur itu. Satu keberhasilan yang hanya berupa teks tidak mencakup jalur tersebut.
  7. Pertahankan rute pengembalian. Respons HTTP yang selesai hanya menunjukkan bahwa satu panggilan telah berakhir.

Sumber

Diperiksa pada 21 September 2026.