Ulasan Grok 4.7
Grok 4.7 layak diuji lebih dulu untuk agen coding dan knowledge work berdurasi panjang dengan harga yang sama, tetapi skor xAI bukan pengganti pengujian pada workload Anda.
Ulasan Grok 4.7 ini mengambil kesimpulan yang lebih terbatas daripada judul peluncurannya. Untuk coding jangka panjang, penggunaan alat, dan knowledge work profesional, 4.7 masuk akal untuk dinilai lebih dulu: model ini meningkat pada ketujuh baris perbandingan Grok 4.6 yang diterbitkan xAI sambil mempertahankan harga API standar dan konteks 500K. Itu bukan bukti bahwa 4.7 selalu unggul. Tabel resmi mencampur tingkat reasoning effort dan kami tidak menjalankan benchmark sendiri dengan permintaan berbayar.
SpaceXAI merilis grok-4.7 pada 21 September 2026. Model tersedia di public API xAI, tetapi belum tercantum di katalog publik OmniaKey saat diperiksa pada 22 September. Sampai katalog live berubah, gunakan Grok 4.6 di OmniaKey atau penyedia yang benar-benar mengekspos ID 4.7 secara tepat.
Data diverifikasi pada 22 September 2026. Spesifikasi dan skor peluncuran berasal dari pengumuman serta dokumentasi developer SpaceXAI. Artificial Analysis sudah menampilkan Intelligence Index awal untuk xhigh, tetapi kolom kecepatan dan harga provider belum lengkap. Kami tidak memakai private preview, credential xAI, atau pengukuran latensi langsung. Hasil vendor, bukti independen, dan rekomendasi kami dipisahkan.
Kesimpulan ulasan Grok 4.7
Untuk pekerjaan agen baru yang panjang, uji 4.7 sebelum 4.6. Sinyal paling berguna adalah perubahan antargenerasi: xAI melaporkan hasil 4.7 lebih tinggi pada tujuh perbandingan langsung, dengan kenaikan besar pada Terminal-Bench 4.0 dan EEBench tanpa kenaikan tarif token standar.
Jangan bermigrasi hanya berdasarkan judul peluncuran. Tabel memakai Grok 4.7 pada xhigh, Grok 4.6 pada high, dan model frontier lain pada max; hasil DeepSWE 4.7 juga ditandai high effort. Pengaturan tersebut dapat mengubah penggunaan token, latensi, dan perilaku.
Pertahankan 4.6 sebagai rollback sampai tugas Anda lulus. Kedua generasi memiliki konteks 500K dan harga langsung yang sama. Evaluasi bertahap lebih murah daripada menemukan regresi tool call, penolakan, keluaran panjang, atau format di production.
Tanggal rilis dan spesifikasi utama
| Item | Kontrak Grok 4.7 |
|---|---|
| Tanggal rilis | 21 September 2026 |
| ID model API | grok-4.7 |
| Input / output | Teks dan gambar / teks |
| Jendela konteks | 500,000 tokens |
| Knowledge cutoff | Mei 2026 |
| Reasoning effort | low, medium, high (default), xhigh |
| API | Responses API dan Chat Completions |
| Kemampuan | Function calling, structured outputs, web search, X search, code execution |
| Batch API | Tidak didukung |
| Harga global langsung untuk prompt di bawah 200K | $2 input / $0.50 cache / $6 output per 1M |
| Harga global langsung untuk prompt 200K atau lebih | $4 input / $1 cache / $12 output per 1M |
Angka 500K adalah kapasitas, bukan kuota gratis. Begitu prompt mencapai 200K tokens, xAI menerapkan tarif yang lebih tinggi ke seluruh token dalam request. Start guide tidak mencantumkan batas text output, tetapi rate limits, latensi, anggaran, dan perilaku endpoint tetap membatasi workload nyata.
Apa yang berubah dari Grok 4.6?
SpaceXAI menyebut base model baru yang lebih besar, reinforcement learning lebih lama dengan tugas sulit berdurasi berjam-jam, self-verification dan pengelolaan konteks panjang yang lebih baik, pemahaman native atas harness Grok Bot, serta safeguard stack baru.
Itu adalah klaim peluncuran vendor, bukan hasil arsitektur yang diaudit secara independen. Perusahaan tidak menerbitkan jumlah parameter pada pengumuman atau kontrak model saat ini.
| Titik keputusan | Grok 4.7 | Grok 4.6 | Implikasinya |
|---|---|---|---|
| Base / training | Base baru lebih besar; RL lebih lama pada tugas sulit | Generasi sebelumnya | Alasan wajar untuk menguji ulang agen panjang |
| Harga langsung standar | $2 / $0.50 / $6 | $2 / $0.50 / $6 | Tidak ada premium harga saat upgrade |
| Harga konteks panjang | $4 / $1 / $12 | $4 / $1 / $12 | Ekonomi sama pada batas 200K |
| Konteks | 500K | 500K | Bukan peningkatan kapasitas |
| Reasoning | low sampai xhigh; high default | low sampai xhigh; high default | Kunci effort yang sama saat membandingkan |
| Batch | Tidak didukung | Tidak didukung | Jangan mengasumsikan diskon Batch |
| Fokus rilis | Coding, agen, knowledge work, self-check | Coding dan agen panjang | Reliabilitas, bukan modality baru |
Upgrade praktisnya adalah performa tugas yang diklaim pada harga yang sama, bukan konteks lebih besar atau token lebih murah. Panduan harga API Grok 4.6 tetap menjadi referensi anggaran terperinci untuk route yang saat ini tercantum di OmniaKey.
Benchmark Grok 4.7: cara membacanya
Hasil ini dilaporkan oleh SpaceXAI dan tidak direproduksi oleh OmniaKey. Publisher menampilkan 4.7 pada xhigh, 4.6 pada high, GPT-5.6 Sol pada max, dan Fable 5.1 pada max; tanda bintang menunjukkan DeepSWE 4.7 memakai high effort.
| Evaluasi | Grok 4.7 | Grok 4.6 | GPT-5.6 Sol | Fable 5.1 | 4.7 vs 4.6 |
|---|---|---|---|---|---|
| CursorBench 4.0 | 46.3% | 40.4% | 41.7% | 51.8% | +5.9 pp |
| DeepSWE v1.1 | 71.0%* | 65.2% | 72.7% | 70.0% | +5.8 pp |
| EEBench | 64.0% | 53.0% | 39.4% | 56.4% | +11.0 pp |
| AA Briefcase v1.1 | 1,657 | 1,546 | 1,487 | 1,678 | +111 Elo |
| Terminal-Bench 4.0 | 38.0% | 20.3% | 37.3% | 57.9% | +17.7 pp |
| Harvey Legal Agent Benchmark | 19.6% | 15.8% | 2.5% | 6.7% | +3.8 pp |
| HealthBench Professional | 56.7% | 48.5% | 60.5% | 62.1% | +8.2 pp |
Tabel tersebut mendukung satu klaim yang kuat: pada setup xAI sendiri, 4.7 meningkat dari 4.6 di setiap kelompok tugas yang ditampilkan. Tabel tidak membuktikan “Grok 4.7 mengalahkan setiap model”. Fable memimpin CursorBench, AA Briefcase, Terminal-Bench, dan HealthBench; GPT-5.6 Sol memimpin DeepSWE. Harga, effort, harness, penggunaan token, dan kriteria penerimaan juga berbeda.
Untuk coding, peningkatan Terminal-Bench menarik karena evaluasi itu menargetkan pekerjaan terminal berjam-jam. Di sana pula keunggulan Fable paling besar. Ukur kriteria berhasil dan kategori kegagalan, bukan hanya persentase agregat.
Bukti independen yang tersedia
Artificial Analysis telah menambahkan Grok 4.7 pada xhigh saat data diperiksa. Halamannya menampilkan Intelligence Index 46 dan penggunaan output tinggi: 240M tokens di seluruh index dibanding median halaman 92M.
Ini masih snapshot awal. Output speed tercatat N/A dan kolom harga provider belum terisi secara andal. Karena itu kami tidak memakainya untuk memvalidasi klaim “kecepatan sama”, varian Fast, atau biaya per tugas. Skor dapat berubah ketika evaluasi selesai atau suite diperbarui.
- bukti resmi menunjukkan peningkatan konsisten dari 4.6 ke 4.7;
- satu suite independen sudah menempatkan xhigh di rentang frontier;
- belum ada kecepatan independen stabil, p95 latency, atau perbandingan biaya 4.6 yang sepadan;
- workload Anda tetap menjadi pengujian penentu.
Harga API Grok 4.7 dan konteks panjang
Grok 4.7 mempertahankan rate card global langsung yang sama dengan Grok 4.6. Batas saat ini adalah di bawah 200K dan 200K atau lebih. Tepat 200K bukan lagi tarif standar.
| Route | Rentang prompt | Input | Cached input | Output |
|---|---|---|---|---|
| xAI global | Di bawah 200K | $2.00 | $0.50 | $6.00 |
| xAI global | 200K atau lebih | $4.00 | $1.00 | $12.00 |
| xAI US regional | Di bawah 200K | $2.20 | $0.55 | $6.60 |
| xAI US regional | 200K atau lebih | $4.40 | $1.10 | $13.20 |
Semua angka adalah USD per satu juta tokens. Endpoint AS mempertahankan inference di Amerika Serikat dan menambah harga token 10%. Tool calls, penyimpanan, pajak, konversi, dan quote platform pihak ketiga dihitung terpisah.
| Workload | Perhitungan | Biaya token model |
|---|---|---|
| 100K uncached input + 20K output | 0.10 x $2 + 0.02 x $6 | $0.32 |
| 250K uncached input + 20K output | 0.25 x $4 + 0.02 x $12 | $1.24 |
| 50K uncached + 200K cached + 20K output | 0.05 x $4 + 0.20 x $1 + 0.02 x $12 | $0.64 |
Harga cache hanya berlaku saat provider melaporkan cache hit. xAI merekomendasikan prompt_cache_key pada Responses atau x-grok-conv-id pada Chat Completions agar turn terkait tiba di server yang sama. Context compaction penting dalam tool loop panjang karena pengulangan prompt 200K atau lebih menggandakan ketiga tarif.
Untuk varian Fast, ikuti tabel harga
Grok 4.7 Fast adalah model yang sama pada infrastructure lebih cepat. Varian ini hanya tersedia di Cursor dan Grok Build, bukan di public API xAI atau free tier Grok Build.
Halaman harga menyebut Fast “dua kali tarif standar”, lalu mencantumkan $4 / $1 / $12 di bawah 200K dan $6 / $1.50 / $18 pada 200K atau lebih. Baris kedua adalah 1.5x tarif public long-context, bukan 2x. Kutip tabel, jangan menghitung dari prosa, lalu periksa tagihan live sebelum menjalankan volume besar. Cursor menagih lewat plan mereka.
“Dua kali output speed” juga klaim provider, bukan jaminan latensi. Decode throughput tidak mencakup queue, prompt prefill, time to first token, tools, jaringan, atau retries.
Detail API yang penting untuk agen
Responses API selalu mengembalikan reasoning.encrypted_content untuk grok-4.7 walau tidak diminta melalui include. Kirim kembali reasoning items itu tanpa perubahan pada turn berikutnya agar agen multi-turn mempertahankan reasoning state. Perilaku Chat Completions tidak berubah.
Sebelum bermigrasi, verifikasi:
- model ID yang benar-benar dikembalikan dan endpoint;
reasoning_effortyang sama pada kedua generasi;- validitas schema tool call dan perilaku retry;
- prompt, cache read, reasoning, dan visible output tokens;
- first token, end-to-end latency, dan biaya per tugas diterima;
- output length karena xhigh dapat memakai lebih banyak token;
- rollback ke
grok-4.6tanpa mengubah harness.
Contoh request langsung ke xAI Responses:
curl https://api.x.ai/v1/responses \
-H "Authorization: Bearer $XAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-4.7",
"prompt_cache_key": "repo-review-v1",
"input": "Review this patch, run the acceptance criteria, and report any remaining failure."
}'
Gunakan cache key stabil yang bukan rahasia; jangan masukkan API key, email, repository secret, atau ID pelanggan. Base URL dan credential tersebut untuk xAI langsung, bukan konfigurasi OmniaKey.
Di mana Grok 4.7 tersedia?
| Platform | Status 22 September 2026 | Batas penting |
|---|---|---|
| xAI API | Tersedia sebagai grok-4.7 | Varian standar; Fast bukan public API |
| Grok Build | Model default | Fast berbayar dan di luar free tier |
| Cursor | Tersedia di semua plan menurut xAI | Penagihan Fast mengikuti plan Cursor |
| GitHub Copilot | Rollout bertahap diumumkan | Pro, Pro+, Max, Business, Enterprise; admin policy dapat mematikan |
| OpenRouter, Vercel, Cloudflare | Dicantumkan xAI sebagai gateways | Masing-masing mengatur route, harga, dan availability |
| OmniaKey | Belum tercantum saat diperiksa | Cek katalog model live; jangan menebak route |
GitHub menyebut VS Code, Visual Studio, Copilot CLI, cloud agent, Copilot app, JetBrains, Xcode, dan Eclipse. Rollout bertahap tidak berarti picker langsung tersedia bagi setiap akun.
Pengujian Grok 4.6 dan 4.7 yang dapat direproduksi
Pilih 20–50 tugas dari distribusi kegagalan nyata, bukan kumpulan prompt mudah. Bekukan repository revision, system prompt, tools, permissions, effort, timeout, dan acceptance commands.
- diterima tanpa perbaikan, setelah retry, atau gagal;
- schema error, edit salah, test failure, penolakan, dan loop;
- input, cached input, reasoning, dan output tokens;
- first-token dan end-to-end latency pada p50 dan p95;
- model ID dari provider dan total tagihan;
- menit review atau perbaikan manusia.
Pilih 4.7 jika biaya per tugas diterima membaik atau kegagalan penting berkurang. Pertahankan 4.6 bila hasil setara dan route lama lebih sederhana untuk dioperasikan. Untuk lintas keluarga, gunakan panduan model agen coding.
Kesalahan umum dalam ulasan Grok 4.7
Menyebut skor vendor sebagai pengujian independen
Tujuh baris itu berguna, tetapi SpaceXAI memilih dan menjalankannya. Cantumkan sumber dan tingkat effort.
Mengklaim jumlah parameter 2.1T
Angka itu beredar sebelum rilis, tetapi tidak diterbitkan dalam pengumuman atau developer contract. Hanya “new, larger base model” yang dikonfirmasi.
Menganggap konteks 500K gratis
Itu kapasitas prompt maksimal. Pada 200K tokens, seluruh request masuk ke tier harga langsung yang lebih tinggi.
Menganggap Fast sebagai model ID public API
Fast adalah opsi serving di Cursor dan Grok Build. Public API xAI mendokumentasikan grok-4.7, bukan slug Fast.
Menganggap rilis berarti tersedia di OmniaKey
Peluncuran provider dan onboarding gateway adalah peristiwa terpisah. Belum ada route publik OmniaKey 4.7 pada tanggal pemeriksaan.
Pertanyaan umum
Kapan Grok 4.7 dirilis?
SpaceXAI merilisnya pada 21 September 2026. ID model API langsung adalah grok-4.7.
Apakah Grok 4.7 lebih baik daripada Grok 4.6?
Model ini adalah kandidat lebih kuat untuk diuji pertama. xAI melaporkan hasil lebih tinggi pada setiap perbandingan dengan harga langsung sama. Pengujian workload sepadan tetap perlu karena effort, token, tools, dan kegagalan memengaruhi nilai production.
Berapa harga API Grok 4.7?
Pada endpoint global, di bawah 200K biayanya $2 input, $0.50 cached input, dan $6 output per juta. Mulai 200K tarifnya $4, $1, dan $12.
Berapa jendela konteks Grok 4.7?
500,000 tokens. Start guide saat ini tidak menetapkan batas text output, tetapi batas rate, waktu, dan anggaran tetap berlaku.
Berapa jumlah parameter Grok 4.7?
SpaceXAI tidak menerbitkan angka di pengumuman atau halaman model developer. Yang dikonfirmasi hanya base model baru dan lebih besar dari 4.6.
Apakah Grok 4.7 mendukung gambar dan tools?
Ya. Model menerima teks dan gambar, menghasilkan teks, serta mendukung function calling, structured output, web search, X search, dan code execution.
Apakah Grok 4.7 tersedia di OmniaKey?
Belum pada pemeriksaan 22 September. Katalog publik menampilkan Grok 4.6 dan 4.5, tetapi tidak grok-4.7. Periksa katalog live.
Sumber yang diperiksa
- SpaceXAI: peluncuran Grok 4.7
- SpaceXAI: panduan awal Grok 4.7
- SpaceXAI: halaman model Grok 4.7
- SpaceXAI: harga API
- SpaceXAI: release notes
- Artificial Analysis: Grok 4.7 xhigh
- GitHub: Grok 4.7 di Copilot
- OpenRouter: route Grok 4.7
- Katalog model live OmniaKey
Diverifikasi pada 22 September 2026. Availability model, skor dinamis, harga, dan rollout platform dapat berubah; periksa sumber primer dan katalog live sebelum migrasi production.