Grok 4.7 incelemesi
Grok 4.7, uzun süreli kodlama ve bilgi ajanlarında aynı fiyata önce denenmesi gereken bir yükseltme; ancak xAI sonuçları kendi iş yükünüzdeki testi yerine geçmez.
Bu Grok 4.7 incelemesi, lansman başlıklarından daha sınırlı bir sonuca varıyor. Uzun süreli kodlama, araç kullanımı ve profesyonel bilgi işleri için önce 4.7'yi değerlendirmek mantıklı: xAI'ın yayımladığı yedi Grok 4.6 karşılaştırmasının tamamında ilerlerken standart API fiyatını ve 500K bağlamı koruyor. Bu, her işte üstün olduğunun kanıtı değil. Resmi tablo farklı reasoning effort düzeylerini karıştırıyor ve ücretli isteklerle kendi benchmark testimizi çalıştırmadık.
SpaceXAI, grok-4.7 modelini 21 Eylül 2026 tarihinde yayımladı. xAI public API modeli sunuyor; ancak 22 Eylül'deki kontrolde OmniaKey public katalogda model yoktu. Canlı katalog değişene kadar OmniaKey'de Grok 4.6 kullanın veya tam 4.7 ID'sini gerçekten sunan bir sağlayıcı seçin.
Bilgiler 22 Eylül 2026'da doğrulandı. Teknik özellikler ve lansman skorları SpaceXAI duyurusu ile geliştirici belgelerinden geliyor. Artificial Analysis erken bir xhigh Intelligence Index yayımlamıştı, fakat hız ve sağlayıcı fiyatı alanları eksikti. Private preview, xAI credential veya doğrudan gecikme ölçümü kullanmadık. Sağlayıcı sonuçlarını, bağımsız veriyi ve önerimizi ayrı tutuyoruz.
Grok 4.7 incelemesi: kısa karar
Yeni uzun süreli ajan işleri için 4.6'dan önce 4.7'yi test edin. En anlamlı kanıt nesil farkı: xAI, yedi doğrudan karşılaştırmanın tamamında 4.7 için daha yüksek sonuç bildiriyor; Terminal-Bench 4.0 ve EEBench artışları belirgin, standart token tarifesi aynı.
Yalnızca lansman başlığıyla geçiş yapmayın. Tabloda Grok 4.7 xhigh, Grok 4.6 high, diğer frontier modeller max düzeyinde; 4.7 DeepSWE ayrıca high effort olarak işaretli. Bu ayar token kullanımını, gecikmeyi ve davranışı değiştirebilir.
Kendi görevleriniz geçene kadar 4.6'yı rollback olarak tutun. İki nesilde de 500K bağlam ve aynı doğrudan fiyat var. Aşamalı değerlendirme, tool call, ret, gereksiz uzunluk veya çıktı formatı regresyonunu production'da bulmaktan ucuzdur.
Çıkış tarihi ve teknik özellikler
| Özellik | Grok 4.7 sözleşmesi |
|---|---|
| Çıkış tarihi | 21 Eylül 2026 |
| API model ID | grok-4.7 |
| Girdi / çıktı | Metin ve görsel / metin |
| Bağlam penceresi | 500,000 tokens |
| Bilgi kesim tarihi | Mayıs 2026 |
| Reasoning effort | low, medium, high (varsayılan), xhigh |
| API'ler | Responses API ve Chat Completions |
| Yetenekler | Function calling, structured outputs, web search, X search, code execution |
| Batch API | Desteklenmiyor |
| 200K altı prompt için global doğrudan fiyat | 1M başına $2 input / $0.50 cache / $6 output |
| 200K ve üzeri prompt için global doğrudan fiyat | 1M başına $4 input / $1 cache / $12 output |
500K bir kapasitedir, ücretsiz kota değildir. Prompt 200K tokens düzeyine ulaştığında yüksek fiyat istekteki tüm tokenlara uygulanır. Start guide metin çıktısı sınırı belirtmiyor; ancak rate limits, gecikme, bütçe ve endpoint davranışı gerçek workload'u sınırlar.
Grok 4.6'ya göre ne değişti?
SpaceXAI yeni ve daha büyük bir base model, zor ve saatler süren görevlere odaklanan daha uzun reinforcement learning, iyileştirilmiş self-verification ve uzun bağlam yönetimi, Grok Bot harness için native anlayış ve yeni safeguards duyurdu.
Bunlar lansman açıklamalarıdır; bağımsız denetlenmiş architecture sonuçları değildir. Şirket duyuruda veya güncel model sözleşmesinde parameter sayısı yayımlamıyor.
| Karar noktası | Grok 4.7 | Grok 4.6 | Anlamı |
|---|---|---|---|
| Base / eğitim | Yeni büyük base; zor uzun görevlerde daha uzun RL | Önceki nesil | Uzun ajanları yeniden test etme nedeni |
| Standart doğrudan fiyat | $2 / $0.50 / $6 | $2 / $0.50 / $6 | Yükseltmede liste fiyatı farkı yok |
| Uzun bağlam fiyatı | $4 / $1 / $12 | $4 / $1 / $12 | 200K eşiğinde aynı ekonomi |
| Bağlam | 500K | 500K | Kapasite artışı yok |
| Reasoning | low–xhigh; high varsayılan | low–xhigh; high varsayılan | Karşılaştırmada aynı effort'u sabitleyin |
| Batch | Desteklenmiyor | Desteklenmiyor | Varsayımsal Batch indirimi bütçelemeyin |
| Lansman odağı | Kodlama, ajan, bilgi işi, öz denetim | Kodlama ve uzun ajanlar | Yeni modality değil güvenilirlik |
Pratik yükseltme, daha büyük bağlam veya ucuz token değil, aynı liste fiyatındaki iddia edilen görev performansıdır. OmniaKey'de şu anda listelenen route için ayrıntılı bütçe kaynağı Grok 4.6 API fiyat rehberi olmaya devam ediyor.
Grok 4.7 benchmark sonuçlarını okuma
Bunlar SpaceXAI tarafından bildirilen sonuçlardır ve OmniaKey tarafından tekrar edilmemiştir. Yayıncı 4.7 için xhigh, 4.6 için high, GPT-5.6 Sol ve Fable 5.1 için max gösteriyor; yıldız 4.7 DeepSWE sonucunun high effort olduğunu belirtiyor.
| Değerlendirme | Grok 4.7 | Grok 4.6 | GPT-5.6 Sol | Fable 5.1 | 4.7 ve 4.6 farkı |
|---|---|---|---|---|---|
| CursorBench 4.0 | 46.3% | 40.4% | 41.7% | 51.8% | +5.9 pp |
| DeepSWE v1.1 | 71.0%* | 65.2% | 72.7% | 70.0% | +5.8 pp |
| EEBench | 64.0% | 53.0% | 39.4% | 56.4% | +11.0 pp |
| AA Briefcase v1.1 | 1,657 | 1,546 | 1,487 | 1,678 | +111 Elo |
| Terminal-Bench 4.0 | 38.0% | 20.3% | 37.3% | 57.9% | +17.7 pp |
| Harvey Legal Agent Benchmark | 19.6% | 15.8% | 2.5% | 6.7% | +3.8 pp |
| HealthBench Professional | 56.7% | 48.5% | 60.5% | 62.1% | +8.2 pp |
Tablo tek bir sağlam iddiayı destekliyor: xAI'ın kendi kurulumunda 4.7, gösterilen tüm görev ailelerinde 4.6'yı geliştiriyor. “Grok 4.7 her modeli yener” demiyor. Fable, CursorBench, AA Briefcase, Terminal-Bench ve HealthBench'te; GPT-5.6 Sol ise DeepSWE'de önde. Fiyat, effort, harness, token kullanımı ve kabul ölçütleri de farklı.
Kodlama için Terminal-Bench artışı dikkat çekici; test saatler süren terminal işini hedefliyor. Aynı zamanda Fable farkının en büyük olduğu yer. Yalnızca toplam yüzdeyi değil, başarı kriterini ve hata türlerini ölçün.
Hangi bağımsız kanıt var?
Kontrol tarihinde Artificial Analysis, Grok 4.7 xhigh için Intelligence Index 46 gösteriyordu. Sayfa ayrıca index boyunca 240M output tokens kullanımını ve 92M sayfa medyanını gösteriyordu.
Bu erken bir snapshot. Output speed N/A idi ve provider fiyat alanları güvenilir biçimde dolmamıştı. Bu yüzden xAI'ın “aynı hız” söylemini, Fast'i veya görev başına maliyeti doğrulamak için kullanmıyoruz. Değerlendirme tamamlandıkça ya da suite değiştikçe skor hareket edebilir.
- resmi kanıt 4.6'dan 4.7'ye tutarlı bir iyileşme gösteriyor;
- bir bağımsız suite xhigh'ı frontier aralığına yerleştiriyor;
- kararlı bağımsız hız, p95 latency ve eşlenmiş 4.6 maliyet karşılaştırması yoktu;
- belirleyici test kendi workload'unuzdur.
Grok 4.7 API fiyatı ve uzun bağlam
Grok 4.7, Grok 4.6 ile aynı global doğrudan tarifeyi kullanıyor. Güncel eşik 200K altı ile 200K ve üzeri arasındadır. Tam 200K standart fiyat değildir.
| Route | Prompt aralığı | Input | Cached input | Output |
|---|---|---|---|---|
| xAI global | 200K altı | $2.00 | $0.50 | $6.00 |
| xAI global | 200K ve üzeri | $4.00 | $1.00 | $12.00 |
| xAI US regional | 200K altı | $2.20 | $0.55 | $6.60 |
| xAI US regional | 200K ve üzeri | $4.40 | $1.10 | $13.20 |
Tüm değerler bir milyon token başına USD'dir. US endpoint inference'ı ABD içinde tutar ve token fiyatına %10 ekler. Tool calls, depolama, vergi, kur dönüşümü ve third-party platform fiyatı ayrıdır.
| Workload | Hesap | Model token maliyeti |
|---|---|---|
| 100K uncached input + 20K output | 0.10 x $2 + 0.02 x $6 | $0.32 |
| 250K uncached input + 20K output | 0.25 x $4 + 0.02 x $12 | $1.24 |
| 50K uncached + 200K cached + 20K output | 0.05 x $4 + 0.20 x $1 + 0.02 x $12 | $0.64 |
Cache fiyatı yalnızca sağlayıcı cache hit bildirdiğinde geçerlidir. xAI, ilişkili turn'lerin aynı server'a ulaşması için Responses'ta prompt_cache_key, Chat Completions'ta x-grok-conv-id öneriyor. Uzun tool loop'larda context compaction önemlidir; tekrarlanan 200K üzeri prompt üç token tarifesini de ikiye katlar.
Fast sürümünde fiyat tablosunu okuyun
Grok 4.7 Fast, aynı modeli daha hızlı infrastructure üzerinde sunuyor. Yalnızca Cursor ve Grok Build'de var; public xAI API veya Grok Build free tier içinde değil.
Güncel fiyat sayfası Fast için “standart token tarifesinin iki katı” diyor, fakat tabloda 200K altında $4 / $1 / $12, 200K ve üzerinde $6 / $1.50 / $18 listeliyor. İkinci satır public long-context fiyatının 1.5 katıdır, 2 katı değil. Metinden fiyat türetmek yerine tabloyu kullanın ve büyük çalışmadan önce canlı faturayı doğrulayın. Cursor kendi planı üzerinden ücretlendirir.
“İki kat output speed” de sağlayıcı iddiasıdır, latency garantisi değildir. Decode throughput; queue, prompt prefill, time to first token, tools, ağ ve retries sürelerini kapsamaz.
Ajanlarda önemli API ayrıntıları
Responses API, include içinde istenmese de grok-4.7 için her zaman reasoning.encrypted_content döndürür. Multi-turn ajan reasoning state'ini korumak için bu öğeleri sonraki turn'e değiştirmeden gönderin. Chat Completions davranışı değişmedi.
Geçişten önce şunları doğrulayın:
- gerçekten dönen model ID ve endpoint;
- iki nesilde aynı
reasoning_effort; - tool-call schema geçerliliği ve retry davranışı;
- prompt, cache read, reasoning ve görünür output tokens;
- first token, end-to-end latency ve kabul edilen görev maliyeti;
- xhigh daha çok token harcayabileceği için output length;
- harness değişmeden
grok-4.6rollback.
Doğrudan xAI Responses isteği:
curl https://api.x.ai/v1/responses \
-H "Authorization: Bearer $XAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-4.7",
"prompt_cache_key": "repo-review-v1",
"input": "Review this patch, run the acceptance criteria, and report any remaining failure."
}'
Gizli olmayan, kararlı bir cache key kullanın; API key, e-posta, repository secret veya müşteri ID'si eklemeyin. Bu base URL ve credential doğrudan xAI içindir, OmniaKey ayarı değildir.
Grok 4.7 nerede kullanılabilir?
| Platform | 22 Eylül 2026 durumu | Önemli sınır |
|---|---|---|
| xAI API | grok-4.7 olarak mevcut | Standart sürüm; Fast public API değil |
| Grok Build | Varsayılan model | Fast ücretli ve free tier dışında |
| Cursor | xAI'a göre tüm planlarda mevcut | Fast ücreti Cursor planına bağlı |
| GitHub Copilot | Kademeli rollout duyuruldu | Pro, Pro+, Max, Business, Enterprise; admin policy kapatabilir |
| OpenRouter, Vercel, Cloudflare | xAI bunları gateway olarak listeliyor | Route, fiyat ve availability her platforma ait |
| OmniaKey | Kontrol tarihinde listelenmiyordu | Canlı model kataloğunu kontrol edin; route tahmin etmeyin |
GitHub; VS Code, Visual Studio, Copilot CLI, cloud agent, Copilot app, JetBrains, Xcode ve Eclipse'i kapsadığını belirtiyor. Kademeli rollout, her hesabın model seçicisinde hemen görünmesi demek değildir.
Tekrarlanabilir Grok 4.6 ve 4.7 testi
Kolay prompt koleksiyonu yerine gerçek hata dağılımınızdan 20–50 görev seçin. Repository revision, system prompt, tools, permissions, effort, timeout ve acceptance komutlarını sabitleyin.
- düzeltmesiz kabul, retry sonrası kabul veya hata;
- schema hatası, yanlış değişiklik, test failure, ret ve loop;
- input, cached input, reasoning ve output tokens;
- first-token ve end-to-end latency için p50 ve p95;
- sağlayıcının döndürdüğü model ID ve toplam fatura;
- insan review veya düzeltme dakikaları.
Kabul edilen görev maliyeti iyileşiyor ya da önemli hata türleri azalıyorsa 4.7'yi seçin. Sonuçlar eşitse ve mevcut route daha kolay işletiliyorsa 4.6'da kalın. Aileler arası karar için kodlama ajanı model rehberine bakın.
Yaygın Grok 4.7 inceleme hataları
Sağlayıcı skoruna bağımsız test demek
Yedi satırlık tablo faydalı, ancak seçimi ve çalıştırmayı SpaceXAI yaptı. Kaynağı ve effort düzeylerini görünür tutun.
2.1T parameter sayısını gerçek kabul etmek
Sayı lansman öncesinde konuşuldu, fakat duyuru ve güncel developer contract bir değer yayımlamıyor. Yalnızca “new, larger base model” doğrulanmış durumda.
500K bağlamı ücretsiz sanmak
Bu maksimum prompt kapasitesidir. 200K tokens düzeyinde isteğin tamamı yüksek doğrudan fiyat katmanına girer.
Fast'i public API model ID sanmak
Cursor ve Grok Build içindeki serving seçeneğidir. Public xAI API belgelenen ID olarak grok-4.7 sunar.
Lansmanı OmniaKey kullanılabilirliğiyle eşitlemek
Provider lansmanı ve gateway onboarding ayrı olaylardır. Doğrulama tarihinde public OmniaKey 4.7 route yoktu.
Sık sorulan sorular
Grok 4.7 ne zaman çıktı?
21 Eylül 2026'da yayımlandı. Doğrudan API model ID'si grok-4.7.
Grok 4.7, Grok 4.6'dan daha mı iyi?
Önce test etmek için daha güçlü adaydır. xAI, aynı doğrudan token fiyatında gösterdiği tüm 4.6 karşılaştırmalarından yüksek sonuç bildiriyor. Effort, token, tools ve hata türleri nedeniyle eşlenmiş workload testi gerekir.
Grok 4.7 API fiyatı ne kadar?
Global endpoint'te 200K altı için milyon başına input $2, cached input $0.50, output $6. 200K ve üzerinde $4, $1 ve $12.
Grok 4.7 bağlam penceresi kaç token?
500,000 tokens. Start guide metin çıktı sınırı belirtmiyor; rate, süre ve bütçe sınırları yine geçerli.
Grok 4.7 kaç parametreye sahip?
SpaceXAI duyuruda veya developer model sayfasında sayı yayımlamadı. Yalnızca 4.6'dan yeni ve daha büyük bir base model doğrulandı.
Görsel ve araç desteği var mı?
Evet. Metin ve görsel girdi alır, metin üretir; function calling, structured output, web search, X search ve code execution destekler.
Grok 4.7 OmniaKey'de mevcut mu?
22 Eylül kontrolünde değildi. Public katalog Grok 4.6 ve 4.5'i listeliyor, grok-4.7 göstermiyordu. Canlı kataloğu kontrol edin.
Kontrol edilen kaynaklar
- SpaceXAI: Grok 4.7 duyurusu
- SpaceXAI: Grok 4.7 başlangıç rehberi
- SpaceXAI: Grok 4.7 model sayfası
- SpaceXAI: API fiyatları
- SpaceXAI: release notes
- Artificial Analysis: Grok 4.7 xhigh
- GitHub: Copilot'ta Grok 4.7
- OpenRouter: Grok 4.7 route
- OmniaKey canlı model kataloğu
22 Eylül 2026'da doğrulandı. Model availability, dinamik bağımsız skorlar, fiyatlar ve rollout değişebilir; production geçişinden önce birincil kaynakları ve canlı kataloğu yeniden kontrol edin.