Jev modeli artık entegre ve kullanımda · Hoş geldiniz
Blog
Rehber

Grok 4.7 incelemesi

Grok 4.7, uzun süreli kodlama ve bilgi ajanlarında aynı fiyata önce denenmesi gereken bir yükseltme; ancak xAI sonuçları kendi iş yükünüzdeki testi yerine geçmez.

13 dk okumaOmniaKey
Grok 4.7Grok 4.6API fiyatıkodlama benchmarkmodel incelemesi

Bu Grok 4.7 incelemesi, lansman başlıklarından daha sınırlı bir sonuca varıyor. Uzun süreli kodlama, araç kullanımı ve profesyonel bilgi işleri için önce 4.7'yi değerlendirmek mantıklı: xAI'ın yayımladığı yedi Grok 4.6 karşılaştırmasının tamamında ilerlerken standart API fiyatını ve 500K bağlamı koruyor. Bu, her işte üstün olduğunun kanıtı değil. Resmi tablo farklı reasoning effort düzeylerini karıştırıyor ve ücretli isteklerle kendi benchmark testimizi çalıştırmadık.

SpaceXAI, grok-4.7 modelini 21 Eylül 2026 tarihinde yayımladı. xAI public API modeli sunuyor; ancak 22 Eylül'deki kontrolde OmniaKey public katalogda model yoktu. Canlı katalog değişene kadar OmniaKey'de Grok 4.6 kullanın veya tam 4.7 ID'sini gerçekten sunan bir sağlayıcı seçin.

Bilgiler 22 Eylül 2026'da doğrulandı. Teknik özellikler ve lansman skorları SpaceXAI duyurusu ile geliştirici belgelerinden geliyor. Artificial Analysis erken bir xhigh Intelligence Index yayımlamıştı, fakat hız ve sağlayıcı fiyatı alanları eksikti. Private preview, xAI credential veya doğrudan gecikme ölçümü kullanmadık. Sağlayıcı sonuçlarını, bağımsız veriyi ve önerimizi ayrı tutuyoruz.

Grok 4.7 incelemesi: kısa karar

Yeni uzun süreli ajan işleri için 4.6'dan önce 4.7'yi test edin. En anlamlı kanıt nesil farkı: xAI, yedi doğrudan karşılaştırmanın tamamında 4.7 için daha yüksek sonuç bildiriyor; Terminal-Bench 4.0 ve EEBench artışları belirgin, standart token tarifesi aynı.

Yalnızca lansman başlığıyla geçiş yapmayın. Tabloda Grok 4.7 xhigh, Grok 4.6 high, diğer frontier modeller max düzeyinde; 4.7 DeepSWE ayrıca high effort olarak işaretli. Bu ayar token kullanımını, gecikmeyi ve davranışı değiştirebilir.

Kendi görevleriniz geçene kadar 4.6'yı rollback olarak tutun. İki nesilde de 500K bağlam ve aynı doğrudan fiyat var. Aşamalı değerlendirme, tool call, ret, gereksiz uzunluk veya çıktı formatı regresyonunu production'da bulmaktan ucuzdur.

Çıkış tarihi ve teknik özellikler

ÖzellikGrok 4.7 sözleşmesi
Çıkış tarihi21 Eylül 2026
API model IDgrok-4.7
Girdi / çıktıMetin ve görsel / metin
Bağlam penceresi500,000 tokens
Bilgi kesim tarihiMayıs 2026
Reasoning effortlow, medium, high (varsayılan), xhigh
API'lerResponses API ve Chat Completions
YeteneklerFunction calling, structured outputs, web search, X search, code execution
Batch APIDesteklenmiyor
200K altı prompt için global doğrudan fiyat1M başına $2 input / $0.50 cache / $6 output
200K ve üzeri prompt için global doğrudan fiyat1M başına $4 input / $1 cache / $12 output

500K bir kapasitedir, ücretsiz kota değildir. Prompt 200K tokens düzeyine ulaştığında yüksek fiyat istekteki tüm tokenlara uygulanır. Start guide metin çıktısı sınırı belirtmiyor; ancak rate limits, gecikme, bütçe ve endpoint davranışı gerçek workload'u sınırlar.

Grok 4.6'ya göre ne değişti?

SpaceXAI yeni ve daha büyük bir base model, zor ve saatler süren görevlere odaklanan daha uzun reinforcement learning, iyileştirilmiş self-verification ve uzun bağlam yönetimi, Grok Bot harness için native anlayış ve yeni safeguards duyurdu.

Bunlar lansman açıklamalarıdır; bağımsız denetlenmiş architecture sonuçları değildir. Şirket duyuruda veya güncel model sözleşmesinde parameter sayısı yayımlamıyor.

Karar noktasıGrok 4.7Grok 4.6Anlamı
Base / eğitimYeni büyük base; zor uzun görevlerde daha uzun RLÖnceki nesilUzun ajanları yeniden test etme nedeni
Standart doğrudan fiyat$2 / $0.50 / $6$2 / $0.50 / $6Yükseltmede liste fiyatı farkı yok
Uzun bağlam fiyatı$4 / $1 / $12$4 / $1 / $12200K eşiğinde aynı ekonomi
Bağlam500K500KKapasite artışı yok
Reasoninglow–xhigh; high varsayılanlow–xhigh; high varsayılanKarşılaştırmada aynı effort'u sabitleyin
BatchDesteklenmiyorDesteklenmiyorVarsayımsal Batch indirimi bütçelemeyin
Lansman odağıKodlama, ajan, bilgi işi, öz denetimKodlama ve uzun ajanlarYeni modality değil güvenilirlik

Pratik yükseltme, daha büyük bağlam veya ucuz token değil, aynı liste fiyatındaki iddia edilen görev performansıdır. OmniaKey'de şu anda listelenen route için ayrıntılı bütçe kaynağı Grok 4.6 API fiyat rehberi olmaya devam ediyor.

Grok 4.7 benchmark sonuçlarını okuma

Bunlar SpaceXAI tarafından bildirilen sonuçlardır ve OmniaKey tarafından tekrar edilmemiştir. Yayıncı 4.7 için xhigh, 4.6 için high, GPT-5.6 Sol ve Fable 5.1 için max gösteriyor; yıldız 4.7 DeepSWE sonucunun high effort olduğunu belirtiyor.

DeğerlendirmeGrok 4.7Grok 4.6GPT-5.6 SolFable 5.14.7 ve 4.6 farkı
CursorBench 4.046.3%40.4%41.7%51.8%+5.9 pp
DeepSWE v1.171.0%*65.2%72.7%70.0%+5.8 pp
EEBench64.0%53.0%39.4%56.4%+11.0 pp
AA Briefcase v1.11,6571,5461,4871,678+111 Elo
Terminal-Bench 4.038.0%20.3%37.3%57.9%+17.7 pp
Harvey Legal Agent Benchmark19.6%15.8%2.5%6.7%+3.8 pp
HealthBench Professional56.7%48.5%60.5%62.1%+8.2 pp

Tablo tek bir sağlam iddiayı destekliyor: xAI'ın kendi kurulumunda 4.7, gösterilen tüm görev ailelerinde 4.6'yı geliştiriyor. “Grok 4.7 her modeli yener” demiyor. Fable, CursorBench, AA Briefcase, Terminal-Bench ve HealthBench'te; GPT-5.6 Sol ise DeepSWE'de önde. Fiyat, effort, harness, token kullanımı ve kabul ölçütleri de farklı.

Kodlama için Terminal-Bench artışı dikkat çekici; test saatler süren terminal işini hedefliyor. Aynı zamanda Fable farkının en büyük olduğu yer. Yalnızca toplam yüzdeyi değil, başarı kriterini ve hata türlerini ölçün.

Hangi bağımsız kanıt var?

Kontrol tarihinde Artificial Analysis, Grok 4.7 xhigh için Intelligence Index 46 gösteriyordu. Sayfa ayrıca index boyunca 240M output tokens kullanımını ve 92M sayfa medyanını gösteriyordu.

Bu erken bir snapshot. Output speed N/A idi ve provider fiyat alanları güvenilir biçimde dolmamıştı. Bu yüzden xAI'ın “aynı hız” söylemini, Fast'i veya görev başına maliyeti doğrulamak için kullanmıyoruz. Değerlendirme tamamlandıkça ya da suite değiştikçe skor hareket edebilir.

  • resmi kanıt 4.6'dan 4.7'ye tutarlı bir iyileşme gösteriyor;
  • bir bağımsız suite xhigh'ı frontier aralığına yerleştiriyor;
  • kararlı bağımsız hız, p95 latency ve eşlenmiş 4.6 maliyet karşılaştırması yoktu;
  • belirleyici test kendi workload'unuzdur.

Grok 4.7 API fiyatı ve uzun bağlam

Grok 4.7, Grok 4.6 ile aynı global doğrudan tarifeyi kullanıyor. Güncel eşik 200K altı ile 200K ve üzeri arasındadır. Tam 200K standart fiyat değildir.

RoutePrompt aralığıInputCached inputOutput
xAI global200K altı$2.00$0.50$6.00
xAI global200K ve üzeri$4.00$1.00$12.00
xAI US regional200K altı$2.20$0.55$6.60
xAI US regional200K ve üzeri$4.40$1.10$13.20

Tüm değerler bir milyon token başına USD'dir. US endpoint inference'ı ABD içinde tutar ve token fiyatına %10 ekler. Tool calls, depolama, vergi, kur dönüşümü ve third-party platform fiyatı ayrıdır.

WorkloadHesapModel token maliyeti
100K uncached input + 20K output0.10 x $2 + 0.02 x $6$0.32
250K uncached input + 20K output0.25 x $4 + 0.02 x $12$1.24
50K uncached + 200K cached + 20K output0.05 x $4 + 0.20 x $1 + 0.02 x $12$0.64

Cache fiyatı yalnızca sağlayıcı cache hit bildirdiğinde geçerlidir. xAI, ilişkili turn'lerin aynı server'a ulaşması için Responses'ta prompt_cache_key, Chat Completions'ta x-grok-conv-id öneriyor. Uzun tool loop'larda context compaction önemlidir; tekrarlanan 200K üzeri prompt üç token tarifesini de ikiye katlar.

Fast sürümünde fiyat tablosunu okuyun

Grok 4.7 Fast, aynı modeli daha hızlı infrastructure üzerinde sunuyor. Yalnızca Cursor ve Grok Build'de var; public xAI API veya Grok Build free tier içinde değil.

Güncel fiyat sayfası Fast için “standart token tarifesinin iki katı” diyor, fakat tabloda 200K altında $4 / $1 / $12, 200K ve üzerinde $6 / $1.50 / $18 listeliyor. İkinci satır public long-context fiyatının 1.5 katıdır, 2 katı değil. Metinden fiyat türetmek yerine tabloyu kullanın ve büyük çalışmadan önce canlı faturayı doğrulayın. Cursor kendi planı üzerinden ücretlendirir.

“İki kat output speed” de sağlayıcı iddiasıdır, latency garantisi değildir. Decode throughput; queue, prompt prefill, time to first token, tools, ağ ve retries sürelerini kapsamaz.

Ajanlarda önemli API ayrıntıları

Responses API, include içinde istenmese de grok-4.7 için her zaman reasoning.encrypted_content döndürür. Multi-turn ajan reasoning state'ini korumak için bu öğeleri sonraki turn'e değiştirmeden gönderin. Chat Completions davranışı değişmedi.

Geçişten önce şunları doğrulayın:

  1. gerçekten dönen model ID ve endpoint;
  2. iki nesilde aynı reasoning_effort;
  3. tool-call schema geçerliliği ve retry davranışı;
  4. prompt, cache read, reasoning ve görünür output tokens;
  5. first token, end-to-end latency ve kabul edilen görev maliyeti;
  6. xhigh daha çok token harcayabileceği için output length;
  7. harness değişmeden grok-4.6 rollback.

Doğrudan xAI Responses isteği:

bash
curl https://api.x.ai/v1/responses \
  -H "Authorization: Bearer $XAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-4.7",
    "prompt_cache_key": "repo-review-v1",
    "input": "Review this patch, run the acceptance criteria, and report any remaining failure."
  }'

Gizli olmayan, kararlı bir cache key kullanın; API key, e-posta, repository secret veya müşteri ID'si eklemeyin. Bu base URL ve credential doğrudan xAI içindir, OmniaKey ayarı değildir.

Grok 4.7 nerede kullanılabilir?

Platform22 Eylül 2026 durumuÖnemli sınır
xAI APIgrok-4.7 olarak mevcutStandart sürüm; Fast public API değil
Grok BuildVarsayılan modelFast ücretli ve free tier dışında
CursorxAI'a göre tüm planlarda mevcutFast ücreti Cursor planına bağlı
GitHub CopilotKademeli rollout duyurulduPro, Pro+, Max, Business, Enterprise; admin policy kapatabilir
OpenRouter, Vercel, CloudflarexAI bunları gateway olarak listeliyorRoute, fiyat ve availability her platforma ait
OmniaKeyKontrol tarihinde listelenmiyorduCanlı model kataloğunu kontrol edin; route tahmin etmeyin

GitHub; VS Code, Visual Studio, Copilot CLI, cloud agent, Copilot app, JetBrains, Xcode ve Eclipse'i kapsadığını belirtiyor. Kademeli rollout, her hesabın model seçicisinde hemen görünmesi demek değildir.

Tekrarlanabilir Grok 4.6 ve 4.7 testi

Kolay prompt koleksiyonu yerine gerçek hata dağılımınızdan 20–50 görev seçin. Repository revision, system prompt, tools, permissions, effort, timeout ve acceptance komutlarını sabitleyin.

  • düzeltmesiz kabul, retry sonrası kabul veya hata;
  • schema hatası, yanlış değişiklik, test failure, ret ve loop;
  • input, cached input, reasoning ve output tokens;
  • first-token ve end-to-end latency için p50 ve p95;
  • sağlayıcının döndürdüğü model ID ve toplam fatura;
  • insan review veya düzeltme dakikaları.

Kabul edilen görev maliyeti iyileşiyor ya da önemli hata türleri azalıyorsa 4.7'yi seçin. Sonuçlar eşitse ve mevcut route daha kolay işletiliyorsa 4.6'da kalın. Aileler arası karar için kodlama ajanı model rehberine bakın.

Yaygın Grok 4.7 inceleme hataları

Sağlayıcı skoruna bağımsız test demek

Yedi satırlık tablo faydalı, ancak seçimi ve çalıştırmayı SpaceXAI yaptı. Kaynağı ve effort düzeylerini görünür tutun.

2.1T parameter sayısını gerçek kabul etmek

Sayı lansman öncesinde konuşuldu, fakat duyuru ve güncel developer contract bir değer yayımlamıyor. Yalnızca “new, larger base model” doğrulanmış durumda.

500K bağlamı ücretsiz sanmak

Bu maksimum prompt kapasitesidir. 200K tokens düzeyinde isteğin tamamı yüksek doğrudan fiyat katmanına girer.

Fast'i public API model ID sanmak

Cursor ve Grok Build içindeki serving seçeneğidir. Public xAI API belgelenen ID olarak grok-4.7 sunar.

Lansmanı OmniaKey kullanılabilirliğiyle eşitlemek

Provider lansmanı ve gateway onboarding ayrı olaylardır. Doğrulama tarihinde public OmniaKey 4.7 route yoktu.

Sık sorulan sorular

Grok 4.7 ne zaman çıktı?

21 Eylül 2026'da yayımlandı. Doğrudan API model ID'si grok-4.7.

Grok 4.7, Grok 4.6'dan daha mı iyi?

Önce test etmek için daha güçlü adaydır. xAI, aynı doğrudan token fiyatında gösterdiği tüm 4.6 karşılaştırmalarından yüksek sonuç bildiriyor. Effort, token, tools ve hata türleri nedeniyle eşlenmiş workload testi gerekir.

Grok 4.7 API fiyatı ne kadar?

Global endpoint'te 200K altı için milyon başına input $2, cached input $0.50, output $6. 200K ve üzerinde $4, $1 ve $12.

Grok 4.7 bağlam penceresi kaç token?

500,000 tokens. Start guide metin çıktı sınırı belirtmiyor; rate, süre ve bütçe sınırları yine geçerli.

Grok 4.7 kaç parametreye sahip?

SpaceXAI duyuruda veya developer model sayfasında sayı yayımlamadı. Yalnızca 4.6'dan yeni ve daha büyük bir base model doğrulandı.

Görsel ve araç desteği var mı?

Evet. Metin ve görsel girdi alır, metin üretir; function calling, structured output, web search, X search ve code execution destekler.

Grok 4.7 OmniaKey'de mevcut mu?

22 Eylül kontrolünde değildi. Public katalog Grok 4.6 ve 4.5'i listeliyor, grok-4.7 göstermiyordu. Canlı kataloğu kontrol edin.

Kontrol edilen kaynaklar

22 Eylül 2026'da doğrulandı. Model availability, dinamik bağımsız skorlar, fiyatlar ve rollout değişebilir; production geçişinden önce birincil kaynakları ve canlı kataloğu yeniden kontrol edin.