Claude Code Token Kullanımını Azaltma
En büyük tasarruf genellikle son yanıtı kısaltmaktan değil, tekrar taşınan bağlamı küçültmekten ve yeniden çalışmayı önlemekten gelir.
Claude Code token kullanımını azaltma süreci, modelin her turda yeniden işlemesi gereken içeriği kontrol etmekle başlar. Son yanıt kısa olsa bile uzun konuşma geçmişi, okunan dosyalar, komut çıktıları, proje talimatları, araç tanımları ve extended thinking isteği pahalı hale getirebilir.
Doğru hedef, tek bir yanıttaki en düşük token sayısı değildir. Araştırma, düzenleme, test, düzeltme ve insan incelemesi dahil kabul edilmiş bir değişikliğin toplam maliyetidir.
Yanıt başına token yerine kabul edilmiş değişiklik başına maliyeti optimize edin. Gerekli bağlamı kaldırmak bir turu ucuzlatabilir; Claude tahmin yürütür, yanlış dosyaları değiştirir veya üç onarım turuna ihtiyaç duyarsa tüm işi daha pahalı yapar.
Bu rehber /usage, /context, /clear, /compact, /model, /effort ve /mcp gibi güncel Claude Code kontrollerini kullanır. En doğrudan API ile faturalandırılan oturumlara uygulanır. Abonelik planları istek başına fatura yerine kullanım pencereleri kullanır, ancak aynı bağlam alışkanlıkları kotanın daha uzun dayanmasına yardımcı olur.
Claude Code kısa bir yanıttan neden daha fazla token kullanır?
Claude Code tek soru ve tek yanıttan oluşan bir sohbet değil, bir coding agent'tır. Çalışan bir oturum şunları içerebilir:
- prompt'unuz ve hâlâ ilgili olan önceki turlar;
- repository araştırılırken Claude'un okuduğu dosyalar;
- komut, test, derleyici ve araç çıktısı;
CLAUDE.md, geçerli proje kuralları ve çağrılmış skills;- MCP servers içindeki araç tanımları ve sonuçları;
- planlama, extended thinking, üretilen kod ve açıklamalar;
- subagent özetleri ve sonraki düzeltmeler.
Bağlam birikir. Eski bir log veya ilgisiz tasarım tartışması konuşmada kalırsa sonraki istekler bunu yeniden işleyebilir. Prompt caching tekrarlanan içeriğin fiyatını düşürebilir, Claude Code da bağlam sınırına yaklaşınca geçmişi otomatik compact eder; ancak bunlar ilgisiz malzemeyi sonsuza kadar tutmak için gerekçe değildir.
Pratik optimizasyon sırası şöyledir:
- temsilî bir işi ölçün;
- ilgisiz bağlamı kaldırın;
- sürekli talimatları ve araç yükünü azaltın;
- geniş keşfi ve gürültülü çıktıyı önleyin;
- model ve effort seviyesini bilinçli seçin;
- tamamlanan işi yeniden ölçün.
Hisle değil, başlangıç ölçümüyle ilerleyin
Optimizasyondan önce /usage çalıştırın. API kullanıcıları için Session bloğu model bazında token kullanımını ve standart liste fiyatlarıyla yerel maliyet tahminini gösterir. Bu tahmin gateway promosyonunu veya sözleşmeli fiyatı içermeyebilir; finansal doğruluk için gerçek sağlayıcı faturası esas alınmalıdır.
Mevcut pencereyi neyin doldurduğunu görmek için /context çalıştırın. Büyük bir CLAUDE.md, çağrılmış skill veya araç yükü artık tahmin değil, görülebilir veri olur.
Oturum OmniaKey kullanıyorsa bu tanıyı kullanım paneliyle karşılaştırın. İstenen model, giriş ve çıkış token'ları, cache metadatası, gecikme ve çağrı başına gerçek maliyet kaydedilir. Bakiye ve kullanım rehberi hesap bakiyesini, key limitlerini ve kullanım kayıtlarını açıklar.
Tekrarlanabilir bir iş seçin ve önce/sonra şu verileri yazın:
| Ölçüm | Neden önemli? |
|---|---|
| Giriş, cache read, cache write ve çıkış token'ları | Kullanımın nerede biriktiğini gösterir |
| Model turları ve araç çağrıları | Döngüleri ve tekrarlanan keşfi açığa çıkarır |
| Yeniden denemeler ve insan düzeltmeleri | Ucuz görünen ama yeniden iş yaratan turları yakalar |
| Geçen testler ve kabul ölçütleri | Doğruluğun optimize edilmesini engeller |
| Son faturalanan maliyet | Gerçekte ödediğiniz sonucu ölçer |
İki ilgisiz oturumu karşılaştırmayın. Yazım hatası düzeltmesiyle bilinmeyen bir migration aynı token tabanına sahip değildir.
1. İlgisiz işler arasında /clear kullanın
En yüksek getirili alışkanlık en basit olanıdır: sonraki iş mevcut konuşmaya ihtiyaç duymuyorsa /clear ile temiz başlayın.
Daha sonra gerekebilecek oturuma önce ad verin:
/rename auth-refresh-investigation
/clear
Önceki oturum /resume ile erişilebilir kalır. Güncel Claude Code, /clear sonrasında /usage içindeki Session toplamlarını da sıfırlar; böylece sonraki işi ayrı ölçmek kolaylaşır.
Şu durumlarda temizlemek mantıklıdır:
- backend hatasından ilgisiz pazarlama metnine geçmek;
- bir özelliği bitirip repository'nin başka alanına başlamak;
- yanlış varsayımlara dayanan yaklaşımı bırakmak;
- kararı artık etkilemeyen büyük logları taşımak.
Yalnızca bağlam göstergesi büyüdü diye temizlemeyin. İş devam ediyorsa önce doğrulanmış gerçekleri ve kararları koruyun veya açık talimatla compact edin.
2. Uzun işlerde /compact komutunu bilinçli kullanın
/compact, eski geçmişi daha küçük bir özetle değiştirir. Nelerin korunacağını açıkça söyleyin:
/compact Kabul ölçütlerini, değişen dosyaları, başarısız test çıktısını ve çözülmemiş kararları koru.
Uzun bir implementation için genel özetten daha güvenlidir. Aynı koruma kuralı projedeki her iş için geçerliyse CLAUDE.md içine kısa compact talimatı da eklenebilir.
Compaction abonelik kotasını sıfırlamaz; bağlam uyarısı da faturalandırma limiti uyarısı değildir. Compact konuşmada neyin kalacağını yönetir, plan kotası veya API bakiyesi eklemez.
İş hâlâ aynıysa ama mevcut noktaya gelen yol gürültülüyse /compact kullanın. İşin kendisi değiştiyse /clear kullanın.
3. İş başlamadan yüklenen bağlamı küçültün
Claude Code proje talimatlarını oturum başında okur. Yararlı talimatlar hataları önler; her oturuma yüklenen bir el kitabı ise iş ihtiyaç duymasa bile bağlam tüketir.
Anthropic'in güncel rehberi CLAUDE.md dosyasını kısa tutmayı ve özel workflow'ları isteğe bağlı yüklenen skills içine taşımayı önerir. İyi bir kök dosya ağırlıklı olarak şunları içerir:
- değişikliği doğrulayan komutlar;
- repository'ye özel mimari sınırlar;
- kolayca çıkarılamayan ortam kısıtları;
- dilin normal varsayımlarından farklı proje kuralları.
Uzun API eğitimlerini, tek seferlik migration runbook'larını ve alan referanslarını taşıyın. Her oturuma gömmek yerine bağlantı verin veya dar bir skill olarak paketleyin.
MCP servers benzer bir denge yaratır. /mcp çalıştırıp kullanmadığınız server'ları kapatın. Claude Code tam araç tanımlarını varsayılan olarak erteler, ancak adlar ve kullanılan schemas yine bağlam alır. Basit işlemde gh, aws veya sentry-cli gibi odaklı bir CLI geniş araç yüzeyinden daha verimli olabilir.
Temizlikten sonra /context komutunu yeniden çalıştırın. Başlangıç boyutu değişmediyse daha fazla ayar değiştirmeden gerçek büyük kaynağı bulun.
4. Tüm repository keşfini gerektirmeyecek kadar net olun
"Bu repository'yi iyileştir" geniş taramayı tetikler. Sınırları belli bir prompt doğrudan kanıta gider:
src/api/auth.ts içindeki token yenileme sonrası 401 hatasını düzelt.
Public response biçimini koru.
Süresi dolmuş access token ve geçerli refresh token için regression test ekle.
Odaklı auth testini ve typecheck'i çalıştır.
Prompt belirtiyi, muhtemel dosyayı, contract'ı ve kanıtı tanımlar. Claude gerektiğinde dependency okuyabilir, ancak önce tüm codebase'i taramak zorunda değildir.
Gerçekten karmaşık işlerde düzenlemeden önce planlayın. Kısa araştırma ve plan aşaması yanlış mimaride pahalı implementation yapılmasını önleyebilir. Konumu belli tek satırlık düzeltmede plan ek yük olabilir. Belirsizlik gerçek olduğunda kullanın.
Yönü erken düzeltin. Claude yanlış problemi çözüyorsa büyük patch üretmesini bekleyip neden geri alınacağını anlatmayın. Turu durdurun; /rewind konuşma ve kodu önceki checkpoint'e döndürebilir.
Çıktı contract'ı da yardımcı olur:
- önce karar;
- yalnızca değişen dosyalar ve doğrulama sonuçları;
- prompt'u tekrarlamamak;
- eksik bilgi varsa implementation öncesi soru sormak;
- yalnızca gerekli kanıtı kesmeyecekse uzunluk sınırı koymak.
Daha kısa açıklama bazı çıkış token'larını azaltır. Yanlış keşif ve yeniden işi önlemek genellikle daha çok kazandırır.
5. Araç ve test çıktısını odaklı tutun
Büyük komut çıktısı çalışma bağlamına girer. Değişikliği kanıtlayan en dar komutu tercih edin:
pnpm vitest run tests/unit/auth.test.ts
rg -n "FAIL|ERROR" test-output.log
git diff --check
Token azaltmak için hataları gizlemeyin. Başarısız assertion, ilgili stack frame'ler, çıkış durumu ve tanı için yeterli çevre korunmalıdır. Tekrarlanan progress bar, başarılı test listeleri ve binlerce ilgisiz satır çıkarılabilir.
Kararlı ön işleme bir script veya hook içinde yaşamalıdır. Anthropic maliyet rehberi, Claude okumadan önce çok büyük test logunun süzülmesini örnek verir. Küçük ve incelenmiş filtre, modelin her seferinde aynı gürültüyü yeniden keşfetmesinden güvenilirdir.
Çok sayıda dosya okuması gerektiren araştırmayı sınırları belli bir subagent'a vererek ana konuşmaya yalnızca kısa özet döndürebilirsiniz. Bu bağlam izolasyonudur; toplam token'ın düşeceğini garanti etmez, çünkü subagent'ın kendi penceresi vardır. Özet ana işte tekrar okumayı önlediğinde kullanın.
6. Model ve effort seviyesini karara göre seçin
Model seçimi hem fiyatı hem deneme sayısını değiştirir. Claude Sonnet 5 günlük başlangıç için pratiktir, Claude Haiku 4.5 dar ve tekrarlı işlere uyar, Claude Opus 5 ise mimari, belirsizlik veya hata maliyeti yüksek olduğunda daha kolay gerekçelendirilir.
/model ile bilinçli geçiş yapın. Claude Code model rehberi daha kapsamlı routing politikası sunar.
API yollarında extended thinking token'ları çıkış olarak faturalanır. Basit ve iyi tanımlanmış işte /effort ile effort seviyesini düşürüp sonucun hâlâ geçtiğini doğrulayın. Zor planlama veya bilinmeyen debugging için çok düşük effort, tasarrufu yok eden tekrarlar yaratabilir.
Her işi en ucuz modele gönderip buna optimizasyon demeyin. Düzeltmeler ve review debt dahil kabul edilmiş sonuç başına maliyeti karşılaştırın.
7. Kullanımı azalttıktan sonra finansal sınır ekleyin
Harcama limiti token tüketimini azaltmaz. Bir döngü, sızmış key veya beklenmedik workload istek göndermeye devam ederse finansal zararı sınırlar.
OmniaKey kullanırken API Keys panelinde yerel geliştirme, otomasyon ve paylaşılan işler için ayrı key'ler oluşturun. Her birine işine uygun limit verin ve yükseltmeden önce kullanımı inceleyin. Ayrı key'ler tek sınırsız kimlik bilgisine göre attribution ve iptali kolaylaştırır.
Sıra önemlidir:
- gereksiz bağlamı ve tekrarları kaldırın;
- normal iş maliyetini ölçün;
- meşru dalgalanmanın üstüne limit koyun;
- workload sınırı geçtiğinde uyarın veya durdurun.
Çok düşük limit maliyet sorununu iş ortasında hataya dönüştürür. Kullanım incelemesi olmayan limit yalnızca tavana ulaşıldığını söyler.
10 dakikalık Claude Code token denetimi
Bu listeyi gerçek bir oturumda uygulayın:
/usageçalıştırıp model kullanımını kaydedin./contextile en büyük önlenebilir katkıyı bulun.- İş eski konuşmayla ilgisizse
/clearkullanın. CLAUDE.mddosyasını kısaltıp özel talimatları skills içine taşıyın.- Kullanılmayan MCP servers'ı
/mcpile kapatın. - Geniş prompt'u dosya, belirti, sınır ve kabul kontrolüyle değiştirin.
- Odaklı test çalıştırıp hataları saklamadan tekrarlı çıktıyı süzün.
- Zorluğa göre
/modelve/effortseçin. - Aynı iş sınıfını tekrarlayıp tamamlanan maliyeti karşılaştırın.
- Normal aralığı öğrendikten sonra key başına limit ekleyin.
Bir seferde bir veya iki değişken değiştirin. Oturumu temizleyip modeli değiştirir, effort düşürür ve işi aynı anda yeniden yazarsanız hangisinin işe yaradığını bilemezsiniz.
Yaygın hatalar
Yalnızca kısa yanıt istemek
Görünen çıktıyı azaltır; geçmiş, dosya okumaları, araçlar ve thinking kalır. Yararlıdır, fakat nadiren en büyük kaldıraçtır.
İşin hâlâ ihtiyaç duyduğu bağlamı silmek
Eksik kısıtlar tahmine ve yeniden işe yol açar. Temizleme veya compact öncesi doğrulanmış kararları koruyun.
Cache hit'i sıfır kullanım saymak
Prompt caching tekrarlanan girişin fiyatını düşürebilir, ancak cache token'ları kullanımda görünür. Tekrarlanan bağlam yararlı kalmalı ve gerçek fatura kontrol edilmelidir.
Her küçük soru için subagent kullanmak
Her subagent'ın kendi başlangıç ve çalışma bağlamı vardır. Sınırları belli, yüksek hacimli araştırmayı devredin; küçük yerel soruyu mevcut oturumda çözün.
Limiti optimizasyon sanmak
Key limiti sınırda harcamayı durdurur. Sınırın altındaki istekleri verimli yapmaz.
Sık sorulan sorular
Yanıt kısa olduğu halde Claude Code token kullanımı neden yüksek?
İstek, son metinden çok daha büyük konuşma geçmişi, proje kuralları, dosyalar, komut çıktısı, araçlar ve thinking içerebilir. /context ve /usage kontrol edin.
/clear önceki Claude Code oturumumu siler mi?
Yeni oturum başlatır. Önemli işi önce /rename ile adlandırın, sonra /resume ile korunan oturuma dönün.
/compact faturayı her zaman düşürür mü?
Gelecek turlarda taşınan geçmişi küçültür ve sonraki girişi azaltabilir. Net etki oturumun devam süresine ve özetin içeriğine bağlıdır; /usage ve fatura paneliyle ölçün.
Token tasarrufu için her zaman Haiku mu kullanmalıyım?
Hayır. Haiku dar işlerde ekonomik olabilir, ancak birkaç başarısız deneme bir başarılı Sonnet veya Opus turundan pahalıya gelebilir. İşe göre routing yapın.
API key harcama limiti token kullanımını azaltır mı?
Hayır. Kullanım oluştuktan sonra parayı sınırlar. Küçük bağlam, odaklı prompt, bilinçli effort ve çağrı incelemesiyle birlikte kullanın.
Kaynaklar
- Anthropic: Claude Code maliyetlerini yönetme
- Anthropic: Claude Code bağlam penceresi
- Anthropic: Claude Code en iyi uygulamaları
- Anthropic: model ve effort yapılandırması
- Anthropic: Prompt caching
- OmniaKey bakiye ve kullanım belgeleri
Bilgiler 8 Ağustos 2026 tarihinde doğrulandı. Claude Code komutları, model davranışları ve faturalandırma yüzeyleri değişebilir; production bütçesi belirlemeden önce resmi kaynakları ve gerçek kullanım kayıtlarınızı kontrol edin.