DeepSeek V4 Flash yayında · GLM-5.2 fiyatımız resmi fiyatın %50'sine düştü
Blog
Maliyet kontrolü

DeepSeek V4 Pro API fiyatlandırması

DeepSeek V4 Pro, indirimli saatlerde milyon girdi tokenı başına $0.66 ve çıktı için $1.98; iki günlük UTC yoğun zaman aralığında ise $1.32 ve $3.96 tutar.

12 dk okumaOmniaKey
DeepSeek V4 ProAPI pricing0813cost control

Yeni DeepSeek V4 Pro API fiyatlandırması günün saatine göre değişiyor. Doğrudan DeepSeek API kullanımında indirimli saatlerde bir milyon önbellek isabetli girdi tokenı $0.022, önbellek isabetsiz girdi $0.66 ve çıktı $1.98 tutar. Yoğun saatlerde bu fiyatlar iki katına çıkarak $0.044, $1.32 ve $3.96 olur.

13 Ağustos'ta yayımlanan ağırlık snapshot'ının adı DeepSeek-V4-Pro-0813, ancak API model kimliği hâlâ deepseek-v4-pro. İstekte 0813 kullanmayın.

18 Ağustos 2026 tarihinde doğrulandı. DeepSeek, V4 Pro 0813'ü 13 Ağustos'ta yayımladı; saat bazlı yeni fiyatlar 16 Ağustos 16:00 UTC'de yürürlüğe girdi. Aşağıdaki tablolar doğrudan DeepSeek API fiyatlarıdır, kalıcı bir OmniAKey fiyatı iddiası değildir. Üretim bütçesini sabitlemeden önce canlı rotayı kontrol edin.

DeepSeek V4 Pro 0813 kısa özeti

ÖğeGüncel resmi değer
Ağırlıklar / snapshotDeepSeek-V4-Pro-0813
API model kimliğideepseek-v4-pro
Yayın tarihi13 Ağustos 2026
Bağlam penceresi1M token
Maksimum çıktı384K token
Varsayılan düşünmeAçık ve high
Akıl yürütme çabasılow, high veya max
Yerel arayüzlerChat Completions, Responses API, Anthropic API
İndirimli önbellek / yeni girdi / çıktı$0.022 / $0.66 / $1.98
Yoğun önbellek / yeni girdi / çıktı$0.044 / $1.32 / $3.96
Yoğun zaman aralıkları01:00-04:00 ve 06:00-10:00 UTC

Tüm fiyatlar bir milyon token başına ABD dolarıdır. Belirtilen iki aralığın dışındaki bütün saatler indirimlidir ve yoğun fiyatın yarısı uygulanır.

Resmi DeepSeek V4 Pro API fiyat tablosu

Faturalandırılan kullanımİndirimliYoğunYoğun çarpanı
Önbellek isabetli girdi$0.022$0.0442x
Önbellek isabetsiz girdi$0.66$1.322x
Çıktı$1.98$3.962x

Genel hesap:

text
maliyet = önbellek_isabetli_girdi_milyonu x önbellek_fiyatı
        + yeni_girdi_milyonu x yeni_girdi_fiyatı
        + çıktı_milyonu x çıktı_fiyatı

DeepSeek aralıkları UTC olarak tanımlar, ancak fiyat sayfası sınırı geçen uzun bir isteğin nasıl bölündüğünü açıklamaz. Bütçe ve logları UTC tutun, sağlayıcının faturalandırılmış kullanımını kaynak kabul edin ve sınıra yakın uzun istekleri planlamadan bu durumu doğrulayın.

Güncel OmniAKey fiyatı, erişim ve istek örneği için DeepSeek V4 Pro model sayfasını kullanın. Yukarıdaki tablo yalnızca doğrudan DeepSeek faturalandırmasını anlatır. Gateway fiyatı ile DeepSeek'in saat bazlı doğrudan fiyatı farklı ilişkilerdir; eşit olduklarını varsaymak yerine canlı model kataloğunu doğrulayın.

“0813” ne anlama geliyor?

DeepSeek-V4-Pro-0813, V4 Pro Preview sürümünün yerini alan indirilebilir GA snapshot'ıdır. Barındırılan API alias'ı değişmedi:

json
{
  "model": "deepseek-v4-pro"
}

Sürüm Preview mimarisini koruyor ve DSpark speculative decoding modülü ekliyor. DeepSeek model ağırlıklarını MIT lisansıyla da yayımlıyor. Bu, self-hosting için önemlidir; ancak açık ağırlıklar yerel inference'ı ücretsiz yapmaz. Donanım, serving, depolama ve operasyon maliyetleri devam eder.

Barındırılan API tarafındaki pratik değişiklikler:

  • sağlayıcının raporladığı daha güçlü agent benchmark sonuçları;
  • açıkça tanımlanmış low, high ve max seviyeleri;
  • Codex için optimize edilmiş yerel Responses API desteği;
  • 1M bağlam ve high ile max için önerilen en fazla 384K çıktı;
  • yeni yoğun ve indirimli fiyat tablosu.

Sabit alias hızlı yükseltmeyi kolaylaştırır, fakat sabit bir ağırlık snapshot'ı kadar tekrarlanabilir değildir. Sonuç karşılaştırırken istek tarihini, API kimliğini, akıl yürütme seviyesini, Harness sürümünü ve kabul testini kaydedin.

Maliyet örneği 1: önbellek isabetsiz girdi

Bir kodlama görevinin 100.000 önbellek isabetsiz girdi tokenı ve 20.000 çıktı tokenı kullandığını varsayalım.

ZamanHesap
İndirimli0.1 x $0.66 + 0.02 x $1.98 = $0.1056
Yoğun0.1 x $1.32 + 0.02 x $3.96 = $0.2112

Aynı token yükünü yoğun saatlerin dışına taşımak $0.1056 tasarruf sağlar. Görev daha az token kullanmaz; yalnızca uygulanan fiyat değişir.

Maliyet örneği 2: önbellek isabetli girdi

Şimdi aynı 100.000 girdi tokenının önbelleğe isabet ettiğini ve modelin yine 20.000 çıktı tokenı ürettiğini varsayalım.

ZamanHesap
İndirimli0.1 x $0.022 + 0.02 x $1.98 = $0.0418
Yoğun0.1 x $0.044 + 0.02 x $3.96 = $0.0836

Bu örnekte faturanın çoğu çıktıdır. Sıcak bir girdi prefix'i fayda sağlar; yine de uzun akıl yürütme, ayrıntılı yanıt, tekrarlanan tool döngüsü ve retry'lar önbellek tasarrufunu aşabilir.

DeepSeek bağlam önbelleği nasıl çalışır?

DeepSeek disk bağlam önbelleğini varsayılan olarak açar. Sonraki bir istek, ancak prefix'i daha önce kalıcılaştırılan bir cache-prefix birimiyle tamamen eşleşirse düşük fiyatı alır. Benzer metin veya kısmen yeniden kullanılan dosya otomatik isabet değildir.

Yanıttaki usage alanlarını inceleyin:

  • prompt_cache_hit_tokens, isabet fiyatıyla ücretlendirilen girdi tokenlarını gösterir;
  • prompt_cache_miss_tokens, isabetsiz fiyatla ücretlendirilen girdi tokenlarını gösterir.

Önbellek best effort çalışır. Oluşturulması zaman alır ve kullanılmayan veri genellikle birkaç saat ile birkaç gün içinde temizlenir. Bütçeyi beklediğiniz yeniden kullanıma değil, raporlanan alanlara göre kurun.

Sabit system talimatları, tool şemaları, repo kuralları ve büyük referans belgeleri iyi adaylardır. İstemci yapı üzerinde kontrol sağlıyorsa değişen talimatları sabit prefix'in sonrasına koyun.

Akıl yürütme tokenları çıktı olarak ücretlendirilir

Düşünme modu varsayılan olarak high seviyesinde açıktır. DeepSeek, OpenAI tarzı medium ve xhigh isteklerini high seviyesine eşler; modelin gerçek seviyeleri low, high ve max değerleridir.

Chat Completions kullanırken bu üç geçerli değerden birini reasoning_effort parametresiyle ayarlayın.

Responses API içinde akıl yürütme kullanımı usage.output_tokens_details.reasoning_tokens altında görünür. Bu değer çıktı kullanımının parçasıdır; maliyeti yalnızca görünen yanıt metninden hesaplamayın. Kısa bir son yanıtın arkasında çok sayıda reasoning tokenı olabilir.

Basit çıkarma ve dönüşüm için low, günlük agent işi için high ile başlayın. max seviyesini yalnızca daha yüksek kabul oranı ek çıktı, gecikme ve maliyeti haklı çıkarıyorsa test edin. 384K kapasitedir, önerilen varsayılan değildir.

İş akışı düzeyinde bağlam kontrolü için token kullanımını azaltma rehberi, model kalitesini düşürmeden önce eski bağlamı ve sınırsız tool çıktısını temizlemeyi anlatır.

V4 Pro 0813 benchmark değişiklikleri

DeepSeek, V4 Pro Preview karşısında şu artışları raporluyor:

BenchmarkV4 Pro PreviewV4 Pro 0813
Terminal Bench 2.172.187.9
DeepSWE12.862.7
Toolathlon-Verified55.974.1
Tool kullanan HLE48.260.0

Kaynak: DeepSeek (vendor-reported; bağımsız olarak tekrarlanmadı). Herkese açık code-agent benchmark'larında DeepSeek Harness minimal modu, max çabası, temperature = 1.0 ve top_p = 0.95 kullanıldı. Aynı tablodaki DSBench-FullStack ve DSBench-Hard şirket içi test setleridir.

Bu sayılar DeepSeek kurulumunda 0813'ün Preview sürümünden gelişmiş olduğunu destekler. Her model, istemci, repo veya üretim yükünde kazandığını kanıtlamaz. Temsili bir görevi aynı girdiler, izinler, araçlar ve geçiş kontrolüyle tekrarlayın.

Yükleme ve özel provider yapılandırması için DeepSeek Harness kurulum rehberini kullanın. Bu yazı fiyatı ve 0813 maliyet kararını sahiplenir.

DeepSeek V4 Flash üçte bir fiyatına

DeepSeek, V4 Flash için Pro fiyatlarının yaklaşık üçte birini listeliyor. Tabloda önbellek isabetsiz girdi ile çıktı tam üçte bir; yuvarlanmış önbellek isabeti ise üçte birden biraz düşüktür:

V4 Flash kullanımıİndirimliYoğun
Önbellek isabetli girdi$0.007$0.014
Önbellek isabetsiz girdi$0.22$0.44
Çıktı$0.66$1.32

API kimliği deepseek-v4-flash, güncel snapshot ise DeepSeek-V4-Flash-0731 değeridir. Listelenen concurrency sınırı da daha yüksektir: Flash için 2.500, Pro için 500.

Flash, yüksek hacimli ve iyi tanımlı iş için daha ucuz ilk testtir. Bu, eşit kalite kanıtı değildir. Kalıcı agent yönlendirmesinden önce retry ve düzeltme süresi dahil kabul edilmiş görev maliyetini karşılaştırın.

OmniAKey üzerinden DeepSeek V4 Pro çağırma

Önce API Keys panelinde ayrı limitli bir anahtar oluşturun, canlı katalogda deepseek-v4-pro bulunduğunu doğrulayın ve OpenAI uyumlu rotayı çağırın:

bash
curl https://api.omniakey.com/v1/chat/completions \
  -H "Authorization: Bearer $OMNIAKEY_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-pro",
    "messages": [
      {"role": "user", "content": "Bu geçiş planındaki en riskli varsayımı bul."}
    ],
    "stream": true
  }'

Gateway kataloğundaki tam model kimliğini kullanın. API quick start endpoint ve kimlik doğrulama yapısını açıklar.

Temsili bir çalışmadan sonra kullanım panelini inceleyin. Canlı OmniAKey fiyatı bu kuralı açıkça belirtmedikçe DeepSeek'in doğrudan yoğun veya indirimli tablosunu OmniAKey kullanım kaydına uygulamayın.

Model, token, önbellek ve çağrı maliyetini uzlaştırmak için şeffaf faturalandırma rehberini okuyun.

Pratik zamanlama ve bütçe politikası

Şu sırayı kullanın:

  1. Kullanıcıya dönük ve acil işlerde gecikmeyi önceliklendirin; yalnızca indirim için ertelemeyin.
  2. DeepSeek doğrudan kullanımında batch değerlendirme, indeksleme ve tekrar denenebilir işleri 01:00-04:00 ile 06:00-10:00 UTC dışına taşıyın.
  3. Önbellek isabeti, isabetsizlik, akıl yürütme ve çıktıyı ayrı kaydedin.
  4. Kişi, ortam veya otomasyon rolü başına ayrı harcama sınırı belirleyin.
  5. Pro ve Flash'i aynı kabul testiyle karşılaştırın.
  6. Üretim zamanlamasını değiştirmeden resmi fiyat sayfasını yeniden kontrol edin.

Harcama sınırı riski azaltır ama token tüketimini düşürmez. Önce isteği optimize edin, sonra başarılı görevlerdeki normal değişimi karşılayacak bir sınır koyun.

Yaygın DeepSeek V4 Pro fiyat hataları

API modeli olarak DeepSeek-V4-Pro-0813 göndermek

Bu snapshot adıdır. Barındırılan API hâlâ deepseek-v4-pro kullanır.

Bütün saatleri indirimli saymak

Yoğun fiyat 01:00-04:00 ve 06:00-10:00 UTC arasında geçerlidir. Kalan 17 saat yarı fiyatlı tabloyu kullanır.

Her tekrarın önbellek isabeti olduğunu düşünmek

İstek kalıcı bir cache-prefix birimiyle tamamen eşleşmelidir. Görsel benzerliğe değil prompt_cache_hit_tokens alanına güvenin.

1M bağlam veya 384K çıktıyı dahil kredi sanmak

Bunlar kapasite sınırlarıdır. Bu pencerelerdeki tokenlar yine ücretlendirilir.

Görünmeyen reasoning çıktısını atlamak

Akıl yürütme tokenları çıktı kullanımına dahildir. Kısa görünen yanıt her zaman düşük çıktı anlamına gelmez.

Sağlayıcı benchmark'ını bağımsız kanıt gibi sunmak

0813 artışları açıklanan Harness ve max kurulumundaki vendor-reported sonuçlardır. Yararlı bir yükseltme sinyalidir, evrensel üretim sıralaması değildir.

Sık sorulan sorular

DeepSeek V4 Pro API ne kadar?

DeepSeek indirimli saatte milyon önbellek isabetli girdi tokenı için $0.022, isabetsiz girdi için $0.66 ve çıktı için $1.98 listeler. Yoğun fiyatlar $0.044, $1.32 ve $3.96'dır.

DeepSeek V4 Pro ne zaman indirimli?

01:00-04:00 ve 06:00-10:00 UTC dışındaki bütün UTC saatleri indirimlidir. İndirimli fiyatlar yoğun fiyatlardan %50 düşüktür.

DeepSeek V4 Pro 0813 API model kimliği nedir?

deepseek-v4-pro kullanın. DeepSeek-V4-Pro-0813 yayımlanan ağırlıkları ve snapshot'ı adlandırır; barındırılan API istek kimliği değildir.

DeepSeek V4 Pro bir milyon token destekliyor mu?

Evet. DeepSeek 1M bağlam ve 384K maksimum çıktı listeler. Bunlar ücretsiz kota değil, sınırlardır.

DeepSeek V4 Pro, V4 Flash'ten ucuz mu?

Hayır. Flash'in listelenen fiyatları her iki zaman aralığında Pro'nun yaklaşık üçte biridir. Pro, primini daha yüksek kabul oranıyla haklı çıkarmalıdır.

0813 code-agent performansını geliştirdi mi?

DeepSeek, Terminal Bench 2.1, DeepSWE ve Toolathlon-Verified üzerinde Pro Preview'a göre büyük artışlar bildiriyor. Herkese açık koşular DeepSeek Harness minimal ve max kullandı. Kendi görevlerinizde tekrarlayana kadar sonuçları vendor-reported olarak değerlendirin.

Doğrulanan kaynaklar

Bilgiler 18 Ağustos 2026 tarihinde doğrulandı. Sağlayıcı fiyatları, yoğun zamanlar, alias'lar, gateway erişimi ve özellikler değişebilir. Üretim bütçesinden önce birincil kaynakları ve canlı kataloğu kontrol edin.