GPT-5.4 ve GPT-5.4 Mini kullanımdan kaldırıldı · Lütfen kullanılabilir başka bir modele geçin
Blog
Rehber

DeepSeek V4.1 Flash

Yeni Flash daha düşük fiyat ve birçok Agent testinde yükseliş sunuyor; ancak resmi tablo V4 Pro'yu her görevde geçtiğini göstermiyor.

12 dk okumaOmniaKey
DeepSeek V4.1 Flashmodel incelemesiAPI fiyatıçok modlukodlama Agent

Bu DeepSeek V4.1 Flash inceleme yazısı, model mimarisini, DeepSeek'in yayımladığı benchmark'ları ve gerçek entegrasyonda önemli olan API sözleşmesini birbirinden ayırır.

Kısa sonuç: Uzun bağlam, araç döngüleri, ekran görüntüsü ve yüksek hacimli Agent işleri için V4.1 Flash önce karşılaştırılacak adaydır. DeepSeek doğrudan API'nin yoğun olmayan saat fiyatı, önbelleksiz girişte milyon token başına $0.15 ve çıktıda $0.60'tır. Bu, her işte V4 Pro'nun yerine geçtiğini göstermez; bu yazı bağımsız ücretli model çalıştırması veya hız testi yapmış gibi davranmaz.

Bilgi kontrolü: 10 Eylül 2026. Bu inceleme DeepSeek'in sürüm notu, fiyat sayfası, API kılavuzları ve açık model kartına dayanır. Benchmark değerleri vendor-reported niteliğindedir; OmniaKey tarafından bağımsız olarak yeniden üretilmemiştir.

V4.1 Flash önce ne zaman denenmeli?

Uzun prompt ve tekrar eden tool call kullanan kodlama Agent'ları, ekran görüntüsüyle hata ayıklama, doğrulama adımı olan OCR veya belge çıkarma ve token maliyeti ile throughput'un önemli olduğu batch işler iyi başlangıç alanlarıdır.

Akışınız V4 Pro'ya özgü davranışa, sabit tool call biçimine veya denetlenebilir sabit model kimliğine bağlıysa önce regresyon çalıştırın. DeepSeek, deepseek-v4-pro isteğinin 2026-09-14 04:00 UTC itibarıyla V4.1 Flash'a yönleneceğini söylüyor. Model ID aynı kalsa bile çalıştırılan model değişecek.

Lansmanda doğrulanan bilgiler

BaşlıkDoğrulanan bilgi
Resmi sürüm2026-09-10
Yeni DeepSeek API model ID'sideepseek-flash
Eski uyumluluk ID'lerideepseek-v4-flash, deepseek-v4-flash-vision-exp
Pro geçişideepseek-v4-pro, 2026-09-14 04:00 UTC'den itibaren V4.1 Flash'a yönlenir
Mimari552B parametreli multimodal MoE, Causal Encoder-Decoder
Etkin parametrelerprefill için 8B, decode için 16B
Kapasite1M bağlam, en fazla 384K çıktı
API yüzeyleriChat Completions, Responses API, Anthropic API
Lisansağırlıklar ve depo MIT

V4 Flash ve V4 Flash Vision Exp kaldırıldı. deepseek-v4-flash ve deepseek-v4-flash-vision-exp yalnızca geçici uyumluluk yollarıdır; yeni entegrasyon deepseek-flash kullanmalıdır.

DeepSeek, token başına 890 bytes küresel KV Cache, V4 Flash'ın yaklaşık 1/4'ü ve yaklaşık 1/8 kalıcı önbellek ayak izi bildiriyor. Bu, faturalandırılan token sayısının otomatik olarak dörtte bire ineceği anlamına gelmez; serving belleğiyle ilgili bir tasarım bilgisidir.

Doğrudan API fiyatı

DeepSeek'in İngilizce fiyat sayfası doğrudan API için milyon token başına şu USD oranlarını verir:

Faturalandırılan kullanımYoğun olmayanYoğun
Cache hit giriş$0.003$0.006
Cache miss giriş$0.15$0.30
Çıktı$0.60$1.20

Yoğun saatler pazartesiden cumaya 01:00-04:00 ve 06:00-10:00 UTC'dir. Diğer saatler ve hafta sonu yoğun olmayan dönemdir. Bunlar DeepSeek doğrudan fiyatlarıdır, OmniaKey fiyatı değildir.

100.000 cache miss giriş ve 20.000 çıktı token için:

text
V4.1 Flash yoğun olmayan = 0.1 x $0.15 + 0.02 x $0.60 = $0.027
V4.1 Flash yoğun         = 0.1 x $0.30 + 0.02 x $1.20 = $0.054
V4 Pro yoğun olmayan     = 0.1 x $0.66 + 0.02 x $1.98 = $0.1056
V4 Pro yoğun             = 0.1 x $1.32 + 0.02 x $3.96 = $0.2112

Bu token karışımında V4.1 Flash, V4 Pro'dan yaklaşık %74 daha ucuzdur. Bu bir kalite puanı değildir; yeniden denemeler ve insan düzeltmesi kabul edilmiş iş başına maliyeti değiştirebilir. Ağustos Pro oranları DeepSeek V4 Pro API fiyat rehberinde korunur.

Benchmark'lar gerçekte ne söylüyor?

Resmi model kartındaki aynı tabloda V4.1 Flash birçok Agent görevinde V4 Pro'nun üzerindedir, ancak tüm bilgi ve muhakeme testlerinde değildir.

BenchmarkV4 FlashV4 ProV4.1 Flash
GPQA Diamond89.992.490.9
HLE, yalnızca metin37.842.739.1
Terminal-Bench 2.182.787.990.6
DeepSWE v1.154.462.774.2
CyberGym76.783.388.1
HLE, araçlarla51.560.063.9
AutomationBench37.743.254.8

Savunulabilir sonuç, bildirilmiş kodlama, güvenlik, otomasyon ve araç kullanımında net gelişim olduğudur; evrensel galibiyet değildir. Ayrıca iki resmi kaynak NL2Repo-Bench için farklı değer verir: update log 65.4, canlı model kartı 64.0 der. DeepSeek farkı açıklayana kadar bu değer sonuca dahil edilmez.

Agent çerçevesi de skoru değiştirir

Aynı V4.1 Flash ile DeepSWE v1.1, OpenCode'da 65.5'ten mini-SWE-agent'ta 74.2'ye çıkar; fark 8.7 puandır. Terminal-Bench 2.1, Codex'te 84.1 ile DeepSeek Harness Minimal'da 90.6 arasında 6.5 puan fark gösterir.

DeepSeek, DeepSWE görevi başına N=8, Terminal-Bench için N=3 örnek, Linux container, en fazla 500 Agent adımı ve maksimum reasoning effort açıklar. Prompt biçimi, araç döngüsü, retry politikası ve bağlam yönetimi sonucu değiştirir. Kendi kullanacağınız Agent içinde kıyaslayın.

Görsel anlama ve entegrasyon sınırları

V4.1 Flash base64, herkese açık URL veya Files API ile JPEG, PNG, GIF ve WebP alır. Görsel giriş Chat Completions, Responses API ve Anthropic API ile çalışır. Otomatik boyutlandırmadan sonra bir görsel en fazla 1,024 giriş token kullanır.

Bu bir görsel anlama modelidir, görsel üretici değildir. Küçük metin, yoğun tablo ve kritik sözleşme veya finans alanları için deterministik kontrol ya da insan incelemesi gerekir. Thinking modunda tools kullanılıyorsa sonraki isteklere tüm reasoning_content geri verilmelidir; aksi halde kılavuz 400 yanıtı açıklar. FIM tamamlama yalnızca thinking kapalıyken vardır.

OmniAKey'de kullanılabilirlik

2026-09-10 kontrolünde OmniAKey model kataloğu kanonik deepseek-flash rotasını henüz göstermiyordu. Bu nedenle yazı, V4.1 Flash'ın OmniAKey üzerinden şimdi kullanılabildiğini veya bir OmniAKey fiyatı olduğunu iddia etmez.

Doğru ID katalogda göründüğünde API Keys içinde limitli ayrı bir anahtar oluşturun. İlk smoke test'ten sonra model, giriş, cache, çıktı ve maliyeti kontrol edin. şeffaf faturalandırma rehberi ve API hızlı başlangıç da yol gösterir.

V4 Pro geçiş kontrol listesi

  1. 10-30 temsilî işi ve kabul kriterlerini sabitleyin.
  2. deepseek-v4-pro için token, gecikme, retry ve kabul sonucunu kaydedin.
  3. Aynı işi aynı araçlar ve izinlerle deepseek-flash üzerinden çalıştırın.
  4. high ile maxi ayrı deneyin; her çalışmada tek değişken değiştirin.
  5. Uzun bir tool loop ve gerekiyorsa gerçek görsel işi ekleyin.
  6. İlk yanıt fiyatını değil kabul edilmiş iş başına toplam maliyeti kıyaslayın.
  7. 14 Eylül'den önce allowlist, izleme ve denetim etiketlerini güncelleyin.

Sık sorulan sorular

Yeni model ID'si nedir?

DeepSeek doğrudan API için deepseek-flash kullanılır. Eski V4 Flash ID'leri yalnızca uyumluluk adlarıdır.

V4.1 Flash her zaman V4 Pro'dan iyi mi?

Hayır. Birkaç resmi Agent metriğinde önde olsa da GPQA Diamond ve yalnızca metin HLE'de V4 Pro öndedir. Kararı görev ve Agent çerçevesi vermelidir.

V4.1 Flash açık kaynak mı?

Depo ve ağırlıklar MIT lisanslıdır. Yine de 552B MoE çalıştırmak özel donanım, doğru prompt encoding ve operasyonel doğrulama gerektirir.

Birincil kaynaklar

Gerçekler ve hesaplamalar 10 Eylül 2026'da kontrol edildi. Bağımsız ücretli model çağrısı, hız testi veya üretim güvenilirlik testi yapılmadı. Dağıtımdan önce model ID'sini, fiyatları, geçiş zamanını ve gateway kullanılabilirliğini yeniden doğrulayın.