DeepSeek V4.1 Flash
Yeni Flash daha düşük fiyat ve birçok Agent testinde yükseliş sunuyor; ancak resmi tablo V4 Pro'yu her görevde geçtiğini göstermiyor.
Bu DeepSeek V4.1 Flash inceleme yazısı, model mimarisini, DeepSeek'in yayımladığı benchmark'ları ve gerçek entegrasyonda önemli olan API sözleşmesini birbirinden ayırır.
Kısa sonuç: Uzun bağlam, araç döngüleri, ekran görüntüsü ve yüksek hacimli Agent işleri için V4.1 Flash önce karşılaştırılacak adaydır. DeepSeek doğrudan API'nin yoğun olmayan saat fiyatı, önbelleksiz girişte milyon token başına $0.15 ve çıktıda $0.60'tır. Bu, her işte V4 Pro'nun yerine geçtiğini göstermez; bu yazı bağımsız ücretli model çalıştırması veya hız testi yapmış gibi davranmaz.
Bilgi kontrolü: 10 Eylül 2026. Bu inceleme DeepSeek'in sürüm notu, fiyat sayfası, API kılavuzları ve açık model kartına dayanır. Benchmark değerleri vendor-reported niteliğindedir; OmniaKey tarafından bağımsız olarak yeniden üretilmemiştir.
V4.1 Flash önce ne zaman denenmeli?
Uzun prompt ve tekrar eden tool call kullanan kodlama Agent'ları, ekran görüntüsüyle hata ayıklama, doğrulama adımı olan OCR veya belge çıkarma ve token maliyeti ile throughput'un önemli olduğu batch işler iyi başlangıç alanlarıdır.
Akışınız V4 Pro'ya özgü davranışa, sabit tool call biçimine veya denetlenebilir sabit model kimliğine bağlıysa önce regresyon çalıştırın. DeepSeek, deepseek-v4-pro isteğinin 2026-09-14 04:00 UTC itibarıyla V4.1 Flash'a yönleneceğini söylüyor. Model ID aynı kalsa bile çalıştırılan model değişecek.
Lansmanda doğrulanan bilgiler
| Başlık | Doğrulanan bilgi |
|---|---|
| Resmi sürüm | 2026-09-10 |
| Yeni DeepSeek API model ID'si | deepseek-flash |
| Eski uyumluluk ID'leri | deepseek-v4-flash, deepseek-v4-flash-vision-exp |
| Pro geçişi | deepseek-v4-pro, 2026-09-14 04:00 UTC'den itibaren V4.1 Flash'a yönlenir |
| Mimari | 552B parametreli multimodal MoE, Causal Encoder-Decoder |
| Etkin parametreler | prefill için 8B, decode için 16B |
| Kapasite | 1M bağlam, en fazla 384K çıktı |
| API yüzeyleri | Chat Completions, Responses API, Anthropic API |
| Lisans | ağırlıklar ve depo MIT |
V4 Flash ve V4 Flash Vision Exp kaldırıldı. deepseek-v4-flash ve deepseek-v4-flash-vision-exp yalnızca geçici uyumluluk yollarıdır; yeni entegrasyon deepseek-flash kullanmalıdır.
DeepSeek, token başına 890 bytes küresel KV Cache, V4 Flash'ın yaklaşık 1/4'ü ve yaklaşık 1/8 kalıcı önbellek ayak izi bildiriyor. Bu, faturalandırılan token sayısının otomatik olarak dörtte bire ineceği anlamına gelmez; serving belleğiyle ilgili bir tasarım bilgisidir.
Doğrudan API fiyatı
DeepSeek'in İngilizce fiyat sayfası doğrudan API için milyon token başına şu USD oranlarını verir:
| Faturalandırılan kullanım | Yoğun olmayan | Yoğun |
|---|---|---|
| Cache hit giriş | $0.003 | $0.006 |
| Cache miss giriş | $0.15 | $0.30 |
| Çıktı | $0.60 | $1.20 |
Yoğun saatler pazartesiden cumaya 01:00-04:00 ve 06:00-10:00 UTC'dir. Diğer saatler ve hafta sonu yoğun olmayan dönemdir. Bunlar DeepSeek doğrudan fiyatlarıdır, OmniaKey fiyatı değildir.
100.000 cache miss giriş ve 20.000 çıktı token için:
V4.1 Flash yoğun olmayan = 0.1 x $0.15 + 0.02 x $0.60 = $0.027
V4.1 Flash yoğun = 0.1 x $0.30 + 0.02 x $1.20 = $0.054
V4 Pro yoğun olmayan = 0.1 x $0.66 + 0.02 x $1.98 = $0.1056
V4 Pro yoğun = 0.1 x $1.32 + 0.02 x $3.96 = $0.2112
Bu token karışımında V4.1 Flash, V4 Pro'dan yaklaşık %74 daha ucuzdur. Bu bir kalite puanı değildir; yeniden denemeler ve insan düzeltmesi kabul edilmiş iş başına maliyeti değiştirebilir. Ağustos Pro oranları DeepSeek V4 Pro API fiyat rehberinde korunur.
Benchmark'lar gerçekte ne söylüyor?
Resmi model kartındaki aynı tabloda V4.1 Flash birçok Agent görevinde V4 Pro'nun üzerindedir, ancak tüm bilgi ve muhakeme testlerinde değildir.
| Benchmark | V4 Flash | V4 Pro | V4.1 Flash |
|---|---|---|---|
| GPQA Diamond | 89.9 | 92.4 | 90.9 |
| HLE, yalnızca metin | 37.8 | 42.7 | 39.1 |
| Terminal-Bench 2.1 | 82.7 | 87.9 | 90.6 |
| DeepSWE v1.1 | 54.4 | 62.7 | 74.2 |
| CyberGym | 76.7 | 83.3 | 88.1 |
| HLE, araçlarla | 51.5 | 60.0 | 63.9 |
| AutomationBench | 37.7 | 43.2 | 54.8 |
Savunulabilir sonuç, bildirilmiş kodlama, güvenlik, otomasyon ve araç kullanımında net gelişim olduğudur; evrensel galibiyet değildir. Ayrıca iki resmi kaynak NL2Repo-Bench için farklı değer verir: update log 65.4, canlı model kartı 64.0 der. DeepSeek farkı açıklayana kadar bu değer sonuca dahil edilmez.
Agent çerçevesi de skoru değiştirir
Aynı V4.1 Flash ile DeepSWE v1.1, OpenCode'da 65.5'ten mini-SWE-agent'ta 74.2'ye çıkar; fark 8.7 puandır. Terminal-Bench 2.1, Codex'te 84.1 ile DeepSeek Harness Minimal'da 90.6 arasında 6.5 puan fark gösterir.
DeepSeek, DeepSWE görevi başına N=8, Terminal-Bench için N=3 örnek, Linux container, en fazla 500 Agent adımı ve maksimum reasoning effort açıklar. Prompt biçimi, araç döngüsü, retry politikası ve bağlam yönetimi sonucu değiştirir. Kendi kullanacağınız Agent içinde kıyaslayın.
Görsel anlama ve entegrasyon sınırları
V4.1 Flash base64, herkese açık URL veya Files API ile JPEG, PNG, GIF ve WebP alır. Görsel giriş Chat Completions, Responses API ve Anthropic API ile çalışır. Otomatik boyutlandırmadan sonra bir görsel en fazla 1,024 giriş token kullanır.
Bu bir görsel anlama modelidir, görsel üretici değildir. Küçük metin, yoğun tablo ve kritik sözleşme veya finans alanları için deterministik kontrol ya da insan incelemesi gerekir. Thinking modunda tools kullanılıyorsa sonraki isteklere tüm reasoning_content geri verilmelidir; aksi halde kılavuz 400 yanıtı açıklar. FIM tamamlama yalnızca thinking kapalıyken vardır.
OmniAKey'de kullanılabilirlik
2026-09-10 kontrolünde OmniAKey model kataloğu kanonik deepseek-flash rotasını henüz göstermiyordu. Bu nedenle yazı, V4.1 Flash'ın OmniAKey üzerinden şimdi kullanılabildiğini veya bir OmniAKey fiyatı olduğunu iddia etmez.
Doğru ID katalogda göründüğünde API Keys içinde limitli ayrı bir anahtar oluşturun. İlk smoke test'ten sonra model, giriş, cache, çıktı ve maliyeti kontrol edin. şeffaf faturalandırma rehberi ve API hızlı başlangıç da yol gösterir.
V4 Pro geçiş kontrol listesi
- 10-30 temsilî işi ve kabul kriterlerini sabitleyin.
deepseek-v4-proiçin token, gecikme, retry ve kabul sonucunu kaydedin.- Aynı işi aynı araçlar ve izinlerle
deepseek-flashüzerinden çalıştırın. highilemaxi ayrı deneyin; her çalışmada tek değişken değiştirin.- Uzun bir tool loop ve gerekiyorsa gerçek görsel işi ekleyin.
- İlk yanıt fiyatını değil kabul edilmiş iş başına toplam maliyeti kıyaslayın.
- 14 Eylül'den önce allowlist, izleme ve denetim etiketlerini güncelleyin.
Sık sorulan sorular
Yeni model ID'si nedir?
DeepSeek doğrudan API için deepseek-flash kullanılır. Eski V4 Flash ID'leri yalnızca uyumluluk adlarıdır.
V4.1 Flash her zaman V4 Pro'dan iyi mi?
Hayır. Birkaç resmi Agent metriğinde önde olsa da GPQA Diamond ve yalnızca metin HLE'de V4 Pro öndedir. Kararı görev ve Agent çerçevesi vermelidir.
V4.1 Flash açık kaynak mı?
Depo ve ağırlıklar MIT lisanslıdır. Yine de 552B MoE çalıştırmak özel donanım, doğru prompt encoding ve operasyonel doğrulama gerektirir.
Birincil kaynaklar
- DeepSeek V4.1 Flash sürüm notu
- DeepSeek modelleri ve fiyatları
- DeepSeek V4.1 Flash model kartı
- DeepSeek V4.1 teknik raporu
- Görsel anlama rehberi
- Thinking mode rehberi
- DeepSeek güncelleme kaydı
Gerçekler ve hesaplamalar 10 Eylül 2026'da kontrol edildi. Bağımsız ücretli model çağrısı, hız testi veya üretim güvenilirlik testi yapılmadı. Dağıtımdan önce model ID'sini, fiyatları, geçiş zamanını ve gateway kullanılabilirliğini yeniden doğrulayın.