DeepSeek V4 üç farklı kanal üzerinden farklı fiyatlarla satılıyor: abonelik tabanlı kodlama ajanları, doğrudan API anahtarları ve gateway’ler. Her kanal ayrıca trafiği hangi model checkpoint’inin işlediğine dair farklı bir garanti sunuyor. 16 Ağustos 2026’da bu checkpoint farkı maliyet açısından kritik hale geldi. DeepSeek V4 fiyatlandırmasını değiştirdikten sonra aracı satıcılar da fiyatlarını aynı doğrultuda güncelledi. Art arda gelen şikayet başlıkları, çoğu müşterinin gerçekte ne satın aldığını ne kadar az anladığını ortaya çıkardı.
16 Ağustos 2026’da DeepSeek V4 fiyatlandırmasında ne değişti?
DeepSeek, 16 Ağustos’ta 16:00 UTC’de V4 ailesini yoğun ve yoğun olmayan saat kademelerine taşıdı. Yoğun saatler 01:00-04:00 ve 06:00-10:00 UTC aralığında. Bu saatlerde faturalandırma, yoğun olmayan tarifenin tam iki katı üzerinden yapılır. Yoğun olmayan saatlerde V4 Flash; cache hit girdisi, cache miss girdisi ve çıktı için sırasıyla milyon token başına $0,007 / $0,22 / $0,66 maliyetinde. Yoğun saatlerde bu rakamlar ikiye katlanıyor. V4 Pro yoğun olmayan saatlerde $0,022 / $0,66 / $1,98 olarak listeleniyor.
Dikkatler cache hit artışına yoğunlaştı. InfoWorld’ün haberine göre bazı tarifelerde 10 katı aşan artışlar yaşandı. V4 Pro’nun yoğun olmayan saatlerdeki cache hit fiyatı altı kattan fazla, yoğun saatlerdeki tarife ise on iki kattan fazla yükseldi. DeepSeek, cache hit’leri yaklaşık %98 oranında indirimli sunuyordu; bu, sektördeki %90’a yakın normun oldukça üzerindeydi. Dolayısıyla her ajanın faturasının büyük bir kısmı, neredeyse sıfır ücretle işlenen cache okumalarından oluşuyordu.
Bu fark, yeniden fiyatlandırmanın kodlama ajanlarını sohbet arayüzlerinden daha sert vurmasının nedeni. Bir ajan her turda uzun bir sistem prompt’u ve genişleyen konuşma geçmişini yeniden gönderir. Girdi tokenlerinin çoğu bu nedenle cache hit olarak nitelendirilir. Yükselen cache hit fiyatları özellikle ajanları etkiledi.
OpenCode Go neden DeepSeek limitlerini düşürdü?
OpenCode Go’nun aylık ücreti $10’du ve ilk tanıtımda toplamda $60’a kadar model kullanımını karşıladığı belirtiliyordu. DeepSeek yeni tarifeleri yayınladıktan sonra aynı $10 ile önemli ölçüde daha az token satın alınır hale geldi. OpenCode saatler içinde limitlerini düşürdü. V4 Flash %50 azalarak ayda $30’a, V4 Pro ise %75 azalarak $15’e düştü.
r/opencode üzerinde tepki hızla geldi. “Bye bye OpenCode Go” başlıklı bir gönderi 315 upvote ve 108 yorum alırken, Flash bütçesiyle ilgili ayrı bir başlık 173 yorum daha topladı. Ertesi gün OpenCode Flash limitini geri yükseltti ve CEO’nun kamuya açık açıklaması 1.517 puana ulaşarak haftanın en çok upvote alan gönderisi oldu.
Aynı mekanik, herhangi bir sabit ücretli aracı satıcı için geçerli. Kullanım bazlı upstream kapasitesini yeniden satan bir abonelik, upstream’in fiyat riskini aracı satıcının bilançosunda taşır. Upstream 10 kat yeniden fiyatlandırırsa, aracı satıcı kâr marjından feragat eder, fiyatı artırır veya limiti düşürür. OpenCode limiti bir günden kısa sürede kamuya açık biçimde düşürdü; bu, çoğu sağlayıcıdan daha hızlı ve daha şeffaf bir adımdı. Alıcılar hala net bir ödünleşmeyle karşı karşıya: sabit ücret, başkasının maliyet yapısını fiyatlar ve bu yapı değişebilir.
Gerçek DeepSeek V4 Flash’ı mı alıyorsunuz?
Rahatsız edici olan belirsizliğin kendisi.
DeepSeek V4 Flash, kuantizasyon farkındalıklı eğitim (QAT) ile geliştirilmiştir. Yönlendirilen uzmanlar — modelin yaklaşık %96’sı — yerel olarak MXFP4’te bulunur. Kalan parametreler FP8 veya BF16 kullanır. Yayınlanan ağırlıkların vaat edilen davranışı sunmasını sağlayan mimari budur. Birçok serverless sağlayıcı, bu yerel hassasiyetin üzerine aktivasyonlara ek bir fp8 kuantizasyon geçişi uygulayarak kendi serving maliyetlerini düşürür. Yaşananlar ZenMux’un benchmark yazısında anlatılıyor: yanıtlar referans ağırlıklardan sapar ve aynı model adını sunan iki sağlayıcı ölçülebilir biçimde farklı sonuçlar döndürür.
Aynı mekanizma, “aynı prompt, farklı yanıt” şikayetlerine test edilebilir bir açıklama getiriyor ve bunları anekdot olmaktan çıkarıyor. Ayrıca daha keskin bir soruyu da gündeme getiriyor. OpenCode deposunda açık bir issue olan #40409, Go’nun deepseek-v4-flash modelinin kendisini DeepSeek V3.2 olarak tanımladığını ve Mayıs 2025 bilgi kesme tarihine sahip olduğunu bildiren bir raporu kaydediyor; bu arada kullanım V4 Flash kotası üzerinden faturalandırılıyor. Bunu çözülmemiş bir issue’da tek bir kullanıcının raporu olarak ele alın, doğrulanmış bir bulgu olarak değil. Kendini tanımlama güvenilmez bir kanıttır: bir model kendi sürümünü serving altyapısından değil, eğitim verisinden öğrenir. Issue hala açık ve spesifik; herhangi bir çürütme yayınlanmadı.
Bu pratik ders, issue nasıl çözülürse çözülsün geçerli. Tekrarlanabilirlik, her isteği hangi checkpoint’in ve hangi hassasiyetin işlediğini açıklayan bir sağlayıcı gerektirir. Çoğu abonelik bu açıklamayı içermez, çünkü upstream’ler arası havuzlanmış yönlendirme sabit ücreti sürdürülebilir kılan şeydir.
DeepSeek V4 satın almanın üç yolu nasıl karşılaştırılır?
| Kodlama ajanı aboneliği | DeepSeek doğrudan API | Gateway | |
|---|---|---|---|
| Faturalandırma | Sabit aylık ücret, sınırlı kota | Kullanım bazlı, yoğun/yoğun olmayan ayrımı | Kullanım bazlı, sağlayıcılar arası tek anahtar |
| Checkpoint garantisi | Genellikle açıklanmaz | Referans ağırlıklar, birinci taraf | Değişir; taahhütten önce sorun |
| Fiyat değişikliği riski | Aracı satıcı karşılar, sonra limitleri ayarlar | Doğrudan siz üstlenirsiniz | Başka bir upstream’e yönlendirme |
| Model çeşitliliği | Özenle seçilmiş liste | Yalnızca DeepSeek | Yüzlerce model |
| En uygun kullanım | Ani yük artışlı keşif amaçlı kodlama | Tekrarlanabilir ve yoğun olmayan saatlerdeki toplu işler | Çoklu model üretim trafiği |
Alıcılar artık bir zamanlar göz ardı ettikleri satırı atlayamaz. Fiyat ve model çeşitliliğini bir açılış sayfasında ölçmek kolaydır. Kaynak bilgisi ise varsayılan olarak hiçbir yerde açıklanmıyor ve bu ay değişen eksen tam da bu.
DeepSeek V4’e nasıl erişmelisiniz?
Reklamı yapılan tarifeye değil, iş yükü için önemli olan garantiye göre seçim yapın.
- haimaker.ai — DeepSeek V4’ün yanı sıra yüzlerce diğer modeli de kapsayan, istek başına maliyet loglaması dahil tek bir OpenAI uyumlu uç nokta. Bir sağlayıcının yeniden fiyatlandırması, bir topluluk forumu gönderisi yerine kendi telemetrinizde görünür. Gateway çeşitliliği istendiğinde ve yönlendirmenin hala denetlenebilir olması gerektiğinde bunu seçin. AI API gateway sayfası yönlendirme modelini tüm detaylarıyla ele alıyor.
- DeepSeek’in kendi API’si — referans uygulama ve checkpoint’i kesin olarak doğrulamanızı sağlayan tek kaynak. Çıkarımı yoğun olmayan saatlere kaydırabilen iş yüklerine uygun; bu saatlerde Flash çıktısı milyon token başına $0,66 maliyetinde.
- OpenCode Go ve benzeri abonelikler — sabit aylık maliyetle ani yük artışlı iş yüklerine uygun. Ağustos tartışma başlıklarında birden fazla kullanıcı, düşürülmüş haftalık limitleri bile tüketmekte zorlandığını bildirdi. Ödünleşme: hangi checkpoint’i aldığınız doğrulanamaz.
- Diğer gateway’ler — OpenRouter, 80’den fazla sağlayıcıdan 400’den fazla modeli yönlendiriyor ve açık yönlendirme modları sunuyor. Ancak konsolidasyon hızlanıyor: Stripe, OpenRouter’ı satın almak için anlaştı; 16 Ağustos’ta 7 milyar doların üzerinde bir bedelle, üç ay önceki Seri B değerlemesinin 5,4 katı bir primle.
Bir sağlayıcı zaten seçilmişse ve yalnızca yapılandırma detayları gerekiyorsa, OpenCode’da DeepSeek kurulum rehberi sağlayıcı bloğunu ve yaygın /models hata modlarını içeriyor. Hangi düşük maliyetli API’nin bir anahtarı hak ettiği sorusuna daha geniş perspektiften bakmak için, en ucuz AI API anahtarı frontier fiyatlandırmasının altındaki kademeyi ele alıyor ve OpenRouter alternatifleri gateway’leri birebir karşılaştırıyor.
Bir sonraki yeniden fiyatlandırmadan önce ne yapmalısınız?
DeepSeek bir ay içinde fiyatlarını iki kez değiştirdi. Yoğun ve yoğun olmayan saat kademeleri, bu kısıtı kâr marjlarının değil, mevcut kapasitenin yönlendirdiğini gösteriyor. O dönemde bir OpenCode mühendisinin değerlendirmesi, artışın finansal sıkıntıdan ziyade trafik yönetimini yansıttığı yönündeydi. Bu açıklama geçerliyse, daha fazla fiyat değişikliği önceki tarifelere dönüşten ziyade zamanlamaya göre şekillenecek.
En az çabayla yapılacak hazırlık, her isteğin maliyetini kendi altyapınızda loglamaktır. Bir sonraki tarife ayarlaması o zaman bir Reddit başlığında ortaya çıkmadan önce metriklerinizde görünür. Model adını ve temel URL’yi koda gömmek yerine yapılandırma dosyalarına koymak da geçişi kolaylaştırır; böylece bir upstream değişikliği bir kod tabanını yeniden yapılandırma değil, bir dağıtım olur. Bundan sonra kritik mimari soru, iş yükünün gerçekten doğrulanmış bir checkpoint gerektirip gerektirmediğidir. Bu tek sorunu çözmek, kalan kararları standart bir fiyat karşılaştırmasına dönüştürür.
Bir sınırlama hala geçerli: bu detaylar şu anda istek bazında harici olarak doğrulanamıyor. Hiçbir büyük sağlayıcı API yanıtlarına serving hassasiyetini veya checkpoint hash’ini dahil etmiyor. Bu değişene kadar kaynak doğrulama, bağımsız denetime güvenmek yerine doğrudan satıcıya sormak anlamına geliyor.
DEEPSEEK VE DİĞER HER ŞEY İÇİN TEK ANAHTAR ALIN
Sıkça sorulan sorular
OpenCode Go, DeepSeek API’sinden daha mı ucuz?
Ani yük artışlı ve keşif amaçlı iş yükleri için sabit aylık abonelik mantıklı: sabit maliyet, kullanım bazlı faturalandırmanın cezalandıracağı ani kullanım artışlarını karşılar. Ancak sürekli yüksek hacimli yük altında doğrudan API genellikle daha ucuzdur, özellikle yoğun olmayan saatlerde. Ayrıca belirli bir isteği hangi checkpoint’in işlediğini doğrulamanın tek yolu da budur.
DeepSeek V4 Flash yanıtları neden sağlayıcılar arasında farklılık gösteriyor?
DeepSeek V4 Flash, kuantizasyon farkındalıklı eğitimle (QAT) üretilmiş ağırlıklarla gelir; yönlendirilen uzmanlar yerel olarak MXFP4’te tutulurken kalan parametreler FP8 veya BF16’da bulunur. Birçok serverless sağlayıcı, serving maliyetini düşürmek için aktivasyonlara ek bir fp8 kuantizasyon geçişi uygular ve bu da çıktıları yayınlanan referans ağırlıklardan uzaklaştırır. Pratikte, aynı model adını listeleyen iki sağlayıcı ölçülebilir biçimde farklı sonuçlar döndürebilir.
Ağustos 2026’da DeepSeek V4 fiyatlandırmasında ne değişti?
Yoğun ve yoğun olmayan saat fiyatlandırması 16 Ağustos 2026’da 16:00 UTC’de yürürlüğe girdi. Yoğun saatler 01:00-04:00 ve 06:00-10:00 UTC aralığında olup tarifeler yoğun olmayan fiyatın tam iki katı olarak belirlendi. Cache hit girdisi en keskin artışı gördü; bazı kademelerde yaklaşık %1.100’e varan artışlar, prompt caching kullanan ajan iş yüklerine en ağır yükü bindirdi.