DeepSeek, deepseek-v4-pro kullanıcılarına dört gün süre verdi. 14 Eylül 2026 saat 04:00 UTC'de (12:00 Pekin saati), deepseek-v4-pro adını belirten her istek DeepSeek-V4.1-Flash'a yönlendirilecek ve V4.1-Flash tarifeleri üzerinden faturalandırılacaktır. Hiçbir hata oluşmayacak. Hiçbir uyarı verilmeyecek. Faturanız düşecek ve farklı bir model istemlerinize yanıt vermeye başlayacak.
Planlamanız gereken kısım bu son noktadır. Sürüm notu, değişikliği bir yükseltme olarak çerçeveliyor ve DeepSeek'in kendi rakamlarına göre de öyle. Ancak "sessizce yeniden yönlendirildi" "test edildi" ile aynı şey değildir. Ürününüz belirli bir araç çağrısı şekline veya V4-Pro'ya göre ayarladığınız bir gecikme bütçesine bağlıysa, değişikliklerin ne olduğunu Pazar gününden önce bilmek istersiniz, sonrasında değil.
Bu kılavuz, DeepSeek'in ne duyurduğunu, hiçbir şey yapmamanız halinde neler olacağını, bir geçiş kontrol listesini ve geçişin sorunsuz olması için Apidog'da Pro'ya karşı Flash regresyon paketini nasıl oluşturacağınızı kapsar. Modelin kendisi için, önce DeepSeek-V4.1-Flash nedir yazısını okuyun.
ÖZET
- Geçiş: 14 Eylül 2026, 04:00 UTC. Bu andan itibaren
deepseek-v4-proistekleri V4.1-Flash'a yönlendirilecek. - Çağrılarınız başarısız olmayacak ve Pro fiyatları ödemeyeceksiniz. Yoğun saatlerde önbellek-kaçırma girişi 1 milyon belirteç başına 1,32 dolardan 0,30 dolara düşer (%77 daha az); çıktı 3,96 dolardan 1,20 dolara düşer (%70 daha az).
- Model kimliğini kendiniz
deepseek-flasholarak yeniden adlandırın, ardından fonksiyon çağırmayı, yapılandırılmış çıktıyı, akışı ve akıl yürütme çabasını yeniden test edin. - DeepSeek, V4.1-Flash'ın listelenen her referans değerinde V4-Pro'yu geçtiğini belirtiyor. Bunlar tedarikçi rakamlarıdır. Kendi değerlendirmelerinizi yapın.
DeepSeek 10 Eylül'de ne duyurdu
10 Eylül değişiklik günlüğü girişi iki şeyi kapsıyor: V4.1-Flash'ın API'de genel kullanıma sunulması (GA) ve V4-Pro'nun dört gün sonra kullanımdan kaldırılması.

V4-Pro hakkında ifade doğrudan. DeepSeek, V4.1-Flash'ın “performans, maliyet, hız ve toplam süre açısından V4 Pro'yu kapsamlı bir şekilde aştığını” ve “çok sayıda tarafça yapılan testleri” gerekçe gösteriyor. 14 Eylül saat 04:00 UTC'den itibaren deepseek-v4-pro'ya yapılan istekler V4.1-Flash tarafından karşılanacak ve V4.1-Flash olarak fiyatlandırılacak. Pro'nun eski bir ad altında çalışmaya devam ettiği bir geçiş dönemi yoktur.
İsimlendirme temizliği Pro'yu aşıyor:
| Model adı | 10 Eylül sonrası durum |
|---|---|
deepseek-flash |
V4.1-Flash için yeni kanonik kimlik |
deepseek-v4-flash |
Hala kabul ediliyor, V4.1-Flash tarafından hizmet veriliyor |
deepseek-v4-flash-vision-exp |
Hala kabul ediliyor, V4.1-Flash tarafından hizmet veriliyor |
deepseek-v4-pro |
14 Eylül 04:00 UTC'ye kadar V4-Pro tarafından hizmet veriliyor, ardından V4.1-Flash'a yönlendiriliyor |
V4-Flash ve V4-Flash-Vision-Exp modeller olarak kullanımdan kaldırıldı; yalnızca adları takma ad olarak yaşamaya devam ediyor. Temel URL'ler değişmiyor: OpenAI uyumlu format için https://api.deepseek.com ve Anthropic uyumlu format için https://api.deepseek.com/anthropic. V4.1-Flash API için nasıl yapılır kılavuzu, yeni model kimliğini, akıl yürütme kontrolünü ve görüntü girişini ayrıntılı olarak kapsar.
Hiçbir şey yapmazsanız ne olur
Kısa versiyon: entegrasyonunuz çalışmaya devam eder ve daha ucuz hale gelir. Uzun versiyon: beş şey değişir.
Farklı bir model yanıtlar. V4.1-Flash, yeni bir Causal Encoder-Decoder düzenine sahip 552B parametreli bir MoE'dir: 40 katman, 20 kodlayıcı ve 20 kod çözücü, ön doldurma sırasında 8B ve kod çözme sırasında 16B parametre aktif. İstekleriniz artık farklı bir aktif parametre bütçesine ve farklı bir dikkat tasarımına (Sıkıştırılmış Seyrek Dikkat 2) çarpar. Farklı ifade biçimi, farklı varsayılan ayrıntı düzeyi ve bazen sınırda araç çağrılarında farklı kararlar bekleyin.
Çıktı tavanı aynı, önerilen ayarlar değil. Her iki model de 1M bağlam ve 384K maksimum çıktı listeler. V4.1-Flash model kartı, sıcaklık 1.0, top_p 0.95 veya 1.0 ve 256K veya daha fazla maksimum belirteç önerir. V4-Pro'da maliyeti sınırlamak için sıkı bir max_tokens ayarladıysanız, akıl yürütme çıktısının artık yanıt gelmeden önce kesilip kesilmediğini kontrol edin.
Akıl yürütme çabası farklı bir ölçekte çalışır. DeepSeek, V4.1-Flash akıl yürütme çabasını 1'den 100'e kadar ölçekte “sürekli olarak kontrol edilebilir” olarak tanımlıyor. V4-Flash, reasoning_effort artı extra_body={"thinking": {"type": "enabled"}} kabul ediyordu. 1'den 100'e kadar olan ölçeğin API parametresiyle nasıl eşleştiği mevcut belgelere göre [DOĞRULANMALI]; "yüksek" gibi adlandırılmış bir seviyenin Pro'daki derinliği ifade ettiğini varsaymayın.
Fiyatlandırma, yoğun saatlerle birlikte lehinize değişir. Yoğun saatler Pazartesi'den Cuma'ya, 01:00'den 04:00'e ve 06:00'dan 10:00 UTC'ye kadardır. Yoğun olmayan saatler yoğun saatlerin yarısı kadardır. Yeniden yönlendirilen Pro trafiği her iki zaman diliminde de Flash tarifelerinden ödeme yapar.
Eşzamanlılık alanı artar. V4-Pro'nun limiti 500 eşzamanlı istekti. Flash'ınki ise 2.500'dür. Yeniden yönlendirilen trafik daha yüksek limiti devralır, bu nedenle 500'e ayarlanmış herhangi bir istemci tarafı geri çekilmeyi (backoff) tekrar gözden geçirin.
Geçiş kontrol listesi
Bunları sırasıyla yapın. Birlikte, sessiz bir yönlendirmeyi kasıtlı bir yayına dönüştürürler.
- Model kimliğini yeniden adlandırın. Kod tabanınızda ve yapılandırmanızda
deepseek-v4-pro'yu arayın vedeepseek-flashile değiştirin. Takma adın çözülmeye devam etmesine rağmen bunu yapın: açık kimlikler, olayları daha sonra okumayı kolaylaştırır.
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["DEEPSEEK_API_KEY"],
base_url="https://api.deepseek.com",
)
response = client.chat.completions.create(
model="deepseek-flash", # "deepseek-v4-pro" idi
messages=[
{"role": "system", "content": "Destek biletlerini önceliklendiriyorsunuz. Öncelik, ekip ve özet içeren bir JSON nesnesi döndürün."},
{"role": "user", "content": "Müşteri, indirim kodu uygulandıktan sonra ödeme işleminin 502 döndürdüğünü bildirdi."},
],
response_format={"type": "json_object"},
)
print(response.choices[0].message.content)
- Akıl yürütme çabası ayarlarını gözden geçirin.
reasoning_effortveya bir düşünme anahtarını ayarladığınız her yeri listeleyin. Her uç nokta için derinlik mi yoksa gecikme mi istediğinize karar verin, ardından eski değeri taşımak yerine her birini yeni ölçeğe göre test edin. - Fonksiyon çağırma ve yapılandırılmış çıktı testlerini yeniden çalıştırın. Araç çağrısı argümanı biçimlendirmesi, model değişikliklerinin en çok zorladığı yerdir. V4-Pro'da fonksiyon çağırmayı kurduğunuzda testler yazdıysanız, bunları şimdi
deepseek-flash'a karşı çalıştırın. Yazmadıysanız, aşağıdaki Apidog iş akışı size bir set sunar. - Akış ayrıştırıcılarınızı kontrol edin. V4.1-Flash, düşünme modunda akıl yürütme deltalarını ve yanıt deltalarını ayrı ayrı akışa alır. SSE işleyicinizin bunları birleştirmediğinden ve “ilk belirteç” zamanlayıcınızın düşündüğünüzü ölçtüğünden emin olun.
- Gecikme ve maliyeti yeniden temel alın. Bu hafta V4-Pro'da p50 ve p95 gecikmesini artı istek başına belirteçleri kaydedin, ardından
deepseek-flashüzerinde aynı şeyi yapın. Pazartesi günü kontrol panelinin neden değiştiğini biri sorduğunda her iki sayıya da ihtiyacınız olacak. - Panoları ve bütçeleri güncelleyin. Yoğun saatlerde 3,96 dolarlık çıktıya göre kalibre edilmiş maliyet uyarıları, 1,20 dolar ödediğinizde sessizleşir ve hiç tetiklenmeyen bir bütçeye kimse bakmaz. Eşikleri fiyatlandırma sayfasındaki oranlara sıfırlayın ve eski kimliği filtreleyen model başına herhangi bir dökümü düzeltin.
Sohbet tamamlamaları yerine Anthropic uyumlu veya Yanıtlar API formatlarını çağırırsanız, aynı adımlar geçerlidir; V4-Pro API formatları karşılaştırması her isteğin nasıl göründüğünü gösterir, böylece alanları eşleyebilirsiniz.
V4-Pro ile V4.1-Flash bir bakışta
Referans değerleri, V4.1-Flash model kartından DeepSeek tarafından rapor edilmiştir. Fiyatlar, 10 Eylül 2026 tarihinden itibaren geçerli olmak üzere 1M belirteç başına ABD Dolarıdır.
| deepseek-v4-pro | deepseek-flash (V4.1) | |
|---|---|---|
| Aktif parametreler | V4.1 kartında yeniden belirtilmemiş | 8B ön doldurma / 16B kod çözme |
| HumanEval | 76.8 | 79.4 |
| GSM8K | 92.6 | 93.0 |
| DeepSWE v1.1 | 62.7 | 74.2 |
| Terminal-Bench 2.1 | 87.9 | 90.6 |
| Girdi, önbellek isabeti (yoğun olmayan / yoğun saatler) | $0.022 / $0.044 | $0.003 / $0.006 |
| Girdi, önbellek kaçırma (yoğun olmayan / yoğun saatler) | $0.66 / $1.32 | $0.15 / $0.30 |
| Çıktı (yoğun olmayan / yoğun saatler) | $1.98 / $3.96 | $0.60 / $1.20 |
| Bağlam / maks. çıktı | 1M / 384K | 1M / 384K |
| Eşzamanlılık limiti | 500 | 2,500 |
En büyük fark DeepSWE'de, 11,5 puan artışla. En küçük ise GSM8K, 0,4 artışla. İş yükünüz ilkokul matematiği gibiyse eşitlik bekleyin; çoklu dosya kod düzenlemeleri gibiyse, DeepSeek'in rakamları kazanç sağlayacağınızı söylüyor. V4-Flash'ı da içeren üçlü karşılaştırma V4.1-Flash vs V4-Pro vs V4-Flash makalesinde yer almaktadır.
Risk: tedarikçi referans değerleri, tedarikçi görevlerini ölçer
Bu tablodaki her sayı DeepSeek'ten geldi. “Birden fazla tarafça yapılan testler” DeepSeek'in ifadesidir ve taraflar sürüm notunda belirtilmemiştir. Bu, sayıların yanlış olduğu anlamına gelmez. Bu, ölçümlerin sizin istemleriniz, araç şemalarınız veya kullanıcılarınızın karmaşık girdileri üzerinde değil, referans paketleri üzerinde yapıldığı anlamına gelir.
Bir model, Terminal-Bench'te daha yüksek puan alsa bile, ayrıştırıcınızın bağlı olduğu bir araç çağrısı argümanını biçimlendirme şeklini değiştirebilir. Model iki kat daha fazla çıktı yazarsa, daha ucuz çıktı belirteçleri işe yaramaz. Bunu bilmenin tek yolu, her iki model de mevcutken kendi trafiğinizi her ikisi üzerinden geçirmektir. 14 Eylül'e kadar vaktiniz var.
Geçişten önce Apidog'da bir regresyon paketi oluşturun
İşte Apidog'da size tekrarlanabilir bir Pro ile Flash karşılaştırması sunan ve çalıştırmayı CI'a devreden bir iş akışı.
- Mevcut V4-Pro isteklerinizi içe aktarın. OpenAI uyumlu bir OpenAPI spesifikasyonu içe aktarın veya üretimde kullandığınız curl komutlarını yapıştırın.
DEEPSEEK_API_KEY'i bir ortama yerleştirin ve Yetkilendirme başlığındaBearer {{DEEPSEEK_API_KEY}}olarak referans verin.deepseek-v4-proolarak ayarlanmış ikinci bir{{MODEL_ID}}değişkeni ekleyin. - Her isteği
deepseek-flashile çoğaltın. İkinci bir ortamda{{MODEL_ID}}'yideepseek-flasholarak ayarlayın veya iki kimliği eşleştirilmiş isteklerde sabit kodlayın. Aynı istemler, aynı araç dizisi, aynımax_tokens. Tek fark model olmalıdır. - JSON şekli ve araç çağrısı yapısı üzerinde onaylamalar ekleyin. Yapılandırılmış çıktı için,
choices[0].message.content'ın JSON olarak ayrıştırıldığını ve beklediğiniz anahtarları içerdiğini onaylayın. Fonksiyon çağırma için,choices[0].message.tool_calls[0].function.name'in beklediğiniz araçla eşit olduğunu vearguments'ın ayrıştırıldığını onaylayın. Bu kontroller, sessiz format kaymalarını yakalar. - Her ikisini de tek bir test senaryosu olarak çalıştırın. Pro ve Flash isteklerini tek bir senaryoda birleştirin, böylece her çalıştırma tek bir rapor üretir.
stream: trueile bir akış isteği ekleyin; Apidog SSE olaylarını tek tek işler, böylece akıl yürütme ve yanıt deltalarının ayrıştırıcınızın beklediği şekilde gelip gelmediğini görebilirsiniz. - Sonuçları karşılaştırın. Raporun iki yarısını karşılaştırın: onaylama geçiş oranı, yanıt süresi ve
usage.completion_tokens. Her onaylamayı geçen ancak %40 daha fazla çıktı belirteci yayan bir model, maliyet matematiğinizi değiştirir ve bunu faturadan önce görürsünüz. apidog-cliile CI'da zamanlayın. Senaryoyu boru hattınızdan 14 Eylül boyunca günlük olarak çalıştırın ve sonrasında da çalıştırmaya devam edin. Pro kaldırıldıktan sonra, Pro kısmı da Flash yanıtlarını döndürür ve fark sıfıra iner: geçişin gerçekleştiğinin ve onaylamalarınızın hala geçerli olduğunun onayı.
Bunu kurmak için Apidog'u indirin. Akış paylaşılan bir projede yer alır, böylece faturanın sahibi ve istemlerin sahibi aynı raporu okur.
Sıkça Sorulan Sorular
V4-Pro çağrılarım 14 Eylül'de başarısız olacak mı? Hayır. deepseek-v4-pro'yu belirten istekler V4.1-Flash'a yönlendirilir. 200 yanıtı ve bir V4.1-Flash yanıtı alırsınız. Başarısızlık modu davranışsaldır, bir hata kodu değildir.
Geçişten sonra V4-Pro fiyatları üzerinden mi ücretlendirileceğim? Hayır. Yeniden yönlendirilen istekler V4.1-Flash tarifelerinden faturalandırılır: yoğun saatlerde, 1M önbellek-kaçırma giriş belirteci başına 1,32 dolar yerine 0,30 dolar ve 1M çıktı belirteci başına 3,96 dolar yerine 1,20 dolar.
Kimliği deepseek-flash olarak mı yeniden adlandırmalıyım yoksa deepseek-v4-pro olarak mı bırakmalıyım? Yeniden adlandırın. Takma ad çalışır, ancak açık bir kimlik, günlüklerinizin, panolarınızın ve maliyet raporlarınızın neyin çağrıldığını belirtmesi anlamına gelir.
V4-Pro-0813 kurulumu hala geçerli mi? V4-Pro-0813 API kılavuzundaki anahtar, temel URL ve istek şekli değişmeden kalır. Değişen, arkalarındaki model ve akıl yürütme çabası kontrolüdür, bu nedenle varsaymak yerine yeniden test edin.
V4.1-Flash herhangi bir konuda V4-Pro'dan daha mı kötü? DeepSeek'in yayınladığı referans değerleri, listelenen her görevde kazançlar gösteriyor. Yayınlandığı sırada bağımsız sonuçlar mevcut değildi. “Hiçbir şeyde kötü değil” ifadesini test edilmesi gereken bir iddia olarak kabul edin.
Dört gün yeterli
Geçiş, bir dize değişikliği ve bir test çalıştırmasından ibarettir. Dize değişikliği bir dakika sürer. Test çalıştırması, önümüzdeki hafta ödeyeceğiniz modelin etrafında tasarladığınız gibi davranıp davranmadığını size söyler. Paketi oluşturun, deepseek-v4-pro hala Pro'ya çözümlenirken çalıştırın ve farkı okuyun. Eğer temizse, %70 daha ucuz bir fatura ve beş kat daha fazla eşzamanlılığı ücretsiz elde edersiniz. Eğer değilse, bunu DeepSeek'in değil, kendi programınıza göre öğrenmiş olursunuz.
