DeepSeek V4-Flash-Vision API Nasıl Kullanılır (Görüntü Giriş Kılavuzu)

DeepSeek'in en ucuz modeli artık görebiliyor. Model Kimliği, 384 jetonluk görüntülerle flaş hızlı fiyatlandırma, üç giriş yöntemi, sınırlar ve çözümlü bir maliyet örneği.

Ashley Innocent

Ashley Innocent

24 August 2026

DeepSeek V4-Flash-Vision API Nasıl Kullanılır (Görüntü Giriş Kılavuzu)

Kurumsal İçin Apidog

Şirket İçi (On-Premises) Dağıtım

SSO ve RBAC

SOC 2 Uyumlu

Apidog Enterprise'ı Keşfedin

DeepSeek'in en ucuz modeli artık görebiliyor. 21 Ağustos 2026'da DeepSeek, V4-Flash'ın görsel özellikli bir yapısı olan `deepseek-v4-flash-vision-exp`'i yayınladı. Bu model, aynı üretim API'si aracılığıyla görselleri kabul ediyor ve her görselin en fazla 384 giriş tokenı olarak faturalandırılmasıyla metin tabanlı modelle aynı fiyata sunuluyor. Resmi sürüm notu bunu açıkça belirtiyor: V4-Flash ile aynı metin yeteneği, ayrıca DeepSeek'in çok modlu ajan performansını Opus 4.8'e yaklaştırdığını söylediği görsel anlama özelliği. Bu rehber, modelin ne olduğunu, ismindeki "Exp"in üretim kullanımı için ne anlama geldiğini, görselleri göndermenin üç yolunu, sizi zorlayacak sınırları ve çok modlu istekleri doğru şekilde nasıl test edeceğinizi kapsıyor. Görsel istekler içerik türlerini karıştırır ve hızla büyür, bu nedenle terminalde JSON'ı elle düzenlemek yerine Apidog'da oluşturmaya değer API çağrılarıdır.

button

deepseek-v4-flash-vision-exp nedir

Model, bir görsel kodlayıcı eklenmiş V4-Flash-0731'dir. DeepSeek'e göre, ajan iş yükleri, muhakeme ve dünya bilgisi dahil olmak üzere metin görevlerinde temel modelle eşleşiyor, böylece V4-Flash'ın zaten yaptıklarını kaybetmeden yer değiştirebilirsiniz. OpenRouter listelemesi, onu toplam 284B parametreden 13B aktif parametreye sahip seyrek bir uzman karışımı modeli olarak tanımlıyor.

Önemli bağlam: V4-Flash, DeepSeek'in bütçe serisidir. Metin modelini DeepSeek V4-Flash API rehberimizde piyasaya sürüldüğünde ele aldık ve ekonomi değişmedi. Flash fiyatlandırmasıyla görsel özelliği, piyasadaki neredeyse tüm çok modlu API'leri geride bırakıyor, bu nedenle DeepSeek'in kendi çerçevesi olan "çok modlu ajan kıyaslamalarında Opus 4.8'e yakın" iddiası dikkat çekti. Satıcı kıyaslama iddialarını iddia olarak kabul edin; herhangi bir şeyi taşımadan önce kendi belgeleriniz üzerinde kendi değerlendirmelerinizi yapın.

Deneysel etiketine rağmen, bu bir sanal alan oyuncağı değil. Model, diğer V4 modelleriyle aynı hız limitleri ve SLA ile üretim API uç noktalarında çalışır ve bekleme listesi veya özel erişim isteği yoktur.

Fiyatlandırma: flash oranları, görseller dahil

Fiyatlandırma kartı, DeepSeek'in fiyatlandırma sayfasına göre yalnızca metin tabanlı deepseek-v4-flash ile aynıdır:

Off-peak (Yoğun Olmayan Saatler) Peak (Yoğun Saatler)
Input, cache hit (giriş, önbellek isabeti) (1 milyon token başına) $0.007 $0.014
Input, cache miss (giriş, önbellek kaçırma) (1 milyon token başına) $0.22 $0.44
Output (çıkış) (1 milyon token başına) $0.66 $1.32

Görseller, faturalandırma için her biri en fazla 384 token olarak tokenize edilir ve giriş oranından ücretlendirilir. Yoğun saatlerde önbellek kaçırma fiyatlandırmasında, tam maliyetli bir görsel yaklaşık 0,00017 ABD dolarıdır. Bin görsel bir kahveden daha ucuza mal olur.

İki fiyatlandırma davranışı metin modelinden aktarılır. Yoğun olmayan saatler, yoğun saatlerin yarısı kadardır; yoğun saatler hafta içi 01:00 ile 04:00 ve 06:00 ile 10:00 UTC arasıdır, bu nedenle bu pencerenin dışında planlanan toplu görsel işleri yarı yarıya daha az maliyetli olur. Ve bağlam önbellekleme, tekrarlanan girişe uygulanır, bu da farklı görseller etrafında aynı sistem istemini yeniden gönderdiğinizde önemlidir. Fiyatlandırma sayfasında V4 serisi için 1M tokenlık bir bağlam penceresi listelenir, çıkış pratikte bunun çok altında sınırlıdır.

Görsel göndermenin üç yolu

Model, DeepSeek'in standart Chat Completions uç noktası aracılığıyla https://api.deepseek.com/chat/completions adresinde çalışır (V4-Flash Responses API lansmanının ortaya koyduğu gibi Messages-stili ve Responses-stili çağrılar da desteklenir). Görseller, bir kullanıcı mesajının content dizisinde yer alır ve üç teslimat seçeneğiniz vardır.

1. Base64 satır içi. Görseli bir veri URL'si olarak kodlayın. Basit, kendi kendine yeterli ve her görsel için 32 MiB ile sınırlıdır:

import base64
from openai import OpenAI

client = OpenAI(api_key="YOUR_DEEPSEEK_KEY", base_url="https://api.deepseek.com")

with open("invoice.png", "rb") as f:
    b64 = base64.b64encode(f.read()).decode()

response = client.chat.completions.create(
    model="deepseek-v4-flash-vision-exp",
    messages=[{
        "role": "user",
        "content": [
            {"type": "text", "text": "Extract the line items and totals as JSON."},
            {"type": "image_url", "image_url": {"url": f"data:image/png;base64,{b64}"}}
        ]
    }]
)
print(response.choices[0].message.content)

2. Harici URL. Kodlama yerine herkese açık erişilebilir bir bağlantı (8.192 karaktere kadar) geçirin:

{"type": "image_url", "image_url": {"url": "https://example.com/chart.png"}}

3. Dosyalar API referansı. Bir kez yükleyin, kimliğe göre yeniden kullanın. DeepSeek'in Dosyalar API'si artık ücretsiz görsel yüklemelerini kabul ediyor ve bir file_id referansı, istekler arasında aynı görseli yeniden yüklemeyi atlar, her görsel için daha yüksek 64 MiB'lik bir üst sınırla:

{"type": "file", "file": {"file_id": "file-api-xxxxxxxxxxxxxxxx"}}

Tek seferlik çağrılar için Base64'ü, görselleriniz zaten bir CDN'de yaşıyorsa URL'leri ve aynı görseli birden fazla kez kullanan herhangi bir iş akışı için dosya kimliklerini kullanın.

Detay parametresi

Her görseldeki isteğe bağlı bir detail alanı, ön işlemeyi kontrol eder:

Dahili olarak, görseller token sayımı için kabaca 800x800'e normalleştirilir, böylece görsel başına 384 tokenlık tavan korunur. Fişler veya gösterge tabloları üzerinde OCR'ye yakın işler yapıyorsanız, gerçek külliyatınızda "low" ile "high"'ı test edin; bu fiyatlarda maliyet farkı azdır, ancak doğruluk farkı büyük olabilir.

Üretimden önce bilinmesi gereken sınırlar

Kısıtlama Değer
İstek başına maksimum görsel sayısı 600
Satır içi (base64) görsel boyutu 32 MiB
Dosyalar API'si görsel boyutu 64 MiB
Toplam istek gövdesi 48 MiB
Görsel boyutları Kenar başına 8.192 px (15'ten fazla görsel içeren bir istek olduğunda 4.096 px)
Harici URL uzunluğu 8.192 karakter
Görsel yerleşimi Yalnızca user mesajları

Bu son satır gerçek bir 400 hatası üreticisidir: system veya assistant mesajlarındaki görseller reddedilir. Çoklu görsel istekleri desteklenir ve metinle serbestçe iç içe geçer, bu da modelin ekran görüntüsü alan, akıl yürüten ve eylemde bulunan ajan döngüleri için kullanılabilir olmasını sağlar. Bu döngüleri düzenliyorsanız, DeepSeek aynı gün DeepSeek Harness 0.1.1'de bu model için yerel destek sağladı; DeepSeek Harness genel bakışımız bu yığını kapsar. Ayrıca, araç çağırma özelliğinin görsel özelliğin yanında çalıştığını da unutmayın, tıpkı fonksiyon çağırma rehberimizde açıklanan metin modelinin akışı gibi.

"Exp" sizin için ne anlama geliyor

Sonek dürüst bir etiketlemedir, bir ödeme duvarı değildir. Daha önce deneysel DeepSeek uç noktalarında olduğu gibi, modelin kısa sürede revize edilmesini veya değiştirilmesini bekleyin. Pratik önlemler:

Çalışma örneği: bir belge boru hattı ne kadara mal olur

Sayılar fiyatlandırmayı somutlaştırır. Ayda 50.000 taranmış faturayı, her biri bir görselle, 200 tokenlık bir talimat istemi ve çağrı başına yaklaşık 400 tokenlık JSON çıktısıyla işlediğinizi varsayalım:

Toplam: yoğun saatlerde ayda yaklaşık 35 ila 40 dolar, toplu işlem hafta içi 01:00 ile 10:00 UTC saatlerinin dışında çalışırsa bunun yaklaşık yarısı. Çıkış tokenları baskındır, ki bu faydalı bir derstir: görseller bu kadar ucuzken, bir görsel boru hattını görselleri küçülterek değil, yanıt formatını sıkılaştırarak optimize edersiniz. Düz yazı açıklamaları yerine kompakt JSON için istemde bulunmak, görsel ön işlemenin yapacağından daha fazla faturayı düşürür.

Bu maliyet profili aynı zamanda modelin ajan döngüleri için hesaplamayı neden değiştirdiğini de açıklar. Amiral gemisi çok modlu modellerde sürekli çalıştırmak için çok pahalı olan bir ekran görüntüsü-akıl yürütme-eylem döngüsü, kare başına 384 token ile uygulanabilir hale gelir.

Apidog'da çok modlu istekleri test etme

Görsel isteklerini elle yinelemek can sıkıcıdır: Base64 blobları ham JSON'ı okunaksız hale getirir ve detail ayarlarını karşılaştırmak neredeyse aynı yükleri karıştırmak anlamına gelir. Daha temiz bir döngü:

  1. {{model_id}}, {{detail}} ve görsel yükünü değişkenler olarak kullanarak isteği bir Apidog projesine bir kez kaydedin. Test görsellerini veya detay seviyelerini değiştirmek, açılır menüden seçim yapmak kadar kolay hale gelir.
  2. Kodlamayı betikleyin. Bir ön istek betiği görseli okur ve Base64 dizesini enjekte eder, böylece görünür istek gövdesi okunabilir kalır.
  3. Yapıyı doğrulayın, hisleri değil. JSON çıktısı (satır öğeleri, sınırlayıcı açıklamalar, grafik değerleri) için istemde bulunuyorsanız, yanıtı ayrıştıran ve alanları kontrol eden onaylar ekleyin. Bu, "model iyi görünüyor" ifadesini, her Exp-model revizyonundan sonra yeniden çalıştırabileceğiniz bir geçme/kalma durumuna dönüştürür.
  4. İstem ayarlanırken ön ucunuz için yanıt şeklini taklit edin; Apidog'un akıllı taklidi, API çağrılarını yakmadan şemayı sunar.

Apidog'u ücretsiz indirin ve tüm kurulum dakikalar sürer; DeepSeek deneysel modeli revize ettiğinde yeniden çalıştırmak tek bir tıklamadır.

SSS

deepseek-v4-flash-vision-exp ücretsiz mi? Hayır, ama çok yakın. Tam olarak metin modelinin flash oranlarında faturalandırılır, her görsel 384 giriş tokenı ile sınırlıdır. DeepSeek'in Dosyalar API'si görsel depolama alanı ücretsizdir; yalnızca görseller bir isteğe girdiğinde ödeme yaparsınız.

deepseek-v4-flash'ın yerine mi geçiyor? Hayır. Metin modeli kararlı kimlik olarak kalır. Görsel yapısı metin görevlerinde onunla eşleşir, bu nedenle deneysel dalgalanmayı kabul ediyorsanız görsel kimliği üzerinde birleşebilirsiniz, ancak muhafazakar desen, yalnızca görsel içeren trafiği ona yönlendirmektir.

Anthropic tarzı API formatı aracılığıyla kullanabilir miyim? Evet. DeepSeek'in V4 uç noktaları Chat Completions, Messages-format ve Responses-format çağrılarını kabul eder, böylece mevcut üç stilden herhangi birindeki istemciler, istek lehçelerini değiştirmeden görsel blokları ekleyebilir. V4 Pro API detaylı incelememiz, aile genelinde paylaşılan uç nokta mekaniklerini gösterir.

Fiyatlandırma GPT veya Claude vision ile nasıl karşılaştırılır? Milyon giriş tokenı başına 0.22 ila 0.44 dolar ve 384 tokenlık görsellerle, amiral gemisi çok modlu oranların bir mertebe altındadır. Açık soru, iş yükünüzdeki doğruluktur, ki yukarıdaki değerlendirme senaryosu bunun içindir.

Sonuç

DeepSeek aynı oyun kitabını uygulamaya devam ediyor: herkesin yüksek fiyatlarla sunduğu yeteneği alıp flash fiyatlandırmasıyla sunmak ve stabilize olurken dürüstçe etiketlemek. deepseek-v4-flash-vision-exp, üretim uç noktalarında görsel anlama yeteneğini görsel başına sentin kesirleri kadar düşük bir fiyata sunuyor, üç giriş yolu ve etrafında tasarım yapabileceğiniz gerçek sınırlamalarla. İsteği bir kez Apidog'da oluşturun, onaylarınızı sabitleyin ve hem Exp modelini bugün kullanmaya hem de halefini çıktığı gün yargılamaya hazır olacaksınız.

API Tasarım-Öncelikli Yaklaşımı Apidog'da Uygulayın

API'leri oluşturmanın ve kullanmanın daha kolay yolunu keşfedin