deepseek-v4-flash-vision-exp uç noktası, V4 Flash serisine görsel girişi getiriyor. Ancak buradaki experimental etiketi önemli: paylaşılan lansman verileri, modelin üretim ortamındaki güvenilirliğini kanıtlamıyor. Bu nedenle, varsayılan üretim çözümü olarak değerlendirmeden önce loglanan bir pilot çalışma yürütün ve mutlaka bir geri dönüş seçeneği hazırlayın.
30 saniyede API tercihi
Mevcut V4 Flash akışınızda ekran görüntülerini, grafikleri, belgeleri veya başka görselleri API uyumlu bir arayüz üzerinden okutmanız gerekiyorsa DeepSeek V4 Flash Vision Exp uygun bir seçenek. Kimlik doğrulamaya bağlı ya da yüksek riskli görsel kararlar içinse yedek bir çözüm bulundurun ve ilgili görevi ayrıca doğrulayın.
| Senaryo | En uygun giriş yöntemi | Neden |
|---|---|---|
| Bir kez kullanılacak küçük yerel görsel | Base64 data URL | Herkese açık barındırma gerekmez |
| Zaten herkese açık olarak barındırılan görsel | Harici URL | İstek gövdesi küçük kalır |
| Büyük görsel veya tekrar tekrar kullanım | Files API file_id | Yüklemeyi yeniden kullanır ve referans verilen görsel başına 64 MiB'a kadar izin verir |
| Geniş kapsamlı bir görevde ayrıntıyı azaltmak gerektiğinde | detail: "low" | Çıkarımdan önce görseli 512 x 512 boyutuna indirger |
Modelin tam adı deepseek-v4-flash-vision-exp. DeepSeek, modeli deneysel olarak listeliyor ve resmî değişiklik günlüğünde 21 Ağustos 2026 itibarıyla API platformunda kullanılabildiğini belirtiyor. Yayın notunda, salt metin yeteneklerinde V4 Flash ile eşdeğer performans ve görsel anlayış gerektiren ajan benchmark'larında büyük iyileşme bildiriliyor.
Chat Completions ile tek görsel gönderme
OpenAI uyumlu Chat Completions isteğinde metin ve görsel, user mesajının içindeki content dizisinde birlikte gönderilir. Resmî Vision rehberi, modele özgü davranışı ayrıntılı biçimde açıklıyor; sıradan deepseek-v4-flash modeline görsel göndermek 400 hatası döndürür.
import base64
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["DEEPSEEK_API_KEY"],
base_url="https://api.deepseek.com",
)
with open("chart.png", "rb") as image_file:
encoded = base64.b64encode(image_file.read()).decode("utf-8")
response = client.chat.completions.create(
model="deepseek-v4-flash-vision-exp",
messages=[
{
"role": "user",
"content": [
{"type": "text", "text": "Extract the three trends from this chart."},
{
"type": "image_url",
"image_url": {
"url": f"data:image/png;base64,{encoded}",
"detail": "original",
},
},
],
}
],
)
print(response.choices[0].message.content)
Chat Completions içinde görseller user mesajlarında desteklenir. Modelin görsel bağlamı ve görevi birlikte alması için görseli ve talimatı aynı içerik dizisinde tutun.
Görseli nasıl göndermelisiniz?
Küçük yerel dosyalar için Base64
Yerelde duran ve tek seferlik kullanılacak görsellerde en kolay yol Base64'tür. Herkese açık barındırma ihtiyacını ortadan kaldırır; fakat kodlanmış veri 48 MiB istek gövdesi sınırına dahil olur ve kaynak görsel 32 MiB ile sınırlıdır.
Bunu tekil kullanıcı veya worker yüklemelerinde kullanın; toplu işlemlerde tekrar tekrar kullanılacak görseller için tercih etmeyin.
Barındırılan varlıklar için herkese açık URL
Herkese açık http veya https URL'leri isteği küçük tutar. Ancak URL erişilebilir olmalı, 8.192 karakteri aşmamalı, indirme işlemi 60 saniye içinde tamamlanmalı ve görsel 32 MiB'tan büyük olmamalıdır. Özel, süresi dolmuş veya kurum içi URL'ler, DeepSeek görseli çekemeden başarısız olabilir.
Tekrar kullanım ve büyük dosyalar için Files API
Görseli Files API üzerinden yükleyin, ardından Vision isteğinde dönen kimliği kullanın:
{
"type": "file",
"file_id": "file-api-xxxxxxxxxxxxxxxx"
}
Referans verilen bir dosya, görsel başına 64 MiB'a kadar çıkabilir ve her istekte aynı baytları yeniden yükleme gereğini ortadan kaldırır. Bunun karşılığında ek bir yükleme ve dosya yaşam döngüsü adımı oluşur; dönen kimliği herkese açık paylaşım bağlantısı gibi görmek yerine, onu oluşturan anahtarla ilişkilendirin.
Dosya 32 MiB'tan büyükse, istek 48 MiB'ı aşabilecekse veya birden fazla ajan adımının aynı görseli incelemesi gerekiyorsa Files API pratik tercihtir.
Maliyet oluşmadan görsel ayrıntısını belirleyin
detail alanı, image_url girişleri ve Responses API görsel parçaları için kullanılabilir. Aşağıdaki davranışlar DeepSeek'in resmî Vision rehberine dayanır.
| Değer | Belgelenen davranış | Şu durumda kullanın |
|---|---|---|
low | Görseli 512 x 512 boyutuna indirger | Yerleşim, genel sahne veya kaba sınıflandırma yeterliyse |
high | Özgün görseli korur | Küçük metinler ya da ince ayrıntılar önemliyse |
original | Özgün görseli korur | Tam ayrıntı kullanımını açıkça belirtmek istiyorsanız |
auto | Şu anda original ile eşdeğerdir | Mevcut varsayılan davranışı kabul ediyorsanız |
DeepSeek, çıkarımdan önce görselleri yeniden boyutlandırır. Vision rehberine göre her görsel en fazla 384 görsel token'ı kullanır ve görseller ayrı ayrı hesaplanır. Çok büyük bir kaynak görsel, yeniden boyutlandırma sonrasında mutlaka orantılı olarak daha fazla görsel token'ı tüketmez; yine de büyük dosyalar yükleme ve istek boyutu sınırlarına takılabilir.
Resmî Models & Pricing sayfası, deepseek-v4-flash-vision-exp için V4 Flash ile aynı token ücretlerini listeliyor: yoğun olmayan saatlerde 1 milyon cache-hit giriş token'ı için $0.007, cache-miss giriş token'ı için $0.22. Yoğun saatlerde bu rakamlar sırasıyla $0.014 ve $0.44. Çıkış ücretleri yoğun olmayan saatlerde $0.66, yoğun saatlerde ise $1.32. Görsel token'ları giriş token'larıyla birlikte ücretlendirilir; bu yüzden görsel sayısı ve ayrıntı tercihi maliyet hesabınıza dahil edilmelidir.
Pratikte API hatasına yol açan sınırlar
| Kısıt | Sınır veya davranış |
|---|---|
| Desteklenen formatlar | JPEG, PNG, GIF, WebP |
| Azami istek gövdesi | 48 MiB |
| Base64 veya URL ile gönderilen azami görsel | 32 MiB |
Files API file_id ile gönderilen azami görsel | 64 MiB |
| İstek başına azami görsel sayısı | 600 |
file_id görselleri hariç toplam görsel boyutu | 64 MiB |
file_id görselleri dahil toplam görsel boyutu | 200 MiB |
| Azami boyut | Her kenar için 8.192 piksel |
| 15 veya daha fazla görselde boyut sınırı | Her kenar için 4.096 piksel |
| Harici URL uzunluğu | 8.192 karakter |
| Harici görsel indirme | 60 saniye içinde tamamlanmalı |
Gözden kaçması kolay iki önemli kısıt var. Görsel kabul eden tek model deepseek-v4-flash-vision-exp; ayrıca Chat Completions'ta system veya assistant mesajlarındaki görsel blokları başarısız olur. Görsel desteklemeyen bir modele gönderilirse DeepSeek'in belgelediği 400 hata mesajı This model does not support image olur.
Üç farklı API arayüzünde aynı model
DeepSeek, modeli Vision rehberinde üç arayüz için belgeliyor:
| Arayüz | Görsel bloğu | Sonuca erişim |
|---|---|---|
| Chat Completions | Bir kullanıcı içerik dizisinde image_url | response.choices[0].message.content |
| Responses API | input_text ile birlikte input_image | response.output_text |
| Anthropic uyumlu API | https://api.deepseek.com/anthropic üzerinde image | Anthropic mesaj içeriği |
Üçü de Base64, herkese açık URL ve Files API referanslarını destekler; ancak içerik türleri farklıdır. Chat Completions bloğunu değiştirmeden Responses API'ye kopyalamayın.
Lansman verilerinin söylediği ve söylemediği şeyler
DeepSeek'in 21 Ağustos tarihli değişiklik günlüğü, Terminal Bench 2.1'de 83.9 ve p0.95'te Chartography'de 64.3 dahil olmak üzere güçlü lansman benchmark'ları bildiriyor. Bunlar bağımsız olarak yeniden üretilmiş sonuçlar değil, sağlayıcının kendi bildirdiği değerlerdir. Yayın notunda ayrıca salt metin V4 Flash'ın iki görsel değerlendirmede multimodal unsurları yok saydığı belirtiliyor.
Lansman benchmark sonuçları sağlayıcı tarafından bildirildiği için, üretim trafiğini yönlendirmeden önce uygulamanız açısından önemli görsel görevleri doğrulayın.
Üretim ortamında kullanılmalı mı?
İş yükünüz ekran görüntüsü analizi, grafik çıkarımı, belge ön elemesi veya görsel durumu incelemesi gereken bir ajan içeriyorsa DeepSeek V4 Flash Vision Exp'i kontrollü bir pilotta kullanın. Flash ile aynı fiyatlandırma ve üç farklı giriş yöntemi, değerlendirme maliyetini düşük tutar. Görsel başına 384 token sınırı da maliyet modellemesi için somut bir başlangıç noktası sunar.
Model deneysel statüdeyken ve aktarılan lansman verileri bu senaryolarda güvenilirliği kanıtlamazken, kimlik doğrulama, güvenlik kararları, tıbbi yorumlama veya sonuçları ağır olan başka görsel değerlendirmelerde bunu tek arka uç olarak kullanmayın. Aynı arayüzün arkasına bir geri dönüş seçeneği yerleştirin; görsel kaynağını, detail ayarını, giriş ve çıkış kullanımını, gecikmeyi, yeniden denemeleri ve görev başarısını kaydedin.
Üretim trafiğini yönlendirmeden önce en az şunları test edin:
- Ekran görüntülerindeki küçük metinleri
lowveoriginalayrıntı seviyelerinde. - Etiketler, açıklama kutuları ve yoğun eksenler içeren grafikleri.
- Tek istekte birden fazla görseli.
- Özel ve yavaş görsel URL'lerini.
- Görsel incelemenin ardından yapılan araç çağrılarını.
- Hatalı veya belirsiz kimlik isteklerini.
- 400 hatası, zaman aşımı ya da hatalı biçimlendirilmiş görsel yanıtından sonra geri dönüş davranışını.
DeepSeek V4 Flash Vision Exp API SSS
Modelin tam adı nedir?
deepseek-v4-flash-vision-exp kullanın. DeepSeek'in 21 Ağustos 2026 tarihli değişiklik günlüğü, bunu API platformundaki deneysel bir multimodal model olarak tanımlıyor.
V4 Flash ile aynı şekilde mi ücretlendirilir?
Evet. DeepSeek'in fiyatlandırma sayfası, Vision Exp ve V4 Flash için aynı cache-hit, cache-miss ve çıkış token ücretlerini listeliyor. Görsel token'ları giriş token'larıyla birlikte ücretlendirilir ve yeniden boyutlandırma sonrasında görsel başına en fazla 384 token kullanılır.
Görsel üretebilir mi?
Resmî Vision rehberi görsel üretimini değil, görsel anlayışını belgeliyor. DeepSeek ayrı bir üretim desteği yayımlamadıkça bu uç noktayı yalnızca anlama amaçlı kabul edin.
İsteğim neden 400 hatası döndürüyor?
Model adını, mesaj rolünü, içerik bloğu türünü, dosya boyutunu ve görsel formatını kontrol edin. Görselleri görsel desteklemeyen bir modele göndermek veya desteklenmeyen mesaj rollerine yerleştirmek, belgelenen This model does not support image hatasını tetikleyebilir.