AIREITER
QwenText Chat

Qwen3.8 Flash

Qwen3.8 Flash; kodlama, ajanlar ve uzun belgeler için hızlı bir modeldir. 1M bağlam. Milyon token başına yaklaşık $0.057 girdi ve $0.193 çıktı.

GirdiResmi $0.1143 1 milyon token basinaAIReiter $0.0571 1 milyon token basinaÇıktıResmi $0.3857 1 milyon token basinaAIReiter $0.1929 1 milyon token basinaCache okumaResmi $0.0143 1 milyon token basinaAIReiter $0.0071 1 milyon token basinaCache oluşturmaResmi $0.1429 1 milyon token basinaAIReiter $0.0714 1 milyon token basina
API ile çalıştır

GIRDI

ÇIKTI

Example
Generated in
42.7 seconds
Girdi Token
134
Çıktı Token
2354
Tokens per second
55.13 tokens / second
Time to first token
-

Model ayrıntıları

Aynı model anahtarını Playground'da, API isteklerinde ve dahili iş akışlarında kullanın.

Model ID
qwen3.8-flash
Sağlayıcı
Qwen
Protokol
OpenAI Chat Completions
Bağlam penceresi
1,000,000 token
Maksimum çıktı
131,072 token
Girdi Token
5.7143 credits / 1 Mn token
Çıktı Token
19.2857 credits / 1 Mn token
Önbellek okuma
0.7143 credits / 1 Mn token
Önbellek yazma
7.1429 credits / 1 Mn token

Kodlama ve uzun süreli işler için hızlı bir Qwen modeli

Qwen3.8 Flash, Alibaba'nın Qwen3.8 serisinin hız odaklı katmanıdır. Kodlama, araç kullanan ajanlar ve kısa bir sohbete sığmayan belgeler için tasarlanmıştır.

Büyük model, düşük maliyet

Toplam 125 milyar parametreye sahiptir ve her token için yaklaşık 6 milyarı kullanılır. Bu sayede yüksek hacimli işler için hem hızlı hem de yeterince ekonomik kalır.

1 milyon token bağlam

Uzun bir teknik şartnameyi, bir yığın dosyayı veya uzun bir ajan izleme kaydını tek bir istekte iletin. Tek bir yanıt 131.072 tokene kadar çıkabilir.

Metinlerin yanı sıra görselleri de okur

Model yalnızca düz metinleri değil; ekran görüntülerini, grafikleri ve belgeleri de anlar. Görev ekrandaki bir içerikle başladığında bu özelliği kullanın.

Yaklaşık $0.057 / $0.193

Milyon token başına girdi yaklaşık $0.057 ve çıktı yaklaşık $0.193 olup, resmi liste fiyatının yaklaşık yarısıdır. Önbelleğe alınmış girdi daha ucuzdur. Yukarıdaki fiyat çubuğu canlı tarifeyi gösterir.

Qwen3.8 Flash'ın güçlü olduğu yönler

Qwen'in Ağustos 2026 sürümüyle yayımlanan kendi model kartı, karşılaştırılan modeller arasında Flash'a kodlama ve araç kullanımında en yüksek puanı veriyor.

Kod deposu çalışmaları

SWE-bench Pro 62.5. SWE-bench Multilingual 81.0. Bir hatayı bulmak, birden çok dosyayı düzenlemek ve sonucu kontrol etmek için kullanın.

Araç çağıran ajanlar

DeepSWE 58.7. Toolathlon 73.5. Çok adımlı bir döngüyü yürütür: hatayı okur, bir araç çağırır ve tekrar dener.

Kod ve zor sorular

LiveCodeBench v6 skoru 91.9. GPQA Diamond skoru 91.7. Rekabetçi programlama ve bilim soruları kapsama alanındadır.

Ekrana bakma

OSWorld kısmi skoru 52.3. MathVision 90.6 veya kod çalıştırabildiğinde 95.7. Ekran görüntüleri ve grafikler soruyla birlikte gönderilebilir.

Flash veya Max

Flash, tüm gün çalışır durumda bırakabileceğiniz modeldir. Max ise işin bütçeden daha kritik olduğu durumlar için amiral gemisidir.
01

Flash'ı seçin

Kodlama ajanları, test-ve-düzeltme döngüleri, uzun belgeler ve maliyeti önemsediğiniz tüm iş yükleri için. 1M penceresi, uzun bir izleme kaydını bölmeden kapsar.

02

Max'i seçin

Qwen3.8 Max, 2.4 trilyonluk amiral gemisi modeldir. En güçlü Qwen modelini istediğinizde ve token fiyatı ikincil planda olduğunda kullanın. /chat/qwen3-8-max adresinden erişebilirsiniz.

03

Aynı istek yapısı

Her iki model de standart bir chat completion isteği alır. Flash için modeli qwen3.8-flash olarak ayarlayın. Yanıtın uzun bir işlem kaydına ihtiyacı olduğunda max tokens değerini artırın. Varsayılan değer 8.192 ve üst sınır 131.072'dir.

Sorular

Bağlam, fiyat, görseller ve Max ile karşılaştırması.

/ 01

Qwen3.8 Flash ne için kullanılır?

Hızlı kodlama, araç kullanan ajanlar ve uzun belgeler için. Max'in daha küçük bir kopyası değil; daha ucuz, daha hızlı Qwen3.8 modelidir.

/ 02

Bağlam uzunluğu ne kadar?

1 milyon token. Tek bir yanıt 131.072 tokene kadar çıkabilir.

/ 03

Maliyeti ne kadar?

Milyon token başına yaklaşık $0.057 girdi ve $0.193 çıktı; resmi liste fiyatının yaklaşık yarısı. Önbellekten okuma daha düşük maliyetlidir. Araç çağrısı başına ek bir ücret yoktur. Fiyat çubuğu anlık tarifeyi gösterir.

/ 04

Görselleri okuyabilir mi?

Evet. Ekran görüntüleri, grafikler ve belge görselleri, metinle birlikte model tarafından desteklenir.

/ 05

Bunun yerine ne zaman Qwen3.8 Max kullanmalıyım?

Amiral gemisi modeli istediğinizde ve token başına daha fazla ödeyebileceğiniz durumlarda. Max, 2.4T modelidir. Flash ise yüksek hacimli kullanım içindir.