Qwen / qwen/qwen3.8-flash

Qwen3.8-Flash - LLMTR üzerinden erişim

Qwen3.8-Flash, uzun belgeleri, görselleri ve videoları aynı konuşmada inceleyen uygulamalar için Qwen'in düşük maliyetli Flash modelidir. 1.000.000 token bağlam ve 131.072 token çıktı sınırı sunar. Kod yardımı, belge özeti, görsel soru yanıtlama ve araç kullanan akışlarda kullanılabilir; JSON Schema ile yapılandırılmış metin üretir. Thinking varsayılan açıktır ve kapatılabilir. Tekrarlanan istem öneklerinde cache isabeti girdi maliyetini düşürür; uzun girdiler için ayrı bir fiyat kademesi yoktur.

Teknik özellikler

Canonical IDqwen/qwen3.8-flash
SağlayıcıQwen
Context penceresi1.000.000 tokens
OperasyonlarCHAT_COMPLETIONS
Modalitelertext, image, video

Fiyatlandırma

Kredi yüklemede %8 platform marjı uygulanır; model kullanım fiyatları ayrıca yükseltilmez.

OperationMetricUnitPrice
CHAT_COMPLETIONSINPUT_TEXTPER_1M_TOKENS$0.160000
CHAT_COMPLETIONSCACHE_READPER_1M_TOKENS$0.016000
CHAT_COMPLETIONSOUTPUT_TEXTPER_1M_TOKENS$0.470000

Örnek kullanım

Mevcut OpenAI SDK akışında yalnızca base URL ve model kimliğini değiştirirsiniz.

curl https://llmtr.com/v1/chat/completions \
  -H "Authorization: Bearer llmtr-your_key" \
  -H "Content-Type: application/json" \
  -d '{"model":"qwen/qwen3.8-flash","messages":[{"role":"user","content":"Hello"}]}'

İlgili modeller