Qwen / qwen/qwen3.8-flash
Qwen3.8-Flash - LLMTR üzerinden erişim
Qwen3.8-Flash, uzun belgeleri, görselleri ve videoları aynı konuşmada inceleyen uygulamalar için Qwen'in düşük maliyetli Flash modelidir. 1.000.000 token bağlam ve 131.072 token çıktı sınırı sunar. Kod yardımı, belge özeti, görsel soru yanıtlama ve araç kullanan akışlarda kullanılabilir; JSON Schema ile yapılandırılmış metin üretir. Thinking varsayılan açıktır ve kapatılabilir. Tekrarlanan istem öneklerinde cache isabeti girdi maliyetini düşürür; uzun girdiler için ayrı bir fiyat kademesi yoktur.
Teknik özellikler
| Canonical ID | qwen/qwen3.8-flash |
|---|---|
| Sağlayıcı | Qwen |
| Context penceresi | 1.000.000 tokens |
| Operasyonlar | CHAT_COMPLETIONS |
| Modaliteler | text, image, video |
Fiyatlandırma
Kredi yüklemede %8 platform marjı uygulanır; model kullanım fiyatları ayrıca yükseltilmez.
| Operation | Metric | Unit | Price |
|---|---|---|---|
| CHAT_COMPLETIONS | INPUT_TEXT | PER_1M_TOKENS | $0.160000 |
| CHAT_COMPLETIONS | CACHE_READ | PER_1M_TOKENS | $0.016000 |
| CHAT_COMPLETIONS | OUTPUT_TEXT | PER_1M_TOKENS | $0.470000 |
Örnek kullanım
Mevcut OpenAI SDK akışında yalnızca base URL ve model kimliğini değiştirirsiniz.
curl https://llmtr.com/v1/chat/completions \
-H "Authorization: Bearer llmtr-your_key" \
-H "Content-Type: application/json" \
-d '{"model":"qwen/qwen3.8-flash","messages":[{"role":"user","content":"Hello"}]}'
İlgili modeller
- Qwen3.8-Max qwen/qwen3.8-max
- Qwen3.7-Max qwen/qwen3.7-max
- Qwen3.8 2.4T A95B qwen/qwen3.8-2.4t-a95b
- Qwen3.7-Plus qwen/qwen3.7-plus
- Qwen3.6-Flash qwen/qwen3.6-flash
- Qwen-Plus qwen/qwen-plus
- Qwen-Plus-2025-01-25 qwen/qwen-plus-2025-01-25
- Qwen-Plus-2025-04-28 qwen/qwen-plus-2025-04-28