Qwen / qwen/qwen3.8-2.4t-a95b
Qwen3.8 2.4T A95B - LLMTR üzerinden erişim
Qwen3.8 2.4T A95B, Qwen3.8 neslinin acik agirlikli surumudur: 2,4 trilyon parametrenin token basina 95 milyari calisan seyrek bir Mixture-of-Experts modelidir. Kod yazma, arastirma ve cok adimli bir isi sonuna kadar goturmesi gereken uzun soluklu ajan akislari icin tasarlanmistir. 262.144 tokenlik baglam penceresi, yerel arac cagrisi, JSON Schema ile sema zorlamali cikti ve tekrarlanan onekleri ucuzlatan prompt cache sunar. Adim adim dusunme her zaman aciktir ve yanittan ayri doner; bu yuzden kisa bir soru bile dusunme tokeni harcayabilir, `max_tokens` degerini buna gore verin. Yalnizca metin kabul eder: gorsel, ses ve video girdisi desteklemez. Cikti icin ayri bir tavan yoktur, sinir baglam penceresinin kendisidir.
Teknik özellikler
| Canonical ID | qwen/qwen3.8-2.4t-a95b |
|---|---|
| Sağlayıcı | Qwen |
| Context penceresi | 262.144 tokens |
| Operasyonlar | CHAT_COMPLETIONS |
| Modaliteler | text |
Fiyatlandırma
Kredi yüklemede %8 platform marjı uygulanır; model kullanım fiyatları ayrıca yükseltilmez.
| Operation | Metric | Unit | Price |
|---|---|---|---|
| CHAT_COMPLETIONS | INPUT_TEXT | PER_1M_TOKENS | $2.00 |
| CHAT_COMPLETIONS | CACHE_READ | PER_1M_TOKENS | $0.200000 |
| CHAT_COMPLETIONS | OUTPUT_TEXT | PER_1M_TOKENS | $6.00 |
Örnek kullanım
Mevcut OpenAI SDK akışında yalnızca base URL ve model kimliğini değiştirirsiniz.
curl https://llmtr.com/v1/chat/completions \
-H "Authorization: Bearer llmtr-your_key" \
-H "Content-Type: application/json" \
-d '{"model":"qwen/qwen3.8-2.4t-a95b","messages":[{"role":"user","content":"Hello"}]}'
İlgili modeller
- Qwen3.8-Max qwen/qwen3.8-max
- Qwen3.7-Max qwen/qwen3.7-max
- Qwen3.7-Plus qwen/qwen3.7-plus
- Qwen3.6-Flash qwen/qwen3.6-flash
- Qwen-Plus qwen/qwen-plus
- Qwen-Plus-2025-01-25 qwen/qwen-plus-2025-01-25
- Qwen-Plus-2025-04-28 qwen/qwen-plus-2025-04-28
- Qwen-Plus-2025-07-14 qwen/qwen-plus-2025-07-14