Qwen / qwen/qwen3.8-2.4t-a95b

Qwen3.8 2.4T A95B - LLMTR üzerinden erişim

Qwen3.8 2.4T A95B, Qwen3.8 neslinin acik agirlikli surumudur: 2,4 trilyon parametrenin token basina 95 milyari calisan seyrek bir Mixture-of-Experts modelidir. Kod yazma, arastirma ve cok adimli bir isi sonuna kadar goturmesi gereken uzun soluklu ajan akislari icin tasarlanmistir. 262.144 tokenlik baglam penceresi, yerel arac cagrisi, JSON Schema ile sema zorlamali cikti ve tekrarlanan onekleri ucuzlatan prompt cache sunar. Adim adim dusunme her zaman aciktir ve yanittan ayri doner; bu yuzden kisa bir soru bile dusunme tokeni harcayabilir, `max_tokens` degerini buna gore verin. Yalnizca metin kabul eder: gorsel, ses ve video girdisi desteklemez. Cikti icin ayri bir tavan yoktur, sinir baglam penceresinin kendisidir.

Teknik özellikler

Canonical IDqwen/qwen3.8-2.4t-a95b
SağlayıcıQwen
Context penceresi262.144 tokens
OperasyonlarCHAT_COMPLETIONS
Modalitelertext

Fiyatlandırma

Kredi yüklemede %8 platform marjı uygulanır; model kullanım fiyatları ayrıca yükseltilmez.

OperationMetricUnitPrice
CHAT_COMPLETIONSINPUT_TEXTPER_1M_TOKENS$2.00
CHAT_COMPLETIONSCACHE_READPER_1M_TOKENS$0.200000
CHAT_COMPLETIONSOUTPUT_TEXTPER_1M_TOKENS$6.00

Örnek kullanım

Mevcut OpenAI SDK akışında yalnızca base URL ve model kimliğini değiştirirsiniz.

curl https://llmtr.com/v1/chat/completions \
  -H "Authorization: Bearer llmtr-your_key" \
  -H "Content-Type: application/json" \
  -d '{"model":"qwen/qwen3.8-2.4t-a95b","messages":[{"role":"user","content":"Hello"}]}'

İlgili modeller