LLMTR / llmtr/qwen3-6-35b

Qwen 3.6 35B-A3B - LLMTR üzerinden erişim

Türkiye'de barindirilan bu MoE model, Gemma 4'e gore daha agir kod ve mantik islerinde guclu bir alternatif sunar. Veri egemenligini korurken daha derin analiz isteyen ekipler icin uygundur. Uretim hizi saniyede yaklasik 8 tokendir ve model uzun yanitlar uretme egilimindedir: 1000 tokeni asan ciktilar iki dakikanin uzerine cikar. Bu modelde `stream: true` kullanmanizi, istemci okuma zaman asimini en az 300 saniyeye cikarmanizi ve gerekmeyen durumlarda `max_tokens` ile yanit uzunlugunu sinirlamanizi oneririz.

Teknik özellikler

Canonical IDllmtr/qwen3-6-35b
SağlayıcıLLMTR
Context penceresi262.144 tokens
OperasyonlarCHAT_COMPLETIONS
Modalitelertext

Fiyatlandırma

Kredi yüklemede %8 platform marjı uygulanır; model kullanım fiyatları ayrıca yükseltilmez.

OperationMetricUnitPrice
CHAT_COMPLETIONSINPUT_TEXTPER_1M_TOKENS$5.00
CHAT_COMPLETIONSOUTPUT_TEXTPER_1M_TOKENS$5.00

Örnek kullanım

Mevcut OpenAI SDK akışında yalnızca base URL ve model kimliğini değiştirirsiniz.

curl https://llmtr.com/v1/chat/completions   -H "Authorization: Bearer llmtr-your_key"   -H "Content-Type: application/json"   -d '{"model":"llmtr/qwen3-6-35b","messages":[{"role":"user","content":"Hello"}]}'

Bu model hakkında rehberler

İlgili modeller