LLMTR / llmtr/qwen3-5-4b
Qwen 3.5 4B - LLMTR üzerinden erişim
LLMTR Qwen 3.5 4B, sunucuları Türkiye'de konumlanmış birinci taraf dil modelidir. OpenAI uyumlu Chat Completions şemasıyla çağrılır; istekleriniz üçüncü taraf bir sağlayıcıya yönlendirilmez. 128K bağlam penceresi sunar (istek başına prompt ve cevap birlikte). Küçük ve hızlı bir modeldir: Türkçe sohbet, özetleme, sınıflandırma, RAG chatbot ve araç çağırma (tool calling) gerektiren ajan akışları için uygundur. Yalnızca metin girdisi kabul eder; görsel, ses ve video gönderilirse istek 400 ile reddedilir. Aynı prompt önekini tekrar gönderdiğinizde prompt cache devreye girer ve cache'ten okunan tokenlar indirimli fiyatlanır; bu, uzun sistem promptu kullanan akışlarda maliyeti belirgin şekilde düşürür. Düşünme (thinking) modu varsayılan olarak açıktır: model yanıttan önce bir akıl yürütme üretir, bunu `reasoning_content` alanında size döndürür ve bu tokenlar `max_tokens` bütçenizden harcanır. Bu nedenle varsayılan modda `max_tokens` değerini en az 2048 verin; daha küçük bir bütçede akıl yürütme bütçeyi tüketir ve içerik boş dönebilir. Düşünmeyi kapatmak için `llmtr/qwen3-5-4b:fast` kullanın veya istek gövdesine `reasoning: false` ekleyin.
Teknik özellikler
| Canonical ID | llmtr/qwen3-5-4b |
|---|---|
| Sağlayıcı | LLMTR |
| Context penceresi | 131.072 tokens |
| Operasyonlar | CHAT_COMPLETIONS |
| Modaliteler | text |
Fiyatlandırma
Kredi yüklemede %8 platform marjı uygulanır; model kullanım fiyatları ayrıca yükseltilmez.
| Operation | Metric | Unit | Price |
|---|---|---|---|
| CHAT_COMPLETIONS | INPUT_TEXT | PER_1M_TOKENS | $1.00 |
| CHAT_COMPLETIONS | CACHE_READ | PER_1M_TOKENS | $0.250000 |
| CHAT_COMPLETIONS | OUTPUT_TEXT | PER_1M_TOKENS | $3.00 |
Örnek kullanım
Mevcut OpenAI SDK akışında yalnızca base URL ve model kimliğini değiştirirsiniz.
curl https://llmtr.com/v1/chat/completions \
-H "Authorization: Bearer llmtr-your_key" \
-H "Content-Type: application/json" \
-d '{"model":"llmtr/qwen3-5-4b","messages":[{"role":"user","content":"Hello"}]}'
İlgili modeller
- Gemma 4 llmtr/gemma-4
- Qwen 3.6 35B-A3B llmtr/qwen3-6-35b
- Trendyol Asure 12B llmtr/trendyol-asure-12b
- Magibu 11B v8 llmtr/magibu-11b-v8
- Muse Glimmer 30B (Türkiye) llmtr/muse-glimmer-30b-tr
- EmbeddingGemma 300M llmtr/embeddinggemma-300m
- Trendyol 7B llmtr/trendyol-7b
- GPT-5.6 Sol openai/gpt-5.6-sol