InclusionAI / inclusionai/ling-3.0-tiny

Ling 3.0 Tiny - LLMTR üzerinden erişim

Ling 3.0 Tiny, InclusionAI'nin kucuk Mixture-of-Experts modelidir: 7,9 milyar toplam parametrenin token basina yalnizca 1,3 milyari calisir. Iki modu vardir. Varsayilan Thinking modunda yanit vermeden once adim adim dusunur ve dusunce zinciri `reasoning_content` alaninda ayri doner. Instant modunda ise dogrudan cevap verir; modeli `:fast` sonekiyle veya `"reasoning": false` gondererek bu moda alirsiniz. Arac/fonksiyon cagrisini yerel olarak destekler, tekrarlanan istemlerde prompt cache okumasi yapar ve 256K baglam penceresi sunar. Cikti tek seferde en fazla 32.768 token olabilir. Yalnizca metin kabul eder; gorsel, ses ve sema zorlamali JSON ciktisi desteklemez. Thinking modunda dusunme tokenlari da cikti sayilir ve `completion_tokens` icinde doner; kisa sorularda bile uzun dusunebildigi icin `max_tokens` degerini bol tutun ya da hiz gerektiginde Instant moda gecin.

Teknik özellikler

Canonical IDinclusionai/ling-3.0-tiny
SağlayıcıInclusionAI
Context penceresi262.144 tokens
OperasyonlarCHAT_COMPLETIONS
Modalitelertext

Fiyatlandırma

Kredi yüklemede %8 platform marjı uygulanır; model kullanım fiyatları ayrıca yükseltilmez.

OperationMetricUnitPrice
CHAT_COMPLETIONSINPUT_TEXTPER_1M_TOKENSYok
CHAT_COMPLETIONSCACHE_READPER_1M_TOKENSYok
CHAT_COMPLETIONSOUTPUT_TEXTPER_1M_TOKENSYok

Örnek kullanım

Mevcut OpenAI SDK akışında yalnızca base URL ve model kimliğini değiştirirsiniz.

curl https://llmtr.com/v1/chat/completions \
  -H "Authorization: Bearer llmtr-your_key" \
  -H "Content-Type: application/json" \
  -d '{"model":"inclusionai/ling-3.0-tiny","messages":[{"role":"user","content":"Hello"}]}'

İlgili modeller