InclusionAI / inclusionai/ling-3.1-flash

Ling 3.1 Flash - LLMTR üzerinden erişim

Ling 3.1 Flash, InclusionAI'nin hibrit akil yurutme modelidir: 560 milyar parametreli Mixture-of-Experts modelinde token basina yaklasik 25 milyar parametre calisir. 256K baglam sunar, tek yanitta en fazla 32.768 token uretir. Varsayilan olarak dusunur; kapatmak icin `reasoning_effort` alanini `none` gonderin ya da kimlige `:none` ekleyin - bu modelde etkisi olculmus tek seviye budur. Arac cagrisi her iki dusunme durumunda da calisir. Tekrarlanan onekler prompt cache'e girer; kart ucretsiz oldugu icin kazanc fiyatta degil gecikmededir. Yalnizca metin kabul eder; gorsel, ses ve sema zorlamali JSON ciktisi desteklemez. Ucretsiz sunum 13 Ekim 2026 saat 19:00'da (Turkiye saati) biter; ardindan istekler halefini adiyla bildiren bir hata doner - halef ucretli `inclusionai/ling-3.0-flash`.

Teknik özellikler

Canonical IDinclusionai/ling-3.1-flash
SağlayıcıInclusionAI
Context penceresi262.144 tokens
OperasyonlarCHAT_COMPLETIONS
Modalitelertext

Fiyatlandırma

Kredi yüklemede %8 platform marjı uygulanır; model kullanım fiyatları ayrıca yükseltilmez.

OperationMetricUnitPrice
CHAT_COMPLETIONSINPUT_TEXTPER_1M_TOKENSYok
CHAT_COMPLETIONSCACHE_READPER_1M_TOKENSYok
CHAT_COMPLETIONSOUTPUT_TEXTPER_1M_TOKENSYok

Örnek kullanım

Mevcut OpenAI SDK akışında yalnızca base URL ve model kimliğini değiştirirsiniz.

curl https://llmtr.com/v1/chat/completions   -H "Authorization: Bearer llmtr-your_key"   -H "Content-Type: application/json"   -d '{"model":"inclusionai/ling-3.1-flash","messages":[{"role":"user","content":"Hello"}]}'

İlgili modeller