InclusionAI / inclusionai/ling-3.0-flash
Ling 3.0 Flash - LLMTR üzerinden erişim
Ling 3.0 Flash, InclusionAI'nin 124 milyar parametreli Mixture-of-Experts modelidir; token basina yaklasik 5,1 milyar parametre calisir. Ajan is akislarinda token verimliligi hedefiyle egitilmistir: arac cagrisini yerel olarak destekler, tekrarlanan onekleri prompt cache'ten okur ve 256K baglam penceresi sunar. Varsayilan olarak dusunur; dusunce zinciri yanitta `reasoning_content` alaninda ayri doner ve tokenlari `completion_tokens` icinde sayilir. Dusunmeyi kapatmak icin `reasoning_effort` alanini `none` gonderin ya da model kimligine `:none` sonekini ekleyin - bu modelde etkisi olculmus tek seviye budur, diger seviyeler kabul edilse de dusunme uzunlugunu duzenli sekilde degistirmez ve bu yuzden sunulmaz. Cikti tek seferde en fazla 32.768 token olabilir. Yalnizca metin kabul eder; gorsel, ses ve sema zorlamali JSON ciktisi desteklemez. Dusunme acikken model bazi istemlerde uzun uzun dusunup butceyi tuketebilir; kisa ve kesin cevap gerektiginde `none` seviyesi hem hizli hem ucuzdur.
Teknik özellikler
| Canonical ID | inclusionai/ling-3.0-flash |
|---|---|
| Sağlayıcı | InclusionAI |
| Context penceresi | 262.144 tokens |
| Operasyonlar | CHAT_COMPLETIONS |
| Modaliteler | text |
Fiyatlandırma
Kredi yüklemede %8 platform marjı uygulanır; model kullanım fiyatları ayrıca yükseltilmez.
| Operation | Metric | Unit | Price |
|---|---|---|---|
| CHAT_COMPLETIONS | INPUT_TEXT | PER_1M_TOKENS | $0.060000 |
| CHAT_COMPLETIONS | CACHE_READ | PER_1M_TOKENS | $0.012000 |
| CHAT_COMPLETIONS | OUTPUT_TEXT | PER_1M_TOKENS | $0.180000 |
Örnek kullanım
Mevcut OpenAI SDK akışında yalnızca base URL ve model kimliğini değiştirirsiniz.
curl https://llmtr.com/v1/chat/completions -H "Authorization: Bearer llmtr-your_key" -H "Content-Type: application/json" -d '{"model":"inclusionai/ling-3.0-flash","messages":[{"role":"user","content":"Hello"}]}'
Bu model hakkında rehberler
- Ling 3.0 Tiny’yi yerelde çalıştırmanın maliyeti nasıl hesaplanır? - İndirilebilir ağırlıklar, sıfır işletim maliyeti anlamına gelmez. Kendi ölçümlerinizi kullanarak aylık toplamı ve kabul edilen görev başına maliyeti hesaplayın.
- Ling 3.0 Flash'ı yerelde çalıştırma: Ollama ve MLX durumu Tiny'den farklı - Ling Tiny Mac'te çalışır mı yazısı küçük modelin deneysel yerel yolunu ele alıyordu. Flash aynı aileden ama çok daha büyük bir model; bu yazı boyut farkının donanım denklemini nasıl değiştirdiğini ele alıyor.
- Ling 3.0 Flash'ta araç çağırma ve reasoning_effort mekaniği - Flash'a geçiş rehberi geçişin genel çerçevesini anlatır. Bu yazı, Flash'ın iki teknik davranışını, araç çağırma modlarını ve reasoning_effort mekaniğini derinlemesine ele alır.
- Ling 3.0 Flash'ı vLLM ile üretime almak: donanım ve batch ayarları - Ling Tiny vLLM yazısı model kimliğini ve tekli sunucu kurulumunu anlatır. Bu yazı, aynı yolu Flash için üretim ölçeğine taşırken devreye giren donanım paylaşımı ve batch ayarlarını ele alır.
- Ling 3.0 Flash Fin'de reasoning ve zorunlu araç çağırma ile finansal analiz - Ling 3.0 Flash Fin, çok adımlı yatırım araştırması için ayarlanmış bir modeldi; ücretsiz sunumu 30 Eylül 2026'da sona erdi ve satır emekli edildi. Bu yazı, düşünmeyi ne zaman açık ne zaman kapalı tutacağınızı ve aracı ne zaman zorunlu kılacağınızı anlatır; aynı akış halefi olan ücretli Ling 3.0 Flash'ta da çalışır.
- Ling 3.0 Flash'ta prompt cache ile tekrarlanan sistem talimatının maliyetini düşürme - Mevcut üç yazı bu modelin yerel deneme, tool-calling/reasoning_effort mekaniği ve vLLM ile üretim dağıtımını ele alıyordu; üçü de self-hosting eksenindeydi. Bu yazı, LLMTR API'si üzerinden çağrıldığında prompt cache'in maliyeti nasıl düşürdüğünü ele alır.
- Ling Tiny alternatifi: Flash Fin ve ücretli Flash karşılaştırması - Flash Fin, Ling Tiny sonrasında ücretsiz bir alternatifti; ücretsiz sunumu 30 Eylül 2026'da sona erdi ve satır emekli edildi. Ücretli Flash, hem Tiny hem Fin için emeklilik politikasındaki halef olarak kalıyor.
- Ling 3.0 Tiny: kapanan LLMTR API rotasından Flash'a geçiş - Ling 3.0 Tiny'yi arayanlar için: modelin ne olduğu, sağlayıcının rotayı neden kapattığı, LLMTR'nin isteği neden sessizce yönlendirmediği ve Ling 3.0 Flash'a geçerken kodda değişen iki şey.
İlgili modeller
- Ling 3.1 Flash inclusionai/ling-3.1-flash
- Gemma 4 llmtr/gemma-4
- Qwen 3.6 35B-A3B llmtr/qwen3-6-35b
- Trendyol Asure 12B llmtr/trendyol-asure-12b
- Magibu 11B v8 llmtr/magibu-11b-v8
- Muse Glimmer 30B (Türkiye) llmtr/muse-glimmer-30b-tr
- Leyla llmtr/leyla
- EmbeddingGemma 300M llmtr/embeddinggemma-300m