# LLMTR Full Model Catalog Generated for search and AI retrieval. Internal links are origin-relative and contain only public catalog data. Brand assets, colour tokens, and logo usage rules for this platform are published separately at /design.md. ## About LLMTR LLMTR is an OpenAI-compatible LLM gateway that serves Turkey-hosted and global models from one catalog, one API key, and one usage and billing surface. Every model below is reachable at /v1 by changing only the base URL and the model identifier. It fits organisations that need language models alongside data-control and auditability requirements: public institutions and local government, law firms and in-house legal teams, financial institutions, and other data-sensitive sectors such as health, defence supply chain, and critical infrastructure operators. Data-control properties: user prompts and model response bodies are not written to the usage and billing database; customer API keys are stored as SHA-256 hashes; provider keys are held only in environment variables; models marked as Turkey-hosted run on LLMTR infrastructure located in Turkey. Model unit prices below are catalog values and are not marked up; an 8% platform margin applies to credit top-ups only. ## Gemma 4 (llmtr/gemma-4) URL: /models/llmtr/gemma-4 Provider: LLMTR Context window: 32768 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 10 USD Summary: Türkiye'de barindirilan Gemma 4; veri egemenligi isteyen ekipler icin. Description: Türkiye'de barindirilan birinci taraf modeldir; istemleriniz ucuncu taraf rotaya cikmadan islenir. Kurum ici yardimci, chat ve veri egemenligi onemli urunlerde guclu bir yerli default sunar. ## Qwen 3.6 35B-A3B (llmtr/qwen3-6-35b) URL: /models/llmtr/qwen3-6-35b Provider: LLMTR Context window: 16384 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 10 USD Summary: Türkiye'de barindirilan kod ve mantik agirlikli isler icin yerli Qwen modeli. Description: Türkiye'de barindirilan bu MoE model, Gemma 4'e gore daha agir kod ve mantik islerinde guclu bir alternatif sunar. Veri egemenligini korurken daha derin analiz isteyen ekipler icin uygundur. ## MedGemma 4B (llmtr/medgemma-4b) URL: /models/llmtr/medgemma-4b Provider: LLMTR Context window: 8192 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 3 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 5 USD Summary: Türkiye'de barindirilan tibbi metin ve tek gorsel yorumlari icin MedGemma modeli. Description: Türkiye'de barindirilan MedGemma 4B, tibbi metin ve base64 data URL olarak verilen tek gorsel anlama isleri icin konumlanan bir LLMTR modelidir; uzak gorsel URL'leri desteklenmez. MedGemma'nin multimodal varyantlari, gogus rontgeni, dermatoloji, oftalmoloji ve histopatoloji gibi kimlikten arindirilmis tibbi gorsellerle on egitilmis SigLIP gorsel kodlayici kullanir; dil bileseni tibbi metinler, soru-cevap verileri ve tibbi gorsel/veri kaynaklariyla egitilmistir. Ciktilar klinik tani, tedavi veya hasta yonetimi kararlarinda tek basina kullanilmamalidir. ## Trendyol 7B (llmtr/trendyol-7b) URL: /models/llmtr/trendyol-7b Provider: LLMTR Context window: 32768 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.5 USD Summary: Sohbet ve RAG chatbot isleri icin Turkiye'deki Trendyol tarafindan uretilen 7B model. Description: Trendyol 7B, Trendyol tarafindan uretilen Qwen2.5 7B tabanli chat modelidir. 32K baglam penceresine sahiptir. Turkce sohbet, RAG chatbot, musteri destek yardimcilari, e-ticaret bilgi akislari, ozetleme, urun aciklamasi ve kategori/etiket metin isleri icin uygundur. Gorsel, ses, video girdisi ve gorsel uretimi desteklenmez. Model karti: https://huggingface.co/Trendyol/Trendyol-LLM-7B-chat-v4.1.0 ## Magibu 11B v8 (llmtr/magibu-11b-v8) URL: /models/llmtr/magibu-11b-v8 Provider: LLMTR Context window: 8192 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.5 USD Summary: Turkce sohbet ve yardimci akislar icin Magibu ekibi tarafindan gelistirilmis 11B LLMTR modeli. Description: Magibu 11B v8, Magibu ekibi tarafindan gelistirilmis Turkce'ye ozel bir LLMTR modelidir. OpenAI uyumlu Chat Completions semasiyla sohbet, ozetleme, taslak uretimi, siniflandirma ve genel yardimci akislarinda kullanilir. Bu endpoint text-only calisir; gorsel, ses ve video girdisi desteklenmez. Model detaylari: https://huggingface.co/magibu/magibu-11b-v0.8 ## Sincap (llmtr/sincap) URL: /models/llmtr/sincap Provider: LLMTR Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0 USD Summary: Ücretsiz denemeler için deneysel model. LLMTR modeli değildir, Türkiye'de barındırılmamaktadır. Description: Farklı yazım tarzlarını ve hafif yardımcı akışları denemek isteyen ekipler için sunulan ücretsiz bir modeldir. Üretim kritik işlerden çok keşif, prototip ve deneme senaryolarında anlamlıdır. LLMTR modeli değildir; Türkiye'de barındırılmamaktadır. ## EmbeddingGemma 300M (llmtr/embeddinggemma-300m) URL: /models/llmtr/embeddinggemma-300m Provider: LLMTR Context window: 2048 Operations: EMBEDDINGS Modalities: text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD Summary: Semantik arama ve RAG icin Turkiye'de barindirilan embedding modeli. Description: EmbeddingGemma 300M, Turkiye'de barindirilan bir embedding modelidir ve metni 768 boyutlu sayisal vektore cevirir. Semantik arama, RAG, benzerlik karsilastirma, siniflandirma ve kumeleme islerinde kullanilir. Batch input desteklenir; vektor boyutu MRL ile 512/256/128'e kirpilabilir. Metin basina en fazla 2048 token kabul eder ve Turkce dahil 100'den fazla dili destekler. ## Qwen 3.5 4B (llmtr/qwen3-5-4b) URL: /models/llmtr/qwen3-5-4b Provider: LLMTR Context window: 65536 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.25 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 3 USD Summary: Türkiye'de barındırılan, araç çağırma ve prompt cache destekli 4B sohbet modeli. Description: LLMTR Qwen 3.5 4B, sunucuları Türkiye'de konumlanmış birinci taraf dil modelidir. OpenAI uyumlu Chat Completions şemasıyla çağrılır; istekleriniz üçüncü taraf bir sağlayıcıya yönlendirilmez. 64K bağlam penceresi sunar (istek başına prompt ve cevap birlikte). Küçük ve hızlı bir modeldir: Türkçe sohbet, özetleme, sınıflandırma, RAG chatbot ve araç çağırma (tool calling) gerektiren ajan akışları için uygundur. Aynı prompt önekini tekrar gönderdiğinizde prompt cache devreye girer ve cache'ten okunan tokenlar indirimli fiyatlanır; bu, uzun sistem promptu kullanan akışlarda maliyeti belirgin şekilde düşürür. Düşünme (thinking) modu opsiyoneldir ve varsayılan olarak kapalıdır; `llmtr/qwen3-5-4b:think` ile açabilirsiniz. Düşünme açıkken model yanıttan önce uzun bir akıl yürütme üretir ve bu, `max_tokens` bütçenizden harcanır; bu nedenle `max_tokens` değerini en az 2048 verin, aksi halde bütçe akıl yürütmede tükenir ve içerik boş dönebilir. Görsel, ses ve video girdisi desteklenmez. ## Ornith 1.0 35B (llmtr/ornith-1-35b) URL: /models/llmtr/ornith-1-35b Provider: LLMTR Context window: 32768 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 5 USD Summary: Türkiye'de barındırılan, araç çağırma ve prompt cache destekli agentic kodlama modeli. Description: LLMTR Ornith 1.0 35B, Türkiye'de barındırılan birinci taraf kodlama modelidir. Tek seferlik kod üretmekten çok, gerçek depolar içinde çok adımlı görevleri sürdürmek üzere eğitilmiştir: kod tabanında gezinme, dosya düzenleme, test çalıştırma ve araç zinciri kurma. OpenAI uyumlu Chat Completions arabirimiyle çağrılır, 32K bağlam penceresi sunar, araç çağırma (tool calling) ve prompt cache okumayı destekler. Model yanıt vermeden önce her zaman adım adım düşünür ve bu düşünme adımları `message.reasoning_content` alanında ayrıca döner; bu davranış kapatılamaz, dolayısıyla `max_tokens` değerini en az 1500 verin, aksi halde bütçe düşünme aşamasında tükenir ve içerik boş döner. Yanıt üretimi hafif sohbet modellerine kıyasla belirgin şekilde uzun sürer; `stream: true` kullanmanız önerilir. İstekler Türkiye'deki sunucularımızda işlenir ve üçüncü taraf bir sağlayıcıya yönlendirilmez. ## GPT-5.6 Sol (openai/gpt-5.6-sol) URL: /models/openai/gpt-5.6-sol Provider: OpenAI Context window: 1050000 Operations: RESPONSES Modalities: text, image Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 5 USD; RESPONSES/CACHE_READ/PER_1M_TOKENS: 0.5 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 30 USD Summary: GPT-5.6 Sol: zor reasoning, kod ve ajan akışları için OpenAI GPT-5.6 preview modeli. Description: GPT-5.6 Sol, OpenAI GPT-5.6 ailesinde zor profesyonel analiz, agentic kodlama, araç kullanan çok adımlı akışlar ve uzun bağlamlı işler için uygundur. 1.05M bağlam, 128K maksimum çıktı, metin/görsel girdi, prompt cache ve gerçek max reasoning effort desteği sunar. ## GPT-5.6 Sol Pro (openai/gpt-5.6-sol-pro) URL: /models/openai/gpt-5.6-sol-pro Provider: OpenAI Context window: 1050000 Operations: RESPONSES Modalities: text, image Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 5 USD; RESPONSES/CACHE_READ/PER_1M_TOKENS: 0.5 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 30 USD Summary: GPT-5.6 Sol Pro: pro modda zor reasoning, kod ve ajan akışları için OpenAI GPT-5.6 preview modeli. Description: GPT-5.6 Sol Pro, OpenAI GPT-5.6 ailesinde Sol kalitesini Responses API reasoning.mode=pro ile kullanan kalite öncelikli işler için uygundur. 1.05M bağlam, 128K maksimum çıktı, metin/görsel girdi, prompt cache ve gerçek max reasoning effort desteği sunar. Bu LLMTR wrapper modeli ayrı bir OpenAI native slug'ı değildir; upstream base GPT-5.6 modeline gider ve pro mode varsayılanını body'de açar. ## GPT-5.6 Terra (openai/gpt-5.6-terra) URL: /models/openai/gpt-5.6-terra Provider: OpenAI Context window: 1050000 Operations: RESPONSES Modalities: text, image Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 2.5 USD; RESPONSES/CACHE_READ/PER_1M_TOKENS: 0.25 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 15 USD Summary: GPT-5.6 Terra: zeka ve maliyet dengesi isteyen üretim işleri için OpenAI GPT-5.6 preview modeli. Description: GPT-5.6 Terra, OpenAI GPT-5.6 ailesinde güçlü performans isterken Sol maliyetine çıkmaması gereken kod, ajan, analiz ve yüksek hacimli yardımcı akışları için uygundur. 1.05M bağlam, 128K maksimum çıktı, metin/görsel girdi, prompt cache ve gerçek max reasoning effort desteği sunar. ## GPT-5.6 Terra Pro (openai/gpt-5.6-terra-pro) URL: /models/openai/gpt-5.6-terra-pro Provider: OpenAI Context window: 1050000 Operations: RESPONSES Modalities: text, image Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 2.5 USD; RESPONSES/CACHE_READ/PER_1M_TOKENS: 0.25 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 15 USD Summary: GPT-5.6 Terra Pro: pro modda zeka-maliyet dengesi isteyen işler için OpenAI GPT-5.6 preview modeli. Description: GPT-5.6 Terra Pro, OpenAI GPT-5.6 ailesinde Terra fiyat dengesini Responses API reasoning.mode=pro ile kullanan kalite öncelikli işler için uygundur. 1.05M bağlam, 128K maksimum çıktı, metin/görsel girdi, prompt cache ve gerçek max reasoning effort desteği sunar. Bu LLMTR wrapper modeli ayrı bir OpenAI native slug'ı değildir; upstream base GPT-5.6 modeline gider ve pro mode varsayılanını body'de açar. ## GPT-5.6 Luna (openai/gpt-5.6-luna) URL: /models/openai/gpt-5.6-luna Provider: OpenAI Context window: 1050000 Operations: RESPONSES Modalities: text, image Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 1 USD; RESPONSES/CACHE_READ/PER_1M_TOKENS: 0.1 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 6 USD Summary: GPT-5.6 Luna: maliyet hassas ve yüksek hacimli işler için OpenAI GPT-5.6 preview modeli. Description: GPT-5.6 Luna, OpenAI GPT-5.6 ailesinde yüksek hacimli yardımcılar, sınıflandırma, özetleme, routing ve maliyet kontrollü üretim akışları için uygundur. 1.05M bağlam, 128K maksimum çıktı, metin/görsel girdi, prompt cache ve gerçek max reasoning effort desteği sunar. ## GPT-5.6 Luna Pro (openai/gpt-5.6-luna-pro) URL: /models/openai/gpt-5.6-luna-pro Provider: OpenAI Context window: 1050000 Operations: RESPONSES Modalities: text, image Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 1 USD; RESPONSES/CACHE_READ/PER_1M_TOKENS: 0.1 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 6 USD Summary: GPT-5.6 Luna Pro: pro modda maliyet hassas yüksek hacimli işler için OpenAI GPT-5.6 preview modeli. Description: GPT-5.6 Luna Pro, OpenAI GPT-5.6 ailesinde Luna maliyet avantajını Responses API reasoning.mode=pro ile kullanan seçici kalite artışı işleri için uygundur. 1.05M bağlam, 128K maksimum çıktı, metin/görsel girdi, prompt cache ve gerçek max reasoning effort desteği sunar. Bu LLMTR wrapper modeli ayrı bir OpenAI native slug'ı değildir; upstream base GPT-5.6 modeline gider ve pro mode varsayılanını body'de açar. ## GPT-5.5 (openai/gpt-5.5) URL: /models/openai/gpt-5.5 Provider: OpenAI Context window: 1050000 Operations: RESPONSES Modalities: text, image Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 5 USD; RESPONSES/CACHE_READ/PER_1M_TOKENS: 0.5 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 30 USD Summary: Kod, derin analiz ve ajan orkestrasyonu için OpenAI'nin en güçlü frontier modeli. Description: Kod, arac yogun ajan akislar, uzun baglamli analiz ve kalite odakli profesyonel isler icin en guclu OpenAI secenegidir. 1.05M baglam, 128K maksimum cikti ve none'dan xhigh'a uzanan reasoning eforlariyla zor uretim islerinde kullanilir. ## GPT-5.5 Pro (openai/gpt-5.5-pro) URL: /models/openai/gpt-5.5-pro Provider: OpenAI Context window: 1050000 Operations: RESPONSES Modalities: text, image Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 30 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 180 USD Summary: En zor reasoning, kod ve uzun bağlamlı analiz için GPT-5.5 Pro. Description: GPT-5.5 Pro, OpenAI tarafındaki en yüksek derinlikli GPT-5.5 varyantıdır. Zor profesyonel reasoning, kod, uzun bağlamlı analiz ve kalite öncelikli ajan işlerinde kullanılır. 1.05M bağlam, 128K maksimum çıktı ve Responses API üzerinden metin/görsel girdi desteği sunar; cached input indirimi bulunmadığı için maliyet planlamasında standart input fiyatını esas alın. ## GPT-5.4 (openai/gpt-5.4) URL: /models/openai/gpt-5.4 Provider: OpenAI Context window: 272000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2.5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 15 USD Summary: Zor muhakeme ve üretim ajanları için OpenAI'nin en güçlü genel modeli. Description: Karmasik reasoning, agent akislar ve kod agirlikli profesyonel isler icin OpenAI'nin en guclu secenegidir. Kalite, arac kullanimi ve uzun cok adimli execution oncelikliyse burada baslayin. ## GPT-5.4 mini (openai/gpt-5.4-mini) URL: /models/openai/gpt-5.4-mini Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.75 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 4.5 USD Summary: Kod yardımcıları ve alt ajan akışları için en dengeli GPT-5.4 mini modeli. Description: Kod, bilgisayar kullanimi ve alt ajan akislarinda ciddi guc sunarken gecikme ve maliyeti daha kontrollu tutar. Uretimde kaliteli ama daha hizli bir default ariyorsaniz iyi secimdir. ## GPT-5.2 (openai/gpt-5.2) URL: /models/openai/gpt-5.2 Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.75 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 14 USD Summary: Kod üretimi ve çok adımlı ajan işleri için üst seviye GPT-5 modeli. Description: Genel zeka, arac kullanimi ve kod kalitesinde GPT-5 ailesinin daha guclu seceneklerinden biridir. Zor cok adimli gorevler, urun kalitesinde cikti ve yuksek dogruluk isteyen ekipler icin uygundur. ## GPT-4.1 (openai/gpt-4.1) URL: /models/openai/gpt-4.1 Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 8 USD Summary: Talimat takibi ve araç çağrıları için güçlü GPT-4.1 modeli. Description: Talimat takibi, arac cagirma ve deterministik urun akislarinda cok guclu bir secenektir. Daha az dusunme overhead'i ile hizli ve duzenli cevap istendiginde iyi default olur. ## GPT-4o (openai/gpt-4o) URL: /models/openai/gpt-4o Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2.5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 10 USD Summary: Sohbet, içerik üretimi ve görsel anlama için esnek multimodal OpenAI modeli. Description: Sohbet, icerik uretimi, gorsel farkindalik ve genel urun entegrasyonlari icin oldukca esnek bir secenektir. Tek modelle cok farkli kullanimi kapsamak isteyen ekipler icin guclu default olur. ## o4-mini (openai/o4-mini) URL: /models/openai/o4-mini Provider: OpenAI Context window: 200000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 4.4 USD Summary: Kod, matematik ve görsel akıl yürütme için hızlı kompakt reasoning modeli. Description: Kod, matematik ve gorsel akil yurutme gerektiren islerde kucuk boyuta gore etkileyici performans verir. Daha pahali reasoning modellerine cikmadan once guclu bir ara secenektir. ## o3 (openai/o3) URL: /models/openai/o3 Provider: OpenAI Context window: 200000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 8 USD Summary: Zor teknik analiz ve çok adımlı problem çözümü için güçlü reasoning modeli. Description: Matematik, bilim, teknik yazim ve kod analizi gibi alanlarda cok adimli dusunme isteyen gorevler icin uygundur. Derin analiz ve saglam muhakeme gereken durumlarda guclu secimdir. ## GPT-5.3-Codex (openai/gpt-5.3-codex) URL: /models/openai/gpt-5.3-codex Provider: OpenAI Context window: 400000 Operations: RESPONSES Modalities: text, image Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 1.75 USD; RESPONSES/CACHE_READ/PER_1M_TOKENS: 0.175 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 14 USD Summary: Depo ölçekli kod düzenlemeleri ve zor mühendislik işleri için Codex modeli. Description: Depo capinda anlayis, uzun duzenleme zincirleri ve agentic kodlama akislarinda ust seviye performansa oynar. Kod urunu gelistiren ekipler icin en iddiali Codex seceneklerinden biridir. ## GPT Image 2 (openai/gpt-image-2) URL: /models/openai/gpt-image-2 Provider: OpenAI Context window: 32000 Operations: IMAGES_GENERATIONS Modalities: text, image Pricing: IMAGES_GENERATIONS/INPUT_TEXT/PER_1M_TOKENS: 5 USD; IMAGES_GENERATIONS/INPUT_IMAGE/PER_1M_TOKENS: 8 USD; IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_1M_TOKENS: 30 USD Summary: Üretim kalitesinde görsel üretim için OpenAI görüntü modeli. Description: Metinden ürün görseli, kampanya kreatifi ve uygulama içi illüstrasyon üretmek isteyen ekipler için uygundur. Boyut, kalite ve çıktı formatı üzerinde kontrol gereken text-to-image akışlarında güçlüdür. ## Gemini Deep Research Preview (google/deep-research-pro-preview-12-2025) URL: /models/google/deep-research-pro-preview-12-2025 Provider: Google Context window: 1048576 Operations: AGENT_RESEARCH Modalities: text Pricing: AGENT_RESEARCH/INPUT_TEXT/PER_1M_TOKENS: 2 USD; AGENT_RESEARCH/OUTPUT_TEXT/PER_1M_TOKENS: 12 USD; AGENT_RESEARCH/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 4.5 USD Summary: Kaynaklı rapor üretimi için otonom Gemini araştırma modeli. Description: Çok adımlı araştırma planlayıp web kaynaklarını tarayarak alıntılı raporlar üretmek için tasarlanmıştır. Kısa sohbetten çok briefing, pazar taraması ve araştırma notu hazırlayan ekiplerde öne çıkar. ## Gemini 2.5 Flash (google/gemini-2.5-flash) URL: /models/google/gemini-2.5-flash Provider: Google Context window: 1048576 Operations: CHAT_COMPLETIONS, RESPONSES Modalities: text, image, video, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.3 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.5 USD; CHAT_COMPLETIONS/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 1 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.03 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.03 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.03 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/INPUT_AUDIO/PER_1M_TOKENS: 1 USD Summary: Günlük multimodal yardımcılar ve araçlı ürün akışları için dengeli Gemini modeli. Description: Düşük gecikme, yüksek hacim ve araç kullanımı isteyen ürün akışlarında çok yönlü davranır. Hem düşünme gerektiren görevlerde hem de günlük multimodal yardımcı senaryolarında güvenli başlangıç noktasıdır. ## Gemini 2.5 Flash Image (google/gemini-2.5-flash-image) URL: /models/google/gemini-2.5-flash-image Provider: Google Context window: 0 Operations: IMAGES_GENERATIONS Modalities: text, image Pricing: IMAGES_GENERATIONS/INPUT_TEXT/PER_1M_TOKENS: 0.3 USD; IMAGES_GENERATIONS/INPUT_IMAGE/PER_1M_TOKENS: 0.3 USD; IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.039 USD Summary: Hızlı görsel üretim ve düzenleme için Gemini görüntü modeli. Description: Metinden görsel üretimi ile konuşmalı düzenlemeyi tek akışta birleştirmek isteyen ekipler için uygundur. Hızlı iterasyon, ürün görseli ve yaratıcı yardımcı senaryolarında güçlüdür. ## Gemini 2.5 Flash-Lite (google/gemini-2.5-flash-lite) URL: /models/google/gemini-2.5-flash-lite Provider: Google Context window: 1048576 Operations: CHAT_COMPLETIONS, RESPONSES Modalities: text, image, video, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.4 USD; CHAT_COMPLETIONS/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 1 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.01 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.01 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.01 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.03 USD Summary: Yüksek hacimli işler için en ekonomik Gemini 2.5 seçeneği. Description: Basit ajan akışları, veri çıkarma ve yoğun API trafiğinde maliyeti düşük tutmak için konumlanır. Derin muhakeme yerine hız, throughput ve fiyat verimliliği önceliklidir. ## Gemini 2.5 Flash Native Audio (Live API) (google/gemini-2.5-flash-native-audio-preview-12-2025) URL: /models/google/gemini-2.5-flash-native-audio-preview-12-2025 Provider: Google Context window: 128000 Operations: REALTIME_SESSION Modalities: text, audio, video Pricing: REALTIME_SESSION/INPUT_TEXT/PER_1M_TOKENS: 0.5 USD; REALTIME_SESSION/OUTPUT_TEXT/PER_1M_TOKENS: 2 USD; REALTIME_SESSION/INPUT_AUDIO/PER_1M_TOKENS: 3 USD; REALTIME_SESSION/INPUT_VIDEO/PER_1M_TOKENS: 3 USD; REALTIME_SESSION/OUTPUT_AUDIO/PER_1M_TOKENS: 12 USD Summary: Gerçek zamanlı sesli diyalog için Gemini Live ses modeli. Description: Doğal konuşma akışı, ses tonu ve düşük gecikmeli sesli etkileşim isteyen uygulamalar için tasarlanmıştır. Realtime sesli asistan, voice UX ve çağrı benzeri deneylerde öne çıkar. ## Gemini 2.5 Flash Preview TTS (google/gemini-2.5-flash-preview-tts) URL: /models/google/gemini-2.5-flash-preview-tts Provider: Google Context window: 0 Operations: AUDIO_SPEECH Modalities: text, audio Pricing: AUDIO_SPEECH/INPUT_TEXT/PER_1M_TOKENS: 0.5 USD; AUDIO_SPEECH/OUTPUT_AUDIO/PER_1M_TOKENS: 10 USD Summary: Hızlı ve yönlendirilebilir konuşma üretimi için Gemini TTS modeli. Description: Metinden sese dönüşümde düşük gecikme ve maliyet verimliliği arayan ekipler için uygundur. Uygulama içi seslendirme, okuma ve yardımcı ses akışlarında pratik bir seçenektir. ## Gemini 2.5 Pro (google/gemini-2.5-pro) URL: /models/google/gemini-2.5-pro Provider: Google Context window: 1048576 Operations: CHAT_COMPLETIONS, RESPONSES Modalities: text, image, audio, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.25 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 10 USD; CHAT_COMPLETIONS/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 4.5 USD; CHAT_COMPLETIONS/TOOL_CALL/PER_1K_CALLS: 25 USD; CHAT_COMPLETIONS/TOOL_CALL/PER_1K_CALLS: 35 USD; RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 1.25 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 10 USD; RESPONSES/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 4.5 USD Summary: Kod, bilim ve zor muhakeme için en güçlü Gemini düşünme modeli. Description: Uzun bağlam, büyük belge analizi ve daha zor problem çözme işlerinde Google tarafındaki üst seviye seçenektir. Kalite, doğruluk ve derin reasoning isteyen ekipler için burada başlamak mantıklıdır. ## Gemini 2.5 Pro Preview TTS (google/gemini-2.5-pro-preview-tts) URL: /models/google/gemini-2.5-pro-preview-tts Provider: Google Context window: 0 Operations: AUDIO_SPEECH Modalities: text, audio Pricing: AUDIO_SPEECH/INPUT_TEXT/PER_1M_TOKENS: 1 USD; AUDIO_SPEECH/OUTPUT_AUDIO/PER_1M_TOKENS: 20 USD Summary: Daha doğal ve güçlü ses çıkışı için Gemini Pro TTS modeli. Description: Daha ifade zenginliği ve yönlendirilebilirlik isteyen text-to-speech senaryolarında öne çıkar. Premium ses deneyimi gerektiren uygulamalar için Flash TTS'e göre daha güçlü bir seçenektir. ## Gemini 3 Flash Preview (google/gemini-3-flash-preview) URL: /models/google/gemini-3-flash-preview Provider: Google Context window: 1048576 Operations: CHAT_COMPLETIONS, RESPONSES Modalities: text, image, video, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 3 USD; CHAT_COMPLETIONS/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 1 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.05 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.05 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.05 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/INPUT_AUDIO/PER_1M_TOKENS: 1 USD Summary: Hızlı multimodal yardımcılar ve ajan deneyleri için Gemini 3 preview modeli. Description: Görsel anlama, araç kullanımı ve hızlı üretim akışlarını tek modelde toplamak isteyen ekipler için uygundur. Kararlı sürüm öncesinde yeni Gemini davranışını erken değerlendirmek için iyi bir preview seçeneğidir. ## Gemini 3.1 Flash-Lite (google/gemini-3.1-flash-lite) URL: /models/google/gemini-3.1-flash-lite Provider: Google Context window: 1048576 Operations: CHAT_COMPLETIONS, RESPONSES Modalities: text, image, video, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.25 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.5 USD; CHAT_COMPLETIONS/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 1 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.025 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.025 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.025 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.05 USD; CHAT_COMPLETIONS/INPUT_AUDIO/PER_1M_TOKENS: 0.5 USD Summary: Yuksek hacimli hafif multimodal isler icin GA Gemini 3.1 secenegi. Description: Basit veri cikarma, hizli ajan gorevleri, ceviri ve cok sik cagrilan multimodal akislar icin dusuk gecikme ve maliyet verimliligi saglar. Preview yerine kararlı GA model kimligiyle kullanilmalidir. ## Gemini 3.1 Pro Preview (google/gemini-3.1-pro-preview) URL: /models/google/gemini-3.1-pro-preview Provider: Google Context window: 1048576 Operations: CHAT_COMPLETIONS, RESPONSES Modalities: text, image, audio, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 12 USD; CHAT_COMPLETIONS/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 4.5 USD; CHAT_COMPLETIONS/TOOL_CALL/PER_1K_CALLS: 14 USD; CHAT_COMPLETIONS/TOOL_CALL/PER_1K_CALLS: 14 USD; RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 2 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 12 USD; RESPONSES/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 4.5 USD Summary: Yazılım, araştırma ve grounded reasoning için üst seviye Gemini 3.1 preview modeli. Description: Daha güvenilir düşünme, daha iyi token verimliliği ve karmaşık görevlerde daha tutarlı çıktı isteyen ekipler için konumlanır. Kod tabanları, araştırma akışları ve yoğun araç kullanımı gerektiren ürünlerde güçlüdür. ## Gemini 3.1 Pro Preview (google/gemini-3.1-pro-preview-customtools) URL: /models/google/gemini-3.1-pro-preview-customtools Provider: Google Context window: 1048576 Operations: CHAT_COMPLETIONS, RESPONSES Modalities: text, image, audio, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 12 USD; CHAT_COMPLETIONS/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 4.5 USD; CHAT_COMPLETIONS/TOOL_CALL/PER_1K_CALLS: 14 USD; CHAT_COMPLETIONS/TOOL_CALL/PER_1K_CALLS: 14 USD; RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 2 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 12 USD; RESPONSES/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 4.5 USD Summary: Yazılım, araştırma ve grounded reasoning için üst seviye Gemini 3.1 preview modeli. Description: Daha güvenilir düşünme, daha iyi token verimliliği ve karmaşık görevlerde daha tutarlı çıktı isteyen ekipler için konumlanır. Kod tabanları, araştırma akışları ve yoğun araç kullanımı gerektiren ürünlerde güçlüdür. ## Gemini 3.5 Flash (google/gemini-3.5-flash) URL: /models/google/gemini-3.5-flash Provider: Google Context window: 1048576 Operations: CHAT_COMPLETIONS, RESPONSES Modalities: image, video, audio, text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 9 USD; CHAT_COMPLETIONS/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 1 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.15 USD; CHAT_COMPLETIONS/INPUT_AUDIO/PER_1M_TOKENS: 1.5 USD; CHAT_COMPLETIONS/INPUT_IMAGE/PER_1M_TOKENS: 1.5 USD; CHAT_COMPLETIONS/INPUT_VIDEO/PER_1M_TOKENS: 1.5 USD; CHAT_COMPLETIONS/TOOL_CALL/PER_1K_CALLS: 14 USD Summary: Ajan, kod ve multimodal ürün akışları için kararlı Gemini Flash modeli. Description: 1M context ve 65K output tavanıyla araç kullanımı, PDF ve medya girdileriyle çalışan üretim uygulamaları için konumlanır. Gemini 3 Flash Preview'dan kararlı kimliğe geçmek isteyen ekiplerde hız, kalite ve maliyet dengesini koruyan ana Flash seçeneğidir. ## Gemini 3.5 Flash-Lite (google/gemini-3.5-flash-lite) URL: /models/google/gemini-3.5-flash-lite Provider: Google Context window: 1048576 Operations: CHAT_COMPLETIONS, RESPONSES Modalities: image, video, audio, text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.3 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.5 USD; CHAT_COMPLETIONS/INPUT_AUDIO/PER_1M_TOKENS: 0.3 USD; CHAT_COMPLETIONS/INPUT_IMAGE/PER_1M_TOKENS: 0.3 USD; CHAT_COMPLETIONS/INPUT_VIDEO/PER_1M_TOKENS: 0.3 USD; CHAT_COMPLETIONS/TOOL_CALL/PER_1K_CALLS: 14 USD; CHAT_COMPLETIONS/TOOL_CALL/PER_1K_CALLS: 14 USD; RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 0.3 USD Summary: Yüksek hacimli ajan ve belge işleme için en uygun maliyetli Gemini modeli. Description: Gecikme ve maliyetin birinci kısıt olduğu işler için konumlanır: toplu belge ayrıştırma, veri çıkarımı, çeviri, sınıflandırma ve alt-ajan görevleri. 1M context, 65K output, görsel/video/ses/PDF girdisi ve araç çağrısı desteğini Flash sınıfının çok altında bir token fiyatıyla sunar; düşünme seviyesi minimal'e çekilerek daha da hızlandırılabilir. ## Gemini 3.6 Flash (google/gemini-3.6-flash) URL: /models/google/gemini-3.6-flash Provider: Google Context window: 1048576 Operations: CHAT_COMPLETIONS, RESPONSES Modalities: image, video, audio, text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 7.5 USD; CHAT_COMPLETIONS/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 1 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.15 USD; CHAT_COMPLETIONS/INPUT_AUDIO/PER_1M_TOKENS: 1.5 USD; CHAT_COMPLETIONS/INPUT_IMAGE/PER_1M_TOKENS: 1.5 USD; CHAT_COMPLETIONS/INPUT_VIDEO/PER_1M_TOKENS: 1.5 USD; CHAT_COMPLETIONS/TOOL_CALL/PER_1K_CALLS: 14 USD Summary: Ajan ve kod akışlarında daha az token harcayan kararlı Gemini Flash modeli. Description: 1M context ve 65K output tavanıyla araç kullanan üretim uygulamaları, kod döngüleri ve belge/medya analizi için konumlanır. Aynı çok adımlı işi Gemini 3.5 Flash'a göre daha az çıktı tokenı ve daha az araç çağrısıyla bitirdiği için ajan başına maliyeti düşürür; çıktı fiyatı da 3.5 Flash'ın altındadır. ## Gemini Embedding (google/gemini-embedding-001) URL: /models/google/gemini-embedding-001 Provider: Google Context window: 2048 Operations: EMBEDDINGS Modalities: text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.15 USD Summary: Metin tabanlı arama ve RAG için temel Gemini embedding modeli. Description: Semantik arama, öneri ve klasik metin retrieval senaryolarında güvenli bir başlangıç sağlar. Görsel yerine yazı odaklı embedding ihtiyacında pratik bir varsayılandır. ## Gemini Embedding 2 Preview (google/gemini-embedding-2-preview) URL: /models/google/gemini-embedding-2-preview Provider: Google Context window: 8192 Operations: EMBEDDINGS Modalities: image, audio, video, text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.2 USD; EMBEDDINGS/OUTPUT_TEXT/PER_1M_TOKENS: 12 USD; EMBEDDINGS/INPUT_AUDIO/PER_SECOND: 0.00016 USD; EMBEDDINGS/INPUT_IMAGE/PER_IMAGE: 0.00012 USD; EMBEDDINGS/INPUT_VIDEO/PER_1M_TOKENS: 12 USD Summary: Metin, görsel ve belge araması için multimodal Gemini embedding modeli. Description: Çok modlu arama, belge eşleme ve farklı veri türlerini birlikte retrieve etmek isteyen sistemler için uygundur. Görsel, PDF ve ses benzeri içerikleri aynı retrieval katmanında toplamak isteyen ekiplerde öne çıkar. ## Imagen 4 (google/imagen-4.0-fast-generate-001) URL: /models/google/imagen-4.0-fast-generate-001 Provider: Google Context window: 0 Operations: IMAGES_GENERATIONS Modalities: image, text Pricing: IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.02 USD Summary: Hızlı iterasyon için optimize edilmiş Imagen 4 sürümü; 17 Ağustos 2026'da kapanır. Description: Metinden görsel üretiminde hız öncelikli yaratıcı akışlar için uygundur. Google'ın müşteri bildirimine göre bu model kimliği 17 Ağustos 2026'da kullanımdan kaldırılır; bu tarihten sonra LLMTR istekleri HTTP 410 model_retired ile reddeder ve otomatik olarak başka bir modele yönlendirmez. ## Imagen 4 (google/imagen-4.0-generate-001) URL: /models/google/imagen-4.0-generate-001 Provider: Google Context window: 0 Operations: IMAGES_GENERATIONS Modalities: image, text Pricing: IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.04 USD Summary: Kalite ve hız dengesi için ana Imagen 4 görsel modeli; 17 Ağustos 2026'da kapanır. Description: Daha iyi metin işleme ve genel görüntü kalitesi ile geniş yaratıcı kullanım alanlarını kapsar. Google'ın müşteri bildirimine göre bu model kimliği 17 Ağustos 2026'da kullanımdan kaldırılır; bu tarihten sonra LLMTR istekleri HTTP 410 model_retired ile reddeder ve otomatik olarak başka bir modele yönlendirmez. ## Imagen 4 (google/imagen-4.0-ultra-generate-001) URL: /models/google/imagen-4.0-ultra-generate-001 Provider: Google Context window: 0 Operations: IMAGES_GENERATIONS Modalities: image, text Pricing: IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.06 USD Summary: Premium kreatifler için en yüksek kaliteli Imagen 4 modeli; 17 Ağustos 2026'da kapanır. Description: Görsel doğruluk, detay ve premium çıktı kalitesinin daha önemli olduğu yaratıcı işlerde tercih edilir. Google'ın müşteri bildirimine göre bu model kimliği 17 Ağustos 2026'da kullanımdan kaldırılır; bu tarihten sonra LLMTR istekleri HTTP 410 model_retired ile reddeder ve otomatik olarak başka bir modele yönlendirmez. ## Veo 3.1 (google/veo-3.1-fast-generate-001) URL: /models/google/veo-3.1-fast-generate-001 Provider: Google Context window: 0 Operations: VIDEO_GENERATIONS Modalities: text, image, video Pricing: VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.1 USD; VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.12 USD; VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.3 USD Summary: Hız odaklı Veo 3.1 Fast video üretimi. Description: Google Veo 3.1 Fast; en güncel Veo neslinde hız ve maliyet öncelikli sesli video üretir. Metin veya görsel referans (image_url, base64) girdisi alır. İterasyon, taslak ve sosyal içerik akışları için uygundur. 720p $0.10, 1080p $0.12, 4k $0.30/saniye fiyatlanır. ## Veo 3.1 (google/veo-3.1-generate-001) URL: /models/google/veo-3.1-generate-001 Provider: Google Context window: 0 Operations: VIDEO_GENERATIONS Modalities: text, image, video Pricing: VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.4 USD; VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.4 USD; VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.6 USD Summary: En güncel Veo 3.1 ile yüksek kaliteli sesli video üretimi. Description: Google Veo 3.1; metinden veya görsel referanstan (image_url, base64) sesli video üreten en güncel Veo modelidir. Sinematik kalite, karmaşık sahne kurgusu ve reklam prodüksiyonu için uygundur. 720p/1080p $0.40, 4k $0.60/saniye fiyatlanır. ## Veo 3.1 (google/veo-3.1-lite-generate-001) URL: /models/google/veo-3.1-lite-generate-001 Provider: Google Context window: 0 Operations: VIDEO_GENERATIONS Modalities: text, image, video Pricing: VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.05 USD; VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.08 USD Summary: En ekonomik Veo katmanı: Veo 3.1 Lite. Description: Google Veo 3.1 Lite; en düşük birim maliyetle sesli video üreten Veo katmanıdır. Metin veya görsel referans (image_url, base64) girdisi alır. Yüksek hacimli, maliyet duyarlı üretim akışları için uygundur. 720p $0.05, 1080p $0.08/saniye fiyatlanır; 4k desteklenmez. ## Claude Fable 5 (anthropic/claude-fable-5) URL: /models/anthropic/claude-fable-5 Provider: Anthropic Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 10 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 50 USD Summary: Anthropic'in en güçlü genel erişimli Mythos sınıfı Claude modeli. Description: Claude Fable 5; uzun soluklu ajan gorevleri, buyuk kod tabanlari, karmasik bilgi isleri ve gorsel anlama gerektiren uretim akislarinda Anthropic'in en guclu genel erisimli modelidir. 1M context, 128K maksimum cikti, adaptive thinking, gorsel girdi ve konfigure edilebilir effort seviyeleri sunar. En yuksek yetenegin gerekmedigi islerde Opus 5 yarı maliyetle daha uygun bir secimdir. Anthropic'in 30 gunluk retention sartina tabidir. ## Claude Opus 5 (anthropic/claude-opus-5) URL: /models/anthropic/claude-opus-5 Provider: Anthropic Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 5 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 25 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 6.25 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 10 USD Summary: Karmaşık ajan kodlaması ve kurumsal işler için yeni nesil Opus. Description: Cok dosyali kod degisiklikleri, uzun soluklu ajan gorevleri, kod incelemesi ve kurumsal bilgi isleri icin Anthropic'in yeni nesil Opus modelidir. 1M context, 128K maksimum cikti, varsayilan olarak acik adaptive thinking, gorsel ve dokuman girdisi, tool calling ve prompt cache destegi sunar. Effort seviyesi low'dan max'a kadar ayarlanabilir; kisa isler icin dusuk, zor ajan islerinde yuksek seviye tercih edilir. ## Claude Opus 4.8 (anthropic/claude-opus-4.8) URL: /models/anthropic/claude-opus-4.8 Provider: Anthropic Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 25 USD Summary: Zor reasoning, kod ve uzun soluklu ajan işleri için stabil Opus modeli. Description: Karmasik reasoning, buyuk kod tabanlari, uzun sureli ajan gorevleri ve profesyonel bilgi isleri icin oturmus Opus secenegidir. 1M context, 128K maksimum cikti ve gorsel girdi sunar. Mevcut entegrasyonlarda guclu kalir; yeni entegrasyonlarda Opus 5 daha guncel secimdir. ## Claude Opus 4.7 (anthropic/claude-opus-4.7) URL: /models/anthropic/claude-opus-4.7 Provider: Anthropic Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 25 USD Summary: Zor kod, derin analiz ve uzun soluklu ajan işleri için önceki nesil Opus. Description: Karmasik reasoning, buyuk kod tabanlari, uzun sureli ajan gorevleri ve profesyonel bilgi isleri icin onceki nesil Opus modelidir. 1M context, 128K maksimum cikti ve yuksek cozunurluklu gorsel anlama sunar. Bu nesle gore ayarlanmis mevcut entegrasyonlarda anlamli kalir; yeni islerde Opus 5 daha guncel secimdir. ## Claude Opus 4.6 (anthropic/claude-opus-4.6) URL: /models/anthropic/claude-opus-4.6 Provider: Anthropic Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 25 USD Summary: Uzun soluklu ajanlar ve ağır kod işleri için en güçlü Claude modeli. Description: Buyuk kod tabanlari, zor code review, hata ayiklama ve uzun sureli agent gorevleri icin Anthropic'in en guclu Opus secenegidir. Kaliteden taviz vermeden zor profesyonel is akislari yuruten ekipler icin uygundur. ## Claude Opus 4.5 (anthropic/claude-opus-4.5) URL: /models/anthropic/claude-opus-4.5 Provider: Anthropic Context window: 200000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 25 USD Summary: Derin analiz ve üst seviye kod kalitesi için premium Opus modeli. Description: Derin analiz, kod kalitesi ve bilgi islerinde Opus kalitesini isteyen ekipler icin guclu secenektir. Yeni 4.6 ciksa da hala zor islerde yuksek tavan sunar. ## Claude Sonnet 5 (anthropic/claude-sonnet-5) URL: /models/anthropic/claude-sonnet-5 Provider: Anthropic Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 10 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 2.5 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 4 USD Summary: Kod, ajan ve uzun bağlamlı işler için yeni nesil Sonnet. Description: Sonnet 4.6'dan gecis icin konumlanan yeni nesil Sonnet modelidir. Kodlama, arac kullanan ajanlar, uzun dokuman analizi ve uretim asistanlarinda guclu hiz-kalite dengesi sunar. 1M context, 128K maksimum cikti, varsayilan adaptive thinking, gorsel girdi, tool calling ve prompt cache destegi vardir. ## Claude Sonnet 4.6 (anthropic/claude-sonnet-4.6) URL: /models/anthropic/claude-sonnet-4.6 Provider: Anthropic Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 3 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 15 USD Summary: Mevcut entegrasyonlar için güçlü, stabil Sonnet 4.6 seçeneği. Description: Kod, agent, bilgisayar kullanimi ve profesyonel ofis islerinde dengeli kalite-fiyat sunan onceki Sonnet amiral gemisidir. Mevcut sistemlerde guclu kalir; yeni entegrasyonlarda Sonnet 5 daha guncel secimdir. ## Claude Sonnet 4.5 (anthropic/claude-sonnet-4.5) URL: /models/anthropic/claude-sonnet-4.5 Provider: Anthropic Context window: 200000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 3 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 15 USD Summary: Kod yardımı ve günlük ajan işleri için güçlü önceki Sonnet modeli. Description: Uretimde cogu is yukunu tasiyabilecek dengeli bir Claude secenegidir. 4.6'ya cikmadan once oturmus Sonnet davranisi isteyen ekipler icin mantiklidir. ## Claude Haiku 4.5 (anthropic/claude-haiku-4.5) URL: /models/anthropic/claude-haiku-4.5 Provider: Anthropic Context window: 200000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 5 USD Summary: Gunluk gorevler icin hizli ve ekonomik Claude. Description: Siniflandirma, destek akislar, ozetleme ve hizli yardimci senaryolarinda iyi calisir. Sonnet veya Opus'a cikmadan once butce dostu ilk Claude secenegidir. ## Qwen3.7-Max (qwen/qwen3.7-max) URL: /models/qwen/qwen3.7-max Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2.5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 7.5 USD Summary: Zor ajan gorevleri ve kontrollu thinking icin Qwen'in en yeni Max modeli. Description: Qwen3.7-Max, Qwen ailesinin yeni ust seviye metin modelidir. Varsayilan olarak thinking acik gelir; daha dusuk gecikme gereken islerde slug suffix veya body uzerinden thinking kapatilabilir. Kod, arastirma, arac kullanimi ve cok adimli talimat takibi icin uygundur. ## Qwen3.7-Plus (qwen/qwen3.7-plus) URL: /models/qwen/qwen3.7-plus Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.4 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.6 USD Summary: Gorsel, video ve metin girdili ajan akislari icin dengeli Qwen3.7 modeli. Description: Qwen3.7-Plus, metinle birlikte gorsel ve video girdilerini anlayan Qwen3.7 modelidir. Ekran okuma, GUI tabanli ajanlar, gorsel referanstan kod uretimi, arac kullanimi ve uzun baglamli yardimci akislar icin dengeli bir secenektir. Varsayilan olarak thinking acik gelir; daha dusuk gecikme gereken islerde slug suffix veya body uzerinden kapatilabilir. ## Qwen3.6-Flash (qwen/qwen3.6-flash) URL: /models/qwen/qwen3.6-flash Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.25 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.5 USD Summary: Gunluk metin isleri ve yardimci akislari icin genel Qwen modeli. Description: Qwen3.6-Flash, Qwen ailesi icinde genel kullanimli bir model secenegidir. Fiyat, hiz ve kapasite dengesi slug varyantina gore degisir. ## Qwen-Plus (qwen/qwen-plus) URL: /models/qwen/qwen-plus Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.040000 USD Summary: Uzun baglamli yardimcilar ve aracli urun akislari icin dengeli Qwen modeli. Description: Qwen-Plus, guclu reasoning, uzun baglam ve arac kullanimi ile cok amacli gorevler icin dengeli bir genel modeldir. Tek modelle genis urun yuzeyi kapsamak isteyen ekipler icin iyi default olur. ## Qwen-Plus-2025-01-25 (qwen/qwen-plus-2025-01-25) URL: /models/qwen/qwen-plus-2025-01-25 Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.4 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.2 USD Summary: Uzun baglamli yardimcilar ve aracli urun akislari icin dengeli Qwen modeli; tarihli snapshot surumu. Description: Qwen-Plus-2025-01-25, guclu reasoning, uzun baglam ve arac kullanimi ile cok amacli gorevler icin dengeli bir genel modeldir. Tek modelle genis urun yuzeyi kapsamak isteyen ekipler icin iyi default olur. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen-Plus-2025-04-28 (qwen/qwen-plus-2025-04-28) URL: /models/qwen/qwen-plus-2025-04-28 Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.4 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.2 USD Summary: Uzun baglamli yardimcilar ve aracli urun akislari icin dengeli Qwen modeli; tarihli snapshot surumu. Description: Qwen-Plus-2025-04-28, guclu reasoning, uzun baglam ve arac kullanimi ile cok amacli gorevler icin dengeli bir genel modeldir. Tek modelle genis urun yuzeyi kapsamak isteyen ekipler icin iyi default olur. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen-Plus-2025-07-14 (qwen/qwen-plus-2025-07-14) URL: /models/qwen/qwen-plus-2025-07-14 Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.4 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.2 USD Summary: Uzun baglamli yardimcilar ve aracli urun akislari icin dengeli Qwen modeli; tarihli snapshot surumu. Description: Qwen-Plus-2025-07-14, guclu reasoning, uzun baglam ve arac kullanimi ile cok amacli gorevler icin dengeli bir genel modeldir. Tek modelle genis urun yuzeyi kapsamak isteyen ekipler icin iyi default olur. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen-Plus-2025-07-28 (qwen/qwen-plus-2025-07-28) URL: /models/qwen/qwen-plus-2025-07-28 Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.400000 USD Summary: Uzun baglamli yardimcilar ve aracli urun akislari icin dengeli Qwen modeli; tarihli snapshot surumu. Description: Qwen-Plus-2025-07-28, guclu reasoning, uzun baglam ve arac kullanimi ile cok amacli gorevler icin dengeli bir genel modeldir. Tek modelle genis urun yuzeyi kapsamak isteyen ekipler icin iyi default olur. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen-Plus-2025-09-11 (qwen/qwen-plus-2025-09-11) URL: /models/qwen/qwen-plus-2025-09-11 Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.400000 USD Summary: Uzun baglamli yardimcilar ve aracli urun akislari icin dengeli Qwen modeli; tarihli snapshot surumu. Description: Qwen-Plus-2025-09-11, guclu reasoning, uzun baglam ve arac kullanimi ile cok amacli gorevler icin dengeli bir genel modeldir. Tek modelle genis urun yuzeyi kapsamak isteyen ekipler icin iyi default olur. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen-Plus-Character-Ja (qwen/qwen-plus-character-ja) URL: /models/qwen/qwen-plus-character-ja Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.5 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.4 USD Summary: Karakter tutarliligi ve rol yapma icin ozel Qwen modeli. Description: Qwen-Plus-Character-Ja, karakter sesi, uzun diyalog tutarliligi ve rol yapma senaryolari icin optimize edilmistir. Ozellikle yaratici yazim ve persona tabanli uygulamalarda one cikar. ## Qwen-Plus-Latest (qwen/qwen-plus-latest) URL: /models/qwen/qwen-plus-latest Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.400000 USD Summary: Uzun baglamli yardimcilar ve aracli urun akislari icin dengeli Qwen modeli. Description: Qwen-Plus-Latest, guclu reasoning, uzun baglam ve arac kullanimi ile cok amacli gorevler icin dengeli bir genel modeldir. Tek modelle genis urun yuzeyi kapsamak isteyen ekipler icin iyi default olur. ## Qwen3-Max (qwen/qwen3-max) URL: /models/qwen/qwen3-max Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.120000 USD Summary: Zor ajan gorevleri ve derin reasoning icin ust seviye Qwen modeli. Description: Qwen3-Max, derin reasoning, arac kullanimi ve daha zor talimat takibi isteyen gorevler icin Qwen ailesinin ust seviye seceneklerinden biridir. Yuksek kalite isteyen agent ve arastirma akislarinda anlamlidir. ## Qwen3-Max-2025-09-23 (qwen/qwen3-max-2025-09-23) URL: /models/qwen/qwen3-max-2025-09-23 Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 1.200000 USD Summary: Zor ajan gorevleri ve derin reasoning icin ust seviye Qwen modeli; tarihli snapshot surumu. Description: Qwen3-Max-2025-09-23, derin reasoning, arac kullanimi ve daha zor talimat takibi isteyen gorevler icin Qwen ailesinin ust seviye seceneklerinden biridir. Yuksek kalite isteyen agent ve arastirma akislarinda anlamlidir. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen3-Max-2026-01-23 (qwen/qwen3-max-2026-01-23) URL: /models/qwen/qwen3-max-2026-01-23 Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 1.200000 USD Summary: Zor ajan gorevleri ve derin reasoning icin ust seviye Qwen modeli; tarihli snapshot surumu. Description: Qwen3-Max-2026-01-23, derin reasoning, arac kullanimi ve daha zor talimat takibi isteyen gorevler icin Qwen ailesinin ust seviye seceneklerinden biridir. Yuksek kalite isteyen agent ve arastirma akislarinda anlamlidir. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen3-Max-Preview (qwen/qwen3-max-preview) URL: /models/qwen/qwen3-max-preview Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.240000 USD Summary: Zor ajan gorevleri ve derin reasoning icin ust seviye Qwen modeli; preview surumu. Description: Qwen3-Max-Preview, derin reasoning, arac kullanimi ve daha zor talimat takibi isteyen gorevler icin Qwen ailesinin ust seviye seceneklerinden biridir. Yuksek kalite isteyen agent ve arastirma akislarinda anlamlidir. Preview varyanti, genel kullanima acilmadan once yeni davranislari erken denemek isteyen ekipler icindir. ## Qwen3.6-Plus (qwen/qwen3.6-plus) URL: /models/qwen/qwen3.6-plus Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.050000 USD Summary: Uzun baglamli yardimcilar ve aracli urun akislari icin dengeli Qwen modeli. Description: Qwen3.6-Plus, guclu reasoning, uzun baglam ve arac kullanimi ile cok amacli gorevler icin dengeli bir genel modeldir. Tek modelle genis urun yuzeyi kapsamak isteyen ekipler icin iyi default olur. ## Qwen3.6-Plus-2026-04-02 (qwen/qwen3.6-plus-2026-04-02) URL: /models/qwen/qwen3.6-plus-2026-04-02 Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.500000 USD Summary: Uzun baglamli yardimcilar ve aracli urun akislari icin dengeli Qwen modeli; tarihli snapshot surumu. Description: Qwen3.6-Plus-2026-04-02, guclu reasoning, uzun baglam ve arac kullanimi ile cok amacli gorevler icin dengeli bir genel modeldir. Tek modelle genis urun yuzeyi kapsamak isteyen ekipler icin iyi default olur. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## GLM-5.2 (zai/glm-5.2) URL: /models/zai/glm-5.2 Provider: Z.AI Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.26 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.234 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 3.96 USD Summary: 1M contextli uzun kod, ajan ve function calling işleri için GLM-5.2. Description: GLM-5.2, 1M context penceresiyle uzun kod tabanları, çok adımlı ajan akışları, function calling ve üretim mühendisliği işleri için Z.AI'nin en yeni metin amiral gemisidir. Düz isteklerde thinking kapalı tutulabilir; zor görevlerde reasoning effort seviyesi seçilebilir. ## GLM-5.1 (zai/glm-5.1) URL: /models/zai/glm-5.1 Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.26 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.234 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 3.96 USD Summary: Agentic engineering icin Z.AI'nin en guclu modeli. Description: Kod yazmaktan proje cikarmaya giden daha uzun akislarda, arac kullanimi ve sistematik execution ile gucludur. Z.AI tarafinda en iddiali genel secenektir. ## GLM-5 (zai/glm-5) URL: /models/zai/glm-5 Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.9 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.18 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.88 USD Summary: Uzun ufuklu kod ve ajan isleri icin guclu GLM modeli. Description: Arka uclarda refactor, derin hata ayiklama ve cok adimli muhendislik islerinde guclu davranir. Acik agirlik cephesinde ust seviye performans isteyen ekipler icin dikkat cekici secenektir. ## GLM-5-Turbo (zai/glm-5-turbo) URL: /models/zai/glm-5-turbo Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.08 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.216 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 3.6 USD Summary: Uzun görev zincirleri ve araç kullanımı için hızlı GLM modeli. Description: Komut takibi, arac cagirma ve uzun gorev zincirlerinde ozellikle iyi ayarlanmis bir varyanttir. Agent altyapisinda hiz ile yetenegi birlikte isteyen ekipler icin uygundur. ## GLM-5V-Turbo (zai/glm-5v-turbo) URL: /models/zai/glm-5v-turbo Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.08 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.216 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 3.6 USD Summary: Gorsel kodlama ve GUI anlama icin GLM'nin guclu multimodal modeli. Description: Ekran goruntusu, video, dosya ve metni birlikte anlayarak planning ve coding gorevlerinde deger uretir. Ozellikle vision tabanli agent ve tasarimdan koda akislarda one cikar. ## DeepSeek V4 Flash (deepseek/deepseek-v4-flash) URL: /models/deepseek/deepseek-v4-flash Provider: DeepSeek Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.14 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.0028 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.28 USD Summary: Uzun bağlamlı ajan akışları ve hızlı reasoning için DeepSeek V4 modeli. Description: DeepSeek-V4-Flash: genis baglam, arac cagrilari, JSON cikti ve istege bagli thinking. Maliyet ve gecikme hassas is yukleri icin Pro'ya gore daha uygun giris noktasidir. DeepSeek bu model icin yogun saat fiyatlandirmasi duyurdu: 01:00-04:00 ve 06:00-10:00 UTC arasinda tum token kalemleri iki katina cikar. ## DeepSeek V4 Pro (deepseek/deepseek-v4-pro) URL: /models/deepseek/deepseek-v4-pro Provider: DeepSeek Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.435 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.003625 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.87 USD Summary: Agir muhakeme ve kod icin premium DeepSeek V4. Description: DeepSeek-V4-Pro, zor reasoning, ajan ve kod islerinde Flash'a gore daha yuksek kalite hedefleyen ekipler icin konumlanir. Ayni 1M baglam ve benzer kabiliyet setiyle daha yuksek birim fiyatla gelir. DeepSeek bu model icin yogun saat fiyatlandirmasi duyurdu: 01:00-04:00 ve 06:00-10:00 UTC arasinda tum token kalemleri iki katina cikar. ## Mistral Large 3 (mistral/mistral-large-latest) URL: /models/mistral/mistral-large-latest Provider: Mistral Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.5 USD Summary: Genel ürün yardımcıları ve görsel farkındalık için üst seviye Mistral modeli. Description: Genel amacli, multimodal ve yuksek kaliteli cikti isteyen ekipler icin Mistral tarafindaki en guclu secenektir. Hem ciddi urun islerinde hem de gorsel farkindalik gereken senaryolarda iyi calisir. ## Sonar (perplexity/sonar) URL: /models/perplexity/sonar Provider: Perplexity Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1 USD; CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 5 USD; CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 8 USD; CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 12 USD Summary: Hizli, kaynakli web cevaplari icin temel Sonar modeli. Description: Gercek zamanli web aramasi ile hizli ve uygun maliyetli grounded cevaplar verir. Guncel bilgi, hizli ozet ve dogrudan soru-cevap ihtiyaclarinda en pratik Perplexity girisidir. ## Mistral Small 4 (mistral/mistral-small-latest) URL: /models/mistral/mistral-small-latest Provider: Mistral Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.15 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.6 USD Summary: Günlük sohbet, reasoning ve kod yardımı için verimli hibrit Mistral modeli. Description: Tek modelle sohbet, kod ve akil yurutme islerini tasimak isteyen ekipler icin verimli bir Mistral secenegidir. Kaliteyi korurken maliyeti amiral geminin altinda tutar. ## Sonar Pro (perplexity/sonar-pro) URL: /models/perplexity/sonar-pro Provider: Perplexity Context window: 200000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 3 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 15 USD; CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 6 USD; CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 10 USD; CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 14 USD; CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 14 USD; CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 18 USD; CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 22 USD Summary: Karmasik sorgular icin daha derin arama yapan Sonar. Description: Standart Sonar'a gore daha zengin arama ve daha derin icerik anlama sunar. Urun karsilastirma, piyasa tarama ve cok adimli bilgi toplama islerinde daha guclu davranir. ## Mistral Medium 3.1 (mistral/mistral-medium-latest) URL: /models/mistral/mistral-medium-latest Provider: Mistral Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.4 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2 USD Summary: Araçlı ürün akışları ve planning için frontier seviye Mistral modeli. Description: Multimodal anlayis, daha guclu planning ve araca dayali akislarda amiral gemi ile kucuk modeller arasinda iyi denge sunar. Uretim olceginde akilli genel model arayan ekipler icin uygundur. ## Sonar Reasoning Pro (perplexity/sonar-reasoning-pro) URL: /models/perplexity/sonar-reasoning-pro Provider: Perplexity Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 8 USD; CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 6 USD; CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 10 USD; CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 14 USD Summary: Web kaynaklarını sentezleyerek zor karşılaştırmalar yapmak için Sonar modeli. Description: Kaynak toplamayi adim adim muhakeme ile birlestirdigi icin zor karsilastirma ve sentez islerinde gucludur. Hizdan biraz feragat edip daha dusunulmus cevap istendiginde tercih edilir. ## Devstral 2 (mistral/devstral-medium-latest) URL: /models/mistral/devstral-medium-latest Provider: Mistral Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.4 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2 USD Summary: Yazilim muhendisligi ve kod ajanlari icin guclu Mistral modeli. Description: Depo anlama, uygulama, refactor ve hata ayiklama gibi yazilim islerinde agentic calisma tarziyla gucludur. Kod odakli urunler icin Mistral tarafindaki ana seceneklerden biridir. ## Inkling (thinkingmachines/inkling) URL: /models/thinkingmachines/inkling Provider: Thinking Machines Context window: 65536 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 3.74 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.748 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 9.36 USD Summary: Thinking Machines'in 975B açık ağırlıklı MoE hibrit reasoning modeli; reasoning eforu none–xhigh arası ayarlanır. Description: Inkling, Thinking Machines'in açık ağırlıklı amiral gemisi modelidir: 975 milyar toplam, token başına 41 milyar aktif parametreli bir Mixture-of-Experts mimarisi. Yanıt vermeden önce adım adım düşünür ve bu düşünme eforunu istek başına ayarlayabilirsiniz — `reasoning_effort` ile none (kapalı) ile xhigh arasında altı seviye. Görseli base64 veri URL'si olarak kabul eder, araç/fonksiyon çağrısı yapar, JSON nesne çıktısı üretir ve prompt cache okumasını destekler. Reasoning tokenları `completion_tokens` içinde döner ve çıktı olarak ücretlendirilir. ## MiMo V2.5 Pro (mimo/mimo-v2.5-pro) URL: /models/mimo/mimo-v2.5-pro Provider: Xiaomi MiMo Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 5 USD Summary: Uzun bağlamlı üretim yardımcıları için üst seviye MiMo 2.5 modeli. Description: Uzun bağlam, araç kullanımı ve daha kaliteli üretim isteyen ekipler için MiMo 2.5 çizgisinin amiral gemisi seçeneğidir. `mimo/mimo-v2-pro` yerine kullanılacak yeni canonical kimliktir ve güncel pay-as-you-go fiyatlarıyla çalışır. ## Recraft V4 (recraft/recraft-v4) URL: /models/recraft/recraft-v4 Provider: Recraft Context window: 10000 Operations: IMAGES_GENERATIONS Modalities: image, text Pricing: IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.04 USD Summary: Marka görselleri ve ürün sahneleri için güncel Recraft raster modeli. Description: Marka görselleri, kampanya kreatifleri ve ürün sahneleri için hızlı ama kaliteli text-to-image üretimi sunar. Güncel Recraft çizgisinde genel amaçlı güvenli başlangıç noktasıdır. ## Recraft V4 Pro (recraft/recraft-v4-pro) URL: /models/recraft/recraft-v4-pro Provider: Recraft Context window: 10000 Operations: IMAGES_GENERATIONS Modalities: image, text Pricing: IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.25 USD Summary: Premium kampanya kreatifi ve detaylı sahneler için Recraft V4 Pro. Description: Detay, kontrol ve premium çıktı kalitesi daha önemli olduğunda standart V4'ün üstüne çıkar. Pazarlama kreatifi ve yüksek görünürlüklü görsel üretiminde güçlüdür. ## MiMo V2.5 (mimo/mimo-v2.5) URL: /models/mimo/mimo-v2.5 Provider: Xiaomi MiMo Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio, video Pricing: CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 5 USD Summary: Metin, görsel ve web destekli yardımcılar için dengeli MiMo 2.5 modeli. Description: Metin, görsel ve daha zengin yardımcı akışlarını tek modelde toplamak isteyen ekipler için dengeli bir seçenektir. `mimo/mimo-v2-omni` ve `mimo/mimo-v2-flash` yerine kullanılacak yeni canonical kimliktir. ## Krea 2 Medium (krea/krea-2-medium) URL: /models/krea/krea-2-medium Provider: Krea Context window: 10000 Operations: IMAGES_GENERATIONS Modalities: image, text Pricing: IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.03 USD Summary: Hizli ve uygun maliyetli metinden gorsel uretimi icin Krea 2 Medium. Description: Krea 2 ailesinin hizli varyantidir; illustrasyon, anime ve ifade gucu yuksek stillerde uretimler arasinda istikrarli ciktilar verir. Hizli iterasyon ve genel amacli gorsel uretimi icin uygun bir baslangic noktasidir. ## Krea 2 Large (krea/krea-2-large) URL: /models/krea/krea-2-large Provider: Krea Context window: 10000 Operations: IMAGES_GENERATIONS Modalities: image, text Pricing: IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.06 USD Summary: Fotograf gercekciligi ve en esnek ciktilar icin Krea 2 Large. Description: Krea 2 ailesinin daha buyuk varyantidir; fotograf gercekciligi, ham dokular ve daha esnek ciktilar gerektiginde one cikar. Kalite ve dokusal zenginligin oncelikli oldugu islerde tercih edilir. ## Fugu Ultra (sakana/fugu-ultra) URL: /models/sakana/fugu-ultra Provider: Sakana AI Context window: 1000000 Operations: CHAT_COMPLETIONS, RESPONSES Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 5 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 30 USD; RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 5 USD; RESPONSES/CACHE_READ/PER_1M_TOKENS: 0.5 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 30 USD Summary: Sakana AI'nin zor reasoning, kodlama ve arastirma isleri icin multi-agent modeli. Description: Fugu Ultra, Sakana AI'nin OpenAI uyumlu multi-agent reasoning modelidir. Zor kodlama, guvenlik analizi, bilimsel arastirma ve uzun baglamli sentez islerinde daha derin uzman ajan havuzu kullanir. ## Apertus v1.5 8B (publicai/apertus-v1.5-8b) URL: /models/publicai/apertus-v1.5-8b Provider: PublicAI Context window: 262144 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.2 USD Summary: Görsel okuma, araç kullanımı ve 262K bağlam sunan hızlı Apertus modeli. Description: Apertus v1.5 8B, metin ve görsel girdiyi birlikte işleyebilen açık ağırlıklı bir modeldir. 262.144 token bağlam penceresiyle uzun dokümanları tek istekte değerlendirebilir; görselleri okuyup içeriğini açıklayabilir. Sohbet, özetleme, sınıflandırma, veri dönüştürme ve JSON formatında çıktı bekleyen akışlar için hızlı ve ekonomik bir seçenektir. Function calling desteklediği için araç çağıran kod ve sohbet uygulamalarıyla birlikte kullanılabilir. Görseller yalnızca base64 data URL olarak gönderilir. ## Apertus v1.5 70B (publicai/apertus-v1.5-70b) URL: /models/publicai/apertus-v1.5-70b Provider: PublicAI Context window: 262144 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.82 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.92 USD Summary: Görsel okuma, araç kullanımı ve 262K bağlam sunan büyük Apertus modeli. Description: Apertus v1.5 70B, ailenin en büyük modeli olup metin ve görsel girdiyi birlikte işler. 262.144 token bağlam penceresiyle uzun dokümanları, kod tabanlarını ve çok turlu konuşmaları tek istekte değerlendirebilir. Bilgi sentezi, analiz, çok dilli yardımcı akışlar, içerik taslağı ve kod yardımı gibi kalitenin öne çıktığı işlerde 8B sürümünden daha güçlü sonuç verir. Function calling ve JSON formatında çıktı desteklediği için araç çağıran kod ve sohbet uygulamalarıyla birlikte kullanılabilir. Görseller yalnızca base64 data URL olarak gönderilir. ## MiniMax M3 (minimax/minimax-m3) URL: /models/minimax/minimax-m3 Provider: MiniMax Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.6 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.12 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.4 USD Summary: Kod, ajan akislari ve 1M baglamli multimodal isler icin MiniMax frontier modeli. Description: MiniMax M3, kodlama, ajan tabanli is akislari, uzun baglamli analiz ve gorsel/video girdili uygulamalar icin konumlanan MiniMax frontier modelidir. 1 milyon token baglam penceresi, OpenAI uyumlu Chat Completions cagrilari, function calling, prompt cache ve adaptive thinking kontroluyle uretim entegrasyonlarinda kullanilir. ## MiniMax M2.7 (minimax/minimax-m2.7) URL: /models/minimax/minimax-m2.7 Provider: MiniMax Context window: 204800 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.3 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.06 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.2 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.375 USD Summary: Kod, ofis isleri ve uzun baglamli ajan akislari icin MiniMax M2 modeli. Description: MiniMax M2.7, kodlama, dokuman uretimi, hata ayiklama, cok adimli is akislari ve uzun baglamli asistan senaryolari icin konumlanan metin modelidir. 204.800 token baglam penceresiyle buyuk konusma gecmisi, genis talimat setleri ve agent odakli muhakeme gerektiren islerde kullanilir. ## Llama 3.3 70B Instruct (meta/llama-3.3-70b-instruct) URL: /models/meta/llama-3.3-70b-instruct Provider: Meta Context window: 131072 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0 USD Summary: Genel sohbet, çok dilli işler ve araç kullanımı için günlük kotayla ücretsiz Llama modeli. Description: Llama 3.3 70B Instruct, Meta'nın çok dilli, açık ağırlıklı instruction modelidir. Genel sohbet, özetleme, içerik taslağı, kod yardımı, function calling ve JSON formatında çıktı bekleyen yardımcı akışlarda güçlü bir genel amaçlı seçenektir. Günlük kullanım kotasıyla ücretsiz sunulur; kota dolduğunda istekler ertesi güne kadar sınırlandırılır. ## Llama 4 Scout 17B (meta/llama-4-scout-17b) URL: /models/meta/llama-4-scout-17b Provider: Meta Context window: 131072 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0 USD Summary: Görsel girdili işler ve araç kullanımı için günlük kotayla ücretsiz Llama 4 modeli. Description: Llama 4 Scout, Meta'nın metinle birlikte görsel girdi kabul eden açık ağırlıklı multimodal modelidir (17B aktif parametre, mixture-of-experts). Görsel açıklama, ekran görüntüsü okuma, doküman görseli analizi, function calling ve JSON çıktı gerektiren multimodal akışlar için uygundur. Günlük kullanım kotasıyla ücretsiz sunulur. ## Nemotron 3 Ultra 550B A55B (nvidia/nemotron-3-ultra-550b-a55b) URL: /models/nvidia/nemotron-3-ultra-550b-a55b Provider: NVIDIA Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0 USD Summary: Zor reasoning ve ajan görevleri için günlük kotayla ücretsiz sunulan en büyük Nemotron modeli. Description: Nemotron 3 Ultra, NVIDIA'nın en büyük açık ağırlıklı modelidir (550B toplam, 55B aktif parametre). 1M token bağlam penceresiyle uzun doküman analizi, çok adımlı reasoning, function calling ve JSON çıktı gerektiren ajan akışlarında kullanılır. Günlük kullanım kotasıyla ücretsiz sunulur; kota dolduğunda istekler ertesi güne kadar sınırlandırılır. ## Kimi K3 (moonshot/kimi-k3) URL: /models/moonshot/kimi-k3 Provider: Moonshot AI (Kimi) Context window: 1048576 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 3 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.3 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 15 USD Summary: 1M token context ve kapatılabilir thinking ile Kimi amiral gemisi. Description: Moonshot AI Kimi K3; uzun bağlamlı analiz, çok adımlı ajan akışları ve görsel anlama için güncel Kimi amiral gemisi modelidir. 1.048.576 token context, görsel girdi (base64 data URL), function calling, JSON çıktı ve otomatik prompt cache destekler. Thinking varsayılan açıktır; istek gövdesinde reasoning:false veya :fast suffix'i ile kapatılabilir. Sampling değerleri sabittir (temperature=1, top_p=0.95); tool_choice auto, none veya required olabilir. Web araması bu modelde desteklenmez. Cached input $0.30/1M, cache miss input $3.00/1M ve output $15.00/1M olarak fiyatlanır. Reasoning tokenları output olarak faturalanır; kısa yanıtlarda bile max_tokens değerini yüksek tutun. ## Kimi K2.7 Code (moonshot/kimi-k2.7-code) URL: /models/moonshot/kimi-k2.7-code Provider: Moonshot AI (Kimi) Context window: 262144 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.95 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.19 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 4 USD; CHAT_COMPLETIONS/REQUEST/PER_CALL: 0.005 USD Summary: Kod ajanları, uzun bağlam ve araçlı teknik işler için güncel Kimi Code modeli. Description: Kimi K2.7 Code, kod üretimi, çok adımlı araç kullanımı, web araması ve uzun bağlamlı teknik analiz için Moonshot tarafındaki güncel üst seviye seçenektir. 262K context, görsel ve video girdisi, JSON çıktı, cache ve varsayılan thinking desteğiyle üretim ajanları için konumlanır. ## Kimi K2.6 (moonshot/kimi-k2.6) URL: /models/moonshot/kimi-k2.6 Provider: Moonshot AI (Kimi) Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.95 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.16 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 4 USD; CHAT_COMPLETIONS/REQUEST/PER_CALL: 0.005 USD Summary: Uzun bağlamlı araştırma ve araçlı multimodal işler için Kimi ailesinin amiral gemisi modeli. Description: Uzun bağlam, araç kullanımı, web araması ve daha zor görevlerde Moonshot tarafındaki en güçlü genel seçenek olarak konumlanır. Hem araştırma hem üretim odaklı ajan akışlarında üst seviye kalite arayan ekipler için uygundur. ## Step 3.7 Flash (stepfun/step-3.7-flash) URL: /models/stepfun/step-3.7-flash Provider: StepFun Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.2 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.04 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.15 USD Summary: Gorsel ve video girdili agent, kod ve reasoning isleri icin StepFun modeli. Description: Step 3.7 Flash, metin, gorsel ve video girdilerini Chat Completions uzerinden isleyebilen multimodal reasoning modelidir. Kod yardimi, cok adimli agent akislari, belge veya ekran goruntusu yorumlama ve uzun baglamli analizlerde kullanilir; reasoning_effort low, medium ve high seviyeleriyle gecikme/derinlik dengesi ayarlanabilir. ## Kimi K2.5 (moonshot/kimi-k2.5) URL: /models/moonshot/kimi-k2.5 Provider: Moonshot AI (Kimi) Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.6 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 3 USD; CHAT_COMPLETIONS/REQUEST/PER_CALL: 0.005 USD Summary: Metin ve görsel akışları için dengeli Kimi modeli. Description: Multimodal yardımcılar, belge yorumlama ve web destekli günlük işlerde güçlü bir orta katman sunar. K2.6'ya çıkmadan önce daha erişilebilir bir kalite seviyesi isteyen ekipler için mantıklıdır. ## Laguna S 2.1 (poolside/laguna-s-2.1) URL: /models/poolside/laguna-s-2.1 Provider: Poolside Context window: 262144 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0 USD Summary: Uzun soluklu ajan kodlama için Poolside'ın güçlü modeli. Description: Çok dosyalı refactor, repo çapında anlama ve uzun araç zincirli görevlerde Poolside tarafındaki en yetenekli seçenektir. 262K bağlam ve 32K çıktı ile büyük değişiklikleri tek oturumda taşır; reasoning'i açıp kapatarak kalite ile hız arasında geçiş yapabilirsiniz. Genel sohbetten çok yazılım üretimi ve agentic coding akışlarında değer üretir. ## Laguna XS 2.1 (poolside/laguna-xs-2.1) URL: /models/poolside/laguna-xs-2.1 Provider: Poolside Context window: 262144 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0 USD Summary: Hızlı ajan kodlama için Poolside'ın hafif modeli. Description: Kısa döngülü kod düzenleme, test yazma ve hızlı iterasyon gereken ajan akışları için tasarlanmıştır. S sınıfıyla aynı 262K bağlamı ve araç çağrısını korurken belirgin biçimde daha hızlı yanıt verir; ağır düşünme gerektirmeyen işlerde reasoning'i kapatarak gecikmeyi daha da düşürebilirsiniz. ## AionLabs: Aion 3.0 (aion-labs/aion-3.0) URL: /models/aion-labs/aion-3.0 Provider: AionLabs Context window: 131072 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 3 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.75 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 6 USD Summary: Uzun kurgu, roleplay ve karakter odakli diyaloglar icin AionLabs modeli. Description: Aion 3.0, uzun diyaloglar, karakter tutarliligi, gerilim kurma ve dallanan hikaye akislari icin konumlanan AionLabs modelidir. GLM ailesi uzerine kurulu coklu model yaklasimi, yazar asistanlari, interaktif kurgu urunleri ve roleplay uygulamalarinda daha yapili sahne ilerleyisi isteyen ekipler icin uygundur. 128K context, 32K maksimum cikti ve cache-read fiyatlandirmasi destekler. ## AionLabs: Aion 3.0 Mini (aion-labs/aion-3.0-mini) URL: /models/aion-labs/aion-3.0-mini Provider: AionLabs Context window: 131072 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.7 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.18 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.4 USD Summary: Yuksek hacimli roleplay ve kurgu akislari icin ekonomik Aion 3 modeli. Description: Aion 3.0 Mini, Aion 3 ailesinin daha dusuk maliyetli secenegidir. DeepSeek ailesi uzerine kurulu coklu model yapisi, roleplay, hikaye taslagi, karakter cevabi ve uzun sohbetlerde maliyeti kontrol ederken daha guclu anlatim yapisi isteyen urunler icin uygundur. 128K context, 32K maksimum cikti ve cache-read fiyatlandirmasi destekler. ## KwaiKAT: KAT-Coder-Pro V2.5 (kwaikat/kat-coder-pro-v2.5) URL: /models/kwaikat/kat-coder-pro-v2.5 Provider: KwaiKAT Context window: 262144 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.74 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.15 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.96 USD Summary: Depo ölçekli agentic yazılım işleri için Kwaipilot'un amiral gemisi kod modeli. Description: KAT-Coder-Pro V2.5, Kwaipilot'un (Kuaishou StreamLake) amiral gemisi agentic kod modelidir. Gerçek, çalıştırılabilir depolar içinde çok adımlı görevleri sürdürmek üzere eğitildi; tek seferlik kod üretiminden çok, kod tabanını gezme, düzenleme, test çalıştırma ve araç zinciri kurma akışları için konumlanır. Yanıt vermeden önce sorunu adım adım düşünür (reasoning her zaman açıktır), güvenilir araç/fonksiyon çağrısı yapar ve base64 veri URL'si olarak görsel girdi kabul eder. 256K bağlam penceresi ve prompt cache okuması destekler. ## KwaiKAT: KAT-Coder-Air V2.5 (kwaikat/kat-coder-air-v2.5) URL: /models/kwaikat/kat-coder-air-v2.5 Provider: KwaiKAT Context window: 262144 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.15 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.03 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.6 USD Summary: Yüksek hacimli agentic kod akışları için ekonomik KAT-Coder modeli. Description: KAT-Coder-Air V2.5, KAT-Coder ailesinin daha hafif ve ekonomik seçeneğidir. Pro ile aynı agentic tasarımı, maliyeti kontrol altında tutması gereken yüksek hacimli kodlama akışlarına taşır: kod tabanında gezinme, dosya düzenleme, araç kullanımı ve çok adımlı görevler. Yanıt öncesi adım adım düşünür (reasoning her zaman açıktır), araç/fonksiyon çağrısı yapar ve base64 veri URL'si olarak görsel girdi kabul eder. 256K bağlam penceresi ve prompt cache okuması destekler. ## Grok 4.5 (xai/grok-4.5) URL: /models/xai/grok-4.5 Provider: xAI Context window: 500000 Operations: RESPONSES Modalities: text, image Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 2 USD; RESPONSES/CACHE_READ/PER_1M_TOKENS: 0.5 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 6 USD Summary: Kod, ajanlar ve bilgi işleri için yeni Grok frontier modeli. Description: Grok 4.5, xAI tarafında kodlama, agentic görevler ve bilgi işleri için konumlanan yeni üst seviye Grok modelidir. 500K context, metin ve görsel girdi, function calling, structured outputs, prompt cache fiyatı ve low/medium/high reasoning effort desteği sunar. Varsayılan reasoning seviyesi high kabul edilir; 200K üstü input, yüksek context fiyatı doğrulanana kadar LLMTR'de kapalıdır. ## Grok 4.3 (xai/grok-4.3) URL: /models/xai/grok-4.3 Provider: xAI Context window: 1000000 Operations: RESPONSES Modalities: text Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 1.25 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 2.5 USD Summary: Uzun bağlamlı analiz ve kod için güçlü Grok modeli. Description: Büyük bağlam penceresi ile araştırma, belge analizi ve daha ağır yazılım işlerinde güçlü bir genel seçenektir. xAI ekosisteminde metin odaklı üst seviye kullanım isteyen ekipler için uygundur. ## Grok Imagine Video 1.5 (xai/grok-imagine-video-1.5) URL: /models/xai/grok-imagine-video-1.5 Provider: xAI Context window: 0 Operations: VIDEO_GENERATIONS Modalities: video, text, image, audio Pricing: VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.08 USD Summary: Sesli, görselden videoya üretim için Grok Imagine 1.5 modeli. Description: Bir başlangıç karesini akıcı harekete dönüştürmek isteyen ekipler için uygundur; ses, ambiyans ve konuşma aynı geçişte üretilir. Ürün tanıtımı, kısa sahne ve konsept animasyonlarında xAI'nin güncel image-to-video seçeneğidir. ## GPT-5.4 nano (openai/gpt-5.4-nano) URL: /models/openai/gpt-5.4-nano Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.25 USD Summary: Hacimli basit gorevler icin en ucuz GPT-5.4 sinifi model. Description: Siniflandirma, yonlendirme, ozetleme ve hafif otomasyon gibi yuksek hacimli islerde maliyet odakli secenektir. Karmasik planning yerine hiz ve verimlilik onceliklidir. ## GPT-5.1 (openai/gpt-5.1) URL: /models/openai/gpt-5.1 Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.25 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 10 USD Summary: Kod yardımı ve araçlı otomasyon için dengeli önceki GPT-5 amiral gemisi. Description: Konfigure edilebilir reasoning ile kod, otomasyon ve genel profesyonel islerde guclu performans verir. En yeni modele cikmadan oturmus bir GPT-5 davranisi isteyen ekipler icin mantikli secimdir. ## GPT-5 (openai/gpt-5) URL: /models/openai/gpt-5 Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.25 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 10 USD Summary: Genel üretim işleri ve mevcut entegrasyonlar için olgun GPT-5 seçeneği. Description: Reasoning ve kod agirlikli gorevlerde hala guclu, olgun bir GPT-5 secenegidir. Mevcut entegrasyonlarini bozmadan saglam genel performans isteyen ekipler icin uygundur. ## GPT-5 mini (openai/gpt-5-mini) URL: /models/openai/gpt-5-mini Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.25 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2 USD Summary: Iyi tanimli isler icin hizli ve ekonomik GPT-5 modeli. Description: Net promptlar, yardimci akislar, veri donusumu ve gunluk copilot isleri icin verimli secenektir. Kaliteyi makul seviyede tutarken maliyeti ciddi bicimde dusurur. ## GPT-5 nano (openai/gpt-5-nano) URL: /models/openai/gpt-5-nano Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.05 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.4 USD Summary: Ozetleme ve siniflandirma icin ultra ekonomik GPT-5 modeli. Description: Basit kararlar, etiketleme, filtreleme ve kisa donusumler gibi yuksek throughput isteyen isler icin tasarlanmistir. En dusuk maliyetli GPT-5 yolunu arayan ekipler icin uygundur. ## GPT-4.1 mini (openai/gpt-4.1-mini) URL: /models/openai/gpt-4.1-mini Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.4 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.6 USD Summary: Günlük araçlı yardımcılar için daha düşük maliyetli GPT-4.1 modeli. Description: Talimat takibi ve arac kullanimi gereken hafif-orta seviye uretim isleri icin ekonomik secenektir. Kaliteyi korurken maliyeti ve gecikmeyi azaltmak isteyen ekipler icin uygundur. ## GPT-4.1 nano (openai/gpt-4.1-nano) URL: /models/openai/gpt-4.1-nano Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.4 USD Summary: Ekstraksiyon ve basit dönüşümler için en hafif GPT-4.1 modeli. Description: Ekstraksiyon, yeniden yazma ve basit donusumler gibi hafif gorevlerde hiz ve maliyet optimizasyonu sunar. Daha zor muhakeme gereken isler icin ust varyantlara cikmak gerekir. ## GPT-4o mini (openai/gpt-4o-mini) URL: /models/openai/gpt-4o-mini Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.15 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.6 USD Summary: Gunluk yardimci akislar icin hizli ve uygun maliyetli model. Description: Chat, ozetleme, siniflandirma ve basit multimodal yardimci akislarda hizli cevap verir. Diger amiral gemilere cikmadan once maliyet odakli iyi bir baslangic noktasi sunar. ## o3-mini (openai/o3-mini) URL: /models/openai/o3-mini Provider: OpenAI Context window: 200000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 4.4 USD Summary: Yapılandırılmış çıktı ve araçlı reasoning için ekonomik o3 modeli. Description: Yapilandirilmis cikti, arac kullanimi ve reasoning isteyen gorevlerde maliyet-verim dengesi sunar. O1 sinifindan daha erisilebilir reasoning isteyen urunler icin uygundur. ## o1 (openai/o1) URL: /models/openai/o1 Provider: OpenAI Context window: 200000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 15 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 60 USD Summary: Derin teknik analiz ve ağır muhakeme için eski premium reasoning modeli. Description: Cevaptan once daha agir dusunme yapan bu model, pahali ama derin analiz odakli isler icin anlamlidir. Yeni GPT-5 reasoning ailesine gecmeden onceki premium referans noktalarindan biridir. ## GPT-OSS 120B (openai/gpt-oss-120b) URL: /models/openai/gpt-oss-120b Provider: OpenAI Context window: 131072 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0 USD Summary: Genel amaçlı işler ve araç kullanımı için günlük kotayla ücretsiz OpenAI açık ağırlıklı modeli. Description: GPT-OSS 120B, OpenAI'nin açık ağırlıklı modelidir. Genel sohbet, özetleme, kod yardımı, function calling ve JSON formatında çıktı bekleyen ürün akışları için güçlü bir seçenektir. Günlük kullanım kotasıyla ücretsiz sunulur; kota dolduğunda istekler ertesi güne kadar sınırlandırılır. ## GPT-OSS 20B (openai/gpt-oss-20b) URL: /models/openai/gpt-oss-20b Provider: OpenAI Context window: 131072 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0 USD Summary: Hızlı yardımcı akışlar için günlük kotayla ücretsiz küçük OpenAI açık ağırlıklı modeli. Description: GPT-OSS 20B, OpenAI'nin küçük açık ağırlıklı modelidir. Düşük gecikmeli sohbet, sınıflandırma, veri dönüşümü, function calling ve JSON çıktı gerektiren hafif otomasyon işleri için uygundur. Günlük kullanım kotasıyla ücretsiz sunulur. ## GPT-4 Turbo (openai/gpt-4-turbo) URL: /models/openai/gpt-4-turbo Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 10 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 30 USD Summary: Uzun bağlamlı metin işleri ve eski entegrasyonlar için GPT-4 modeli. Description: Uzun metin isleme, tarihsel GPT-4 davranisi ve mevcut entegrasyonlari koruma gereken durumlarda anlamlidir. Yeni modellere gore daha pahali kalabilir, ancak uyumluluk odakli gecislerde hala faydali olabilir. ## GPT-3.5 Turbo (openai/gpt-3.5-turbo) URL: /models/openai/gpt-3.5-turbo Provider: OpenAI Context window: 16385 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.5 USD Summary: Basit yardimci isler icin butce dostu eski model. Description: Temel sohbet, kisa donusumler ve eski entegrasyonlar icin hala yeterli olabilir. Modern agent ve reasoning islerinde daha yeni modellere gore belirgin sekilde geride kalir. ## Gemini 2.5 Computer Use Preview (google/gemini-2.5-computer-use-preview-10-2025) URL: /models/google/gemini-2.5-computer-use-preview-10-2025 Provider: Google Context window: 1048576 Operations: COMPUTER_USE Modalities: text Pricing: COMPUTER_USE/INPUT_TEXT/PER_1M_TOKENS: 1.25 USD; COMPUTER_USE/OUTPUT_TEXT/PER_1M_TOKENS: 10 USD Summary: Tarayıcı ve arayüz otomasyonu için Gemini computer-use modeli. Description: Web sayfaları ve uygulama arayüzleri üzerinde adım adım işlem yapan ajanlar geliştirmek için tasarlanmıştır. Otomasyon, test ve görev tamamlama akışlarında metin modelinden daha doğrudan davranır. ## Gemini 3 Pro Image (google/gemini-3-pro-image) URL: /models/google/gemini-3-pro-image Provider: Google Context window: 65536 Operations: IMAGES_GENERATIONS Modalities: text, image Pricing: IMAGES_GENERATIONS/INPUT_TEXT/PER_1M_TOKENS: 2 USD; IMAGES_GENERATIONS/OUTPUT_TEXT/PER_1M_TOKENS: 12 USD; IMAGES_GENERATIONS/INPUT_IMAGE/PER_1M_TOKENS: 2 USD; IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.24 USD; IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_1M_TOKENS: 120 USD Summary: Karmaşık düzenleme ve yaratıcı kontrol için üst seviye Gemini görüntü modeli. Description: Profesyonel kaliteye yakın görsel düzenleme ve üretim isteyen ekipler için konumlanır. Daha hassas komut takibi ve kontrollü yaratıcı iş akışlarında güçlüdür; yeni entegrasyonlarda GA model kimliği kullanılmalıdır. ## Gemini 3.1 Flash Image (google/gemini-3.1-flash-image) URL: /models/google/gemini-3.1-flash-image Provider: Google Context window: 131072 Operations: IMAGES_GENERATIONS Modalities: text, image Pricing: IMAGES_GENERATIONS/INPUT_TEXT/PER_1M_TOKENS: 0.5 USD; IMAGES_GENERATIONS/OUTPUT_TEXT/PER_1M_TOKENS: 3 USD; IMAGES_GENERATIONS/INPUT_IMAGE/PER_1M_TOKENS: 0.5 USD; IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.045 USD; IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.067 USD; IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.101 USD; IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.151 USD; IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_1M_TOKENS: 60 USD Summary: Daha hızlı ve erişilebilir görsel üretim için Gemini image modeli. Description: Konuşmalı düzenleme ve günlük görsel üretim işlerinde düşük gecikmeyi korurken iyi kalite sunar. Geniş kullanıcı tabanına giden yaratıcı ürünler için verimli bir orta katmandır; yeni entegrasyonlarda GA model kimliği kullanılmalıdır. ## Gemini 3.1 Flash Live Preview (google/gemini-3.1-flash-live-preview) URL: /models/google/gemini-3.1-flash-live-preview Provider: Google Context window: 128000 Operations: REALTIME_SESSION Modalities: text, audio, image, video Pricing: REALTIME_SESSION/INPUT_TEXT/PER_1M_TOKENS: 0.75 USD; REALTIME_SESSION/OUTPUT_TEXT/PER_1M_TOKENS: 4.5 USD; REALTIME_SESSION/INPUT_AUDIO/PER_MINUTE: 0.005 USD; REALTIME_SESSION/INPUT_IMAGE/PER_MINUTE: 0.002 USD; REALTIME_SESSION/INPUT_VIDEO/PER_MINUTE: 0.002 USD; REALTIME_SESSION/OUTPUT_AUDIO/PER_MINUTE: 0.018 USD; REALTIME_SESSION/TOOL_CALL/PER_1K_CALLS: 14 USD Summary: Gerçek zamanlı sesli konuşma için düşük gecikmeli Gemini Live modeli. Description: Sesli diyalog, akustik nüans ve multimodal farkındalık gerektiren uygulamalarda öne çıkar. Realtime yardımcılar ve voice-first deneyimler için güçlü bir preview katmanıdır. ## Gemini Robotics-ER 1.5 Preview (google/gemini-robotics-er-1.5-preview) URL: /models/google/gemini-robotics-er-1.5-preview Provider: Google Context window: 1048576 Operations: ROBOTICS_SESSION Modalities: text, image, video, audio Pricing: ROBOTICS_SESSION/INPUT_TEXT/PER_1M_TOKENS: 0.3 USD; ROBOTICS_SESSION/OUTPUT_TEXT/PER_1M_TOKENS: 2.5 USD; ROBOTICS_SESSION/INPUT_AUDIO/PER_1M_TOKENS: 1 USD; ROBOTICS_SESSION/INPUT_IMAGE/PER_1M_TOKENS: 0.3 USD; ROBOTICS_SESSION/INPUT_VIDEO/PER_1M_TOKENS: 0.3 USD; ROBOTICS_SESSION/TOOL_CALL/PER_1K_CALLS: 35 USD Summary: Fiziksel dünyayı anlayan robotik reasoning için Gemini modeli. Description: Robotların çevresini yorumlaması, görev planlaması ve fiziksel etkileşim kararları için tasarlanmıştır. Yazılım asistanından çok embodied reasoning ve robotik araştırma akışlarında anlamlıdır. ## Veo 2 (google/veo-2.0-generate-001) URL: /models/google/veo-2.0-generate-001 Provider: Google Context window: 0 Operations: VIDEO_GENERATIONS Modalities: text, image, video Pricing: VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.35 USD Summary: Metinden video üretimi için Gemini ekosistemindeki Veo modeli. Description: Prompt tabanlı video sahneleri üretmek isteyen ekipler için konumlanan üst seviye bir üretim modelidir. Görsel referans (image_url, base64) ile image-to-video da destekler. Yaratıcı video denemeleri, tanıtım içerikleri ve konsept anlatımı için uygundur. Saniye başına $0.35 fiyatlanır. ## Veo 3 (google/veo-3.0-fast-generate-001) URL: /models/google/veo-3.0-fast-generate-001 Provider: Google Context window: 0 Operations: VIDEO_GENERATIONS Modalities: text, image, video Pricing: VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.1 USD; VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.12 USD; VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.3 USD Summary: Hızlı ve ekonomik Veo 3 Fast video üretimi. Description: Google Veo 3 Fast; düşük gecikme ve maliyet önceliğiyle metinden veya görsel referanstan (image_url, base64) sesli video üretir. Taslak çekimler ve yüksek hacimli üretim akışları için uygundur. 720p $0.10, 1080p $0.12, 4k $0.30/saniye fiyatlanır. ## Veo 3 (google/veo-3.0-generate-001) URL: /models/google/veo-3.0-generate-001 Provider: Google Context window: 0 Operations: VIDEO_GENERATIONS Modalities: text, image, video Pricing: VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.4 USD Summary: Sesli video üretimi için kararlı Veo 3 modeli. Description: Google Veo 3; metinden veya görsel referanstan (image_url, base64) sesli video üretir. Sinematik sahneler, ürün tanıtımları ve hikaye anlatımı için uygundur. Çıktı sese sahiptir ve saniye başına $0.40 fiyatlanır. ## Claude Opus 4.1 (anthropic/claude-opus-4.1) URL: /models/anthropic/claude-opus-4.1 Provider: Anthropic Context window: 200000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 15 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 75 USD Summary: Tarihsel Opus davranışı ve ağır değerlendirmeler için önceki premium Claude modeli. Description: Kaliteyi oncelikleyen eski nesil Opus secenegidir. Tarihsel davranis veya mevcut degerlendirme setleri bu modele gore ayarlandiysa anlamli olabilir. ## Claude Opus 4 (anthropic/claude-opus-4) URL: /models/anthropic/claude-opus-4 Provider: Anthropic Context window: 200000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 15 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 75 USD Summary: Derin reasoning ve ağır kod incelemesi için ilk Claude 4 Opus modeli. Description: Gelistirilmis reasoning ve kod kalitesi icin cikmis erken Opus 4 secenegidir. Yeni Opus varyantlari kadar guncel olmasa da premium davranis bekleyen sistemlerde halen anlamlidir. ## Claude Sonnet 4 (anthropic/claude-sonnet-4) URL: /models/anthropic/claude-sonnet-4 Provider: Anthropic Context window: 200000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 3 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 15 USD Summary: Kullanıcıya dönük yardımcılar ve araçlı akışlar için genel Sonnet modeli. Description: Kullaniciya donuk yardimcilar, aracli akislari ve orta-yuksek hacimli urun islerini tasimak icin uygundur. Maliyet ve kaliteyi birlikte dusunen ekipler icin saglam secimdir. ## Qwen-Flash (qwen/qwen-flash) URL: /models/qwen/qwen-flash Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.005000 USD Summary: Gunluk sohbet ve yuksek hacimli yardimcilar icin hizli Qwen modeli. Description: Qwen-Flash, hizli yanit, dusuk gecikme ve yuksek hacimli kullanim icin optimize edilmis hafif bir modeldir. Basit yardimci akislar, otomasyon ve maliyet kontrollu urunler icin uygundur. ## Qwen-Flash-2025-07-28 (qwen/qwen-flash-2025-07-28) URL: /models/qwen/qwen-flash-2025-07-28 Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.050000 USD Summary: Gunluk sohbet ve yuksek hacimli yardimcilar icin hizli Qwen modeli; tarihli snapshot surumu. Description: Qwen-Flash-2025-07-28, hizli yanit, dusuk gecikme ve yuksek hacimli kullanim icin optimize edilmis hafif bir modeldir. Basit yardimci akislar, otomasyon ve maliyet kontrollu urunler icin uygundur. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen-Mt-Flash (qwen/qwen-mt-flash) URL: /models/qwen/qwen-mt-flash Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.16 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.49 USD Summary: Çok dilli çeviri ve lokalizasyon için Qwen modeli. Description: Qwen-Mt-Flash, terim koruma, bicim koruma ve lokalizasyon islerinde kullanilmak uzere tasarlanmis bir ceviri modelidir. Ulke bazli dil aktarimi ve icerik cevirisinde genel modellerden daha odakli davranir. ## Qwen-Mt-Plus (qwen/qwen-mt-plus) URL: /models/qwen/qwen-mt-plus Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2.46 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 7.37 USD Summary: Çok dilli çeviri ve lokalizasyon için Qwen modeli. Description: Qwen-Mt-Plus, terim koruma, bicim koruma ve lokalizasyon islerinde kullanilmak uzere tasarlanmis bir ceviri modelidir. Ulke bazli dil aktarimi ve icerik cevirisinde genel modellerden daha odakli davranir. ## Qwen-Vl-Ocr (qwen/qwen-vl-ocr) URL: /models/qwen/qwen-vl-ocr Provider: Qwen Context window: 256000 Operations: RESPONSES Modalities: text Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 0.07 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 0.16 USD Summary: OCR ve belge okuma icin ozel Qwen modeli. Description: Qwen-Vl-Ocr, gorselden metin cikarma, belge duzeni okuma ve OCR odakli isler icin optimize edilmistir. Genel multimodal sohbetten cok veri cikarma ve belge anlama tarafinda deger uretir. ## Qwen-Vl-Ocr-2025-11-20 (qwen/qwen-vl-ocr-2025-11-20) URL: /models/qwen/qwen-vl-ocr-2025-11-20 Provider: Qwen Context window: 256000 Operations: RESPONSES Modalities: text Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 0.07 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 0.16 USD Summary: OCR ve belge okuma icin ozel Qwen modeli; tarihli snapshot surumu. Description: Qwen-Vl-Ocr-2025-11-20, gorselden metin cikarma, belge duzeni okuma ve OCR odakli isler icin optimize edilmistir. Genel multimodal sohbetten cok veri cikarma ve belge anlama tarafinda deger uretir. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen3-Coder-30B-A3b-Instruct (qwen/qwen3-coder-30b-a3b-instruct) URL: /models/qwen/qwen3-coder-30b-a3b-instruct Provider: Qwen Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.450000 USD Summary: Kod yazma, duzenleme ve repo arama icin Qwen Coder modeli. Description: Qwen3-Coder-30B-A3b-Instruct, kod yazma, kod duzenleme ve repo anlama icin optimize edilmistir. Agentic coding, arac kullanimi ve yazilim yardimcisi senaryolarinda genel Qwen modellerinden daha odakli davranir. ## Qwen3-Coder-Flash (qwen/qwen3-coder-flash) URL: /models/qwen/qwen3-coder-flash Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.030000 USD Summary: Editor yardimi ve hizli duzeltmeler icin hafif Qwen Coder modeli. Description: Qwen3-Coder-Flash, editor yardimi, hizli duzeltmeler ve daha yuksek hacimli coding yardimi icin tasarlanmistir. Kaliteden bir miktar taviz verip hiz ve maliyeti onceliklendirir. ## Qwen3-Coder-Flash-2025-07-28 (qwen/qwen3-coder-flash-2025-07-28) URL: /models/qwen/qwen3-coder-flash-2025-07-28 Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.300000 USD Summary: Editor yardimi ve hizli duzeltmeler icin hafif Qwen Coder modeli; tarihli snapshot surumu. Description: Qwen3-Coder-Flash-2025-07-28, editor yardimi, hizli duzeltmeler ve daha yuksek hacimli coding yardimi icin tasarlanmistir. Kaliteden bir miktar taviz verip hiz ve maliyeti onceliklendirir. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen3-Coder-Plus (qwen/qwen3-coder-plus) URL: /models/qwen/qwen3-coder-plus Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.100000 USD Summary: Cok dosyali muhendislik isleri ve repo olcekli duzenlemeler icin ust seviye Qwen Coder modeli. Description: Qwen3-Coder-Plus, cok dosyali degisiklikler, repo capinda arama ve daha zor yazilim muhendisligi gorevlerinde Qwen tarafindaki daha guclu coding seceneklerinden biridir. ## Qwen3-Coder-Plus-2025-07-22 (qwen/qwen3-coder-plus-2025-07-22) URL: /models/qwen/qwen3-coder-plus-2025-07-22 Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 1.000000 USD Summary: Cok dosyali muhendislik isleri ve repo olcekli duzenlemeler icin ust seviye Qwen Coder modeli; tarihli snapshot surumu. Description: Qwen3-Coder-Plus-2025-07-22, cok dosyali degisiklikler, repo capinda arama ve daha zor yazilim muhendisligi gorevlerinde Qwen tarafindaki daha guclu coding seceneklerinden biridir. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen3-Coder-Plus-2025-09-23 (qwen/qwen3-coder-plus-2025-09-23) URL: /models/qwen/qwen3-coder-plus-2025-09-23 Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 1.000000 USD Summary: Cok dosyali muhendislik isleri ve repo olcekli duzenlemeler icin ust seviye Qwen Coder modeli; tarihli snapshot surumu. Description: Qwen3-Coder-Plus-2025-09-23, cok dosyali degisiklikler, repo capinda arama ve daha zor yazilim muhendisligi gorevlerinde Qwen tarafindaki daha guclu coding seceneklerinden biridir. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen3-Next-80B-A3b-Instruct (qwen/qwen3-next-80b-a3b-instruct) URL: /models/qwen/qwen3-next-80b-a3b-instruct Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.15 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.2 USD Summary: Verimli ajan ve arac kullanimi icin yeni nesil Qwen modeli. Description: Qwen3-Next-80B-A3b-Instruct, arac kullanimi, genel reasoning ve uzun akislarda verimli calisan yeni nesil bir Qwen secenegidir. ## Qwen3-Next-80B-A3b-Thinking (qwen/qwen3-next-80b-a3b-thinking) URL: /models/qwen/qwen3-next-80b-a3b-thinking Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.15 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.2 USD Summary: Verimli ajan ve arac kullanimi icin yeni nesil Qwen modeli. Description: Qwen3-Next-80B-A3b-Thinking, arac kullanimi, genel reasoning ve uzun akislarda verimli calisan yeni nesil bir Qwen secenegidir. Thinking varyanti, daha zor problemler ve daha dikkatli planning icin daha uygundur. ## Qwen3-Vl-235B-A22b-Instruct (qwen/qwen3-vl-235b-a22b-instruct) URL: /models/qwen/qwen3-vl-235b-a22b-instruct Provider: Qwen Context window: 256000 Operations: RESPONSES Modalities: text Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 0.4 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 1.6 USD Summary: Zor multimodal analiz ve derin gorsel reasoning icin buyuk Qwen VL modeli. Description: Qwen3-Vl-235B-A22b-Instruct, daha buyuk kapasite isteyen ekipler icin acik agirlik tarafinda iddiali bir Qwen VL secenegidir. Zor multimodal analiz ve daha derin gorsel reasoning islerinde anlamlidir. ## Qwen3-Vl-235B-A22b-Thinking (qwen/qwen3-vl-235b-a22b-thinking) URL: /models/qwen/qwen3-vl-235b-a22b-thinking Provider: Qwen Context window: 256000 Operations: RESPONSES Modalities: text Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 0.4 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 4 USD Summary: Zor multimodal analiz ve derin gorsel reasoning icin buyuk Qwen VL modeli. Description: Qwen3-Vl-235B-A22b-Thinking, daha buyuk kapasite isteyen ekipler icin acik agirlik tarafinda iddiali bir Qwen VL secenegidir. Zor multimodal analiz ve daha derin gorsel reasoning islerinde anlamlidir. Thinking varyanti, daha zor gorsel problemler ve daha dikkatli adim adim analiz icin daha uygundur. ## Qwen3-Vl-30B-A3b-Instruct (qwen/qwen3-vl-30b-a3b-instruct) URL: /models/qwen/qwen3-vl-30b-a3b-instruct Provider: Qwen Context window: 256000 Operations: RESPONSES Modalities: text Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 0.2 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 0.8 USD Summary: Gorsel anlama ve OCR icin Qwen VL modeli. Description: Qwen3-Vl-30B-A3b-Instruct, metin, gorsel ve video girdilerini anlayabilen bir vision-language modelidir. OCR, ekran goruntusu analizi, belge anlama ve multimodal yardimci akislar icin uygundur. ## Qwen3-Vl-30B-A3b-Thinking (qwen/qwen3-vl-30b-a3b-thinking) URL: /models/qwen/qwen3-vl-30b-a3b-thinking Provider: Qwen Context window: 256000 Operations: RESPONSES Modalities: text Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 0.2 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 2.4 USD Summary: Gorsel anlama ve OCR icin Qwen VL modeli. Description: Qwen3-Vl-30B-A3b-Thinking, metin, gorsel ve video girdilerini anlayabilen bir vision-language modelidir. OCR, ekran goruntusu analizi, belge anlama ve multimodal yardimci akislar icin uygundur. Thinking varyanti, daha zor gorsel problemler ve daha dikkatli adim adim analiz icin daha uygundur. ## Qwen3-Vl-32B-Instruct (qwen/qwen3-vl-32b-instruct) URL: /models/qwen/qwen3-vl-32b-instruct Provider: Qwen Context window: 256000 Operations: RESPONSES Modalities: text Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 0.16 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 0.64 USD Summary: Gorsel anlama ve OCR icin Qwen VL modeli. Description: Qwen3-Vl-32B-Instruct, metin, gorsel ve video girdilerini anlayabilen bir vision-language modelidir. OCR, ekran goruntusu analizi, belge anlama ve multimodal yardimci akislar icin uygundur. ## Qwen3-Vl-32B-Thinking (qwen/qwen3-vl-32b-thinking) URL: /models/qwen/qwen3-vl-32b-thinking Provider: Qwen Context window: 256000 Operations: RESPONSES Modalities: text Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 0.16 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 0.64 USD Summary: Gorsel anlama ve OCR icin Qwen VL modeli. Description: Qwen3-Vl-32B-Thinking, metin, gorsel ve video girdilerini anlayabilen bir vision-language modelidir. OCR, ekran goruntusu analizi, belge anlama ve multimodal yardimci akislar icin uygundur. Thinking varyanti, daha zor gorsel problemler ve daha dikkatli adim adim analiz icin daha uygundur. ## Qwen3-Vl-8B-Instruct (qwen/qwen3-vl-8b-instruct) URL: /models/qwen/qwen3-vl-8b-instruct Provider: Qwen Context window: 256000 Operations: RESPONSES Modalities: text Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 0.18 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 0.7 USD Summary: Gorsel anlama ve OCR icin Qwen VL modeli. Description: Qwen3-Vl-8B-Instruct, metin, gorsel ve video girdilerini anlayabilen bir vision-language modelidir. OCR, ekran goruntusu analizi, belge anlama ve multimodal yardimci akislar icin uygundur. ## Qwen3-Vl-8B-Thinking (qwen/qwen3-vl-8b-thinking) URL: /models/qwen/qwen3-vl-8b-thinking Provider: Qwen Context window: 256000 Operations: RESPONSES Modalities: text Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 0.18 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 2.1 USD Summary: Gorsel anlama ve OCR icin Qwen VL modeli. Description: Qwen3-Vl-8B-Thinking, metin, gorsel ve video girdilerini anlayabilen bir vision-language modelidir. OCR, ekran goruntusu analizi, belge anlama ve multimodal yardimci akislar icin uygundur. Thinking varyanti, daha zor gorsel problemler ve daha dikkatli adim adim analiz icin daha uygundur. ## Qwen3-Vl-Flash (qwen/qwen3-vl-flash) URL: /models/qwen/qwen3-vl-flash Provider: Qwen Context window: 256000 Operations: RESPONSES Modalities: text Pricing: starting: 0.005000 USD Summary: Hizli gorsel anlama ve OCR icin ekonomik Qwen VL modeli. Description: Qwen3-Vl-Flash, gorsel anlama ve OCR tarafina daha dusuk gecikme ve maliyetle girmek isteyen ekipler icin uygundur. Hizli multimodal yardimci akislar icin iyi secimdir. ## Qwen3-Vl-Flash-2025-10-15 (qwen/qwen3-vl-flash-2025-10-15) URL: /models/qwen/qwen3-vl-flash-2025-10-15 Provider: Qwen Context window: 256000 Operations: RESPONSES Modalities: text Pricing: starting: 0.050000 USD Summary: Hizli gorsel anlama ve OCR icin ekonomik Qwen VL modeli; tarihli snapshot surumu. Description: Qwen3-Vl-Flash-2025-10-15, gorsel anlama ve OCR tarafina daha dusuk gecikme ve maliyetle girmek isteyen ekipler icin uygundur. Hizli multimodal yardimci akislar icin iyi secimdir. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen3-Vl-Plus (qwen/qwen3-vl-plus) URL: /models/qwen/qwen3-vl-plus Provider: Qwen Context window: 256000 Operations: RESPONSES Modalities: text Pricing: starting: 0.020000 USD Summary: Zor belge sentezi ve gorsel reasoning icin ust seviye Qwen VL modeli. Description: Qwen3-Vl-Plus, Qwen tarafinda daha ust kalite isteyen vision-language gorevleri icin konumlanir. Gorsel reasoning, belge sentezi ve ekran goruntusu yorumunda daha guclu secenektir. ## Qwen3-Vl-Plus-2025-09-23 (qwen/qwen3-vl-plus-2025-09-23) URL: /models/qwen/qwen3-vl-plus-2025-09-23 Provider: Qwen Context window: 256000 Operations: RESPONSES Modalities: text Pricing: starting: 0.200000 USD Summary: Zor belge sentezi ve gorsel reasoning icin ust seviye Qwen VL modeli; tarihli snapshot surumu. Description: Qwen3-Vl-Plus-2025-09-23, Qwen tarafinda daha ust kalite isteyen vision-language gorevleri icin konumlanir. Gorsel reasoning, belge sentezi ve ekran goruntusu yorumunda daha guclu secenektir. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen3.5-122B-A10b (qwen/qwen3.5-122b-a10b) URL: /models/qwen/qwen3.5-122b-a10b Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.4 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 3.2 USD Summary: Genel sohbet, ozetleme ve yardimci akislar icin temel Qwen modeli. Description: Qwen3.5-122B-A10b, genel amacli metin gorevleri icin guclu bir temel modeldir; reasoning ve talimat takibinde dengeli performans sunar. Daha ozel coder veya VL varyantlarina cikmadan once genel kullanim icin mantiklidir. ## Qwen3.5-27B (qwen/qwen3.5-27b) URL: /models/qwen/qwen3.5-27b Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.3 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.4 USD Summary: Genel sohbet, ozetleme ve yardimci akislar icin temel Qwen modeli. Description: Qwen3.5-27B, genel amacli metin gorevleri icin guclu bir temel modeldir; reasoning ve talimat takibinde dengeli performans sunar. Daha ozel coder veya VL varyantlarina cikmadan once genel kullanim icin mantiklidir. ## Qwen3.5-35B-A3b (qwen/qwen3.5-35b-a3b) URL: /models/qwen/qwen3.5-35b-a3b Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.25 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2 USD Summary: Genel sohbet, ozetleme ve yardimci akislar icin temel Qwen modeli. Description: Qwen3.5-35B-A3b, genel amacli metin gorevleri icin guclu bir temel modeldir; reasoning ve talimat takibinde dengeli performans sunar. Daha ozel coder veya VL varyantlarina cikmadan once genel kullanim icin mantiklidir. ## Qwen3.5-397B-A17b (qwen/qwen3.5-397b-a17b) URL: /models/qwen/qwen3.5-397b-a17b Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.600000 USD Summary: Genel sohbet, ozetleme ve yardimci akislar icin temel Qwen modeli. Description: Qwen3.5-397B-A17b, genel amacli metin gorevleri icin guclu bir temel modeldir; reasoning ve talimat takibinde dengeli performans sunar. Daha ozel coder veya VL varyantlarina cikmadan once genel kullanim icin mantiklidir. ## Qwen3.5-Flash (qwen/qwen3.5-flash) URL: /models/qwen/qwen3.5-flash Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.01 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.4 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.125 USD Summary: Gunluk sohbet ve yuksek hacimli yardimcilar icin hizli Qwen modeli. Description: Qwen3.5-Flash, hizli yanit, dusuk gecikme ve yuksek hacimli kullanim icin optimize edilmis hafif bir modeldir. Basit yardimci akislar, otomasyon ve maliyet kontrollu urunler icin uygundur. ## Qwen3.5-Flash-2026-02-23 (qwen/qwen3.5-flash-2026-02-23) URL: /models/qwen/qwen3.5-flash-2026-02-23 Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.4 USD Summary: Gunluk sohbet ve yuksek hacimli yardimcilar icin hizli Qwen modeli; tarihli snapshot surumu. Description: Qwen3.5-Flash-2026-02-23, hizli yanit, dusuk gecikme ve yuksek hacimli kullanim icin optimize edilmis hafif bir modeldir. Basit yardimci akislar, otomasyon ve maliyet kontrollu urunler icin uygundur. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen3.5-Plus (qwen/qwen3.5-plus) URL: /models/qwen/qwen3.5-plus Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.040000 USD Summary: Uzun baglamli yardimcilar ve aracli urun akislari icin dengeli Qwen modeli. Description: Qwen3.5-Plus, guclu reasoning, uzun baglam ve arac kullanimi ile cok amacli gorevler icin dengeli bir genel modeldir. Tek modelle genis urun yuzeyi kapsamak isteyen ekipler icin iyi default olur. ## Qwen3.5-Plus-2026-02-15 (qwen/qwen3.5-plus-2026-02-15) URL: /models/qwen/qwen3.5-plus-2026-02-15 Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.400000 USD Summary: Uzun baglamli yardimcilar ve aracli urun akislari icin dengeli Qwen modeli; tarihli snapshot surumu. Description: Qwen3.5-Plus-2026-02-15, guclu reasoning, uzun baglam ve arac kullanimi ile cok amacli gorevler icin dengeli bir genel modeldir. Tek modelle genis urun yuzeyi kapsamak isteyen ekipler icin iyi default olur. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen3 32B (qwen/qwen3-32b-free) URL: /models/qwen/qwen3-32b-free Provider: Qwen Context window: 131072 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0 USD Summary: Reasoning, araç kullanımı ve yapılandırılmış çıktı için günlük kotayla ücretsiz Qwen modeli. Description: Qwen3 32B, adım adım düşünme (reasoning) yeteneğine sahip açık ağırlıklı bir modeldir. Genel sohbet, analiz, kod yardımı, function calling ve JSON formatında çıktı bekleyen ürün akışları için dengeli bir seçenektir. Günlük kullanım kotasıyla ücretsiz sunulur; kota dolduğunda istekler ertesi güne kadar sınırlandırılır. ## HappyHorse-1.0-T2V (alibaba/happyhorse-1.0-t2v) URL: /models/alibaba/happyhorse-1.0-t2v Provider: Alibaba Context window: 0 Operations: VIDEO_GENERATIONS Modalities: text, video Pricing: VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.14 USD; VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.24 USD Summary: Metinden kisa video uretimi icin Alibaba modeli. Description: HappyHorse-1.0-T2V, metin aciklamalarindan akici ve detayli kisa videolar uretmek icin kullanilir. 720P ve 1080P ciktiyi saniye bazli fiyatlandirir; urun sahneleri, reklam taslaklari ve yaratici video prototipleri icin uygundur. ## GLM-4.7 (zai/glm-4.7) URL: /models/zai/glm-4.7 Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.6 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.2 USD Summary: Kod üretimi, prototipleme ve arayüz işleri için güçlendirilmiş GLM modeli. Description: Cok adimli execution, yazilim gorevleri ve daha iyi frontend ciktilari ile onceki GLM nesillerine gore daha gucludur. Ozellikle kod uretimi ve prototiplemede dikkat ceker. ## GLM-4.7-FlashX (zai/glm-4.7-flashx) URL: /models/zai/glm-4.7-flashx Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.07 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.4 USD Summary: Hafif kod yardımı ve hızlı ürün entegrasyonları için GLM-4.7 FlashX. Description: Daha hafif coding yardimi, yardimci akislar ve hiz odakli urun entegrasyonlari icin mantiklidir. GLM-4.7 davranisini daha dusuk maliyetle sunar. ## GLM-4.6 (zai/glm-4.6) URL: /models/zai/glm-4.6 Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.6 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.2 USD Summary: Günlük sohbet, analiz ve yardımcı akışlar için oturmuş GLM modeli. Description: Gundelik sohbet, analiz ve yardimci urun akislarinda dengeli davranir. En yeni seri kadar iddiali olmasa da stabil bir genel model arayan ekipler icin uygundur. ## GLM-4.5 (zai/glm-4.5) URL: /models/zai/glm-4.5 Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.6 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.2 USD Summary: Araç çağrıları ve yazılım ajanları için reasoning odaklı GLM modeli. Description: Tool invocation, web benzeri akislar ve yazilim muhendisligi islerinde guclu bir agent temelidir. Dusunen veya hizli modlar arasinda denge kurabilen ekipler icin esnektir. ## GLM-4.5-X (zai/glm-4.5-x) URL: /models/zai/glm-4.5-x Provider: Z.AI Context window: 96000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2.2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 8.9 USD Summary: Daha yuksek performans ve hiz isteyenler icin GLM-4.5-X. Description: GLM-4.5 ailesinde daha agresif performans arayan ekipler icin konumlanir. Zor reasoning ve hizli donuslerin birlikte onemli oldugu islerde iyi secimdir. ## GLM-4.5-Air (zai/glm-4.5-air) URL: /models/zai/glm-4.5-air Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.1 USD Summary: Kod, reasoning ve araç kullanımı için hafif GLM-4.5 agent modeli. Description: Kod, reasoning ve arac kullanimi isteyen ama maliyeti daha siki kontrol etmek isteyen ekipler icin uygundur. Ailenin butce dostu giris kapisidir. ## GLM-4.5-AirX (zai/glm-4.5-airx) URL: /models/zai/glm-4.5-airx Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 4.5 USD Summary: Dengeli hiz ve kalite icin GLM-4.5-AirX. Description: Air varyantina gore daha iddiali ama hala hafif bir secenek sunar. Orta zorluktaki agent ve coding gorevlerinde iyi fiyat-performans verir. ## GLM-4-32B-0414-128K (zai/glm-4-32b-0414-128k) URL: /models/zai/glm-4-32b-0414-128k Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.1 USD Summary: Basit sohbet ve temel özetleme için en ekonomik GLM modellerinden biri. Description: Basit sohbet, temel ozetleme ve maliyetin baskin oldugu akislar icin uygundur. Daha zor reasoning veya ajan gorevleri icin ust GLM serilerine cikmak gerekir. ## GLM-4.6V (zai/glm-4.6v) URL: /models/zai/glm-4.6v Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.3 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.9 USD Summary: Gorsel anlama icin dengeli Z.AI vision modeli. Description: Resim, belge ve ekran goruntusu yorumlama gibi gorevlerde genel amacli vision secenegi sunar. GLM-5V kadar iddiali olmayan ama daha erisilebilir bir katmandir. ## GLM-OCR (zai/glm-ocr) URL: /models/zai/glm-ocr Provider: Z.AI Context window: 32000 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.03 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.03 USD Summary: Belge ve gorsellerden metin cikarmak icin odakli GLM OCR modeli. Description: Metin cikarma, duzen okuma ve belge isleme odakli sistemlerde en dogrudan secenektir. Genel sohbetten cok veri cikarma islerinde anlamlidir. ## GLM-4.6V-FlashX (zai/glm-4.6v-flashx) URL: /models/zai/glm-4.6v-flashx Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.04 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.4 USD Summary: Gorsel isler icin dusuk maliyetli FlashX secenegi. Description: Temel gorsel anlama ve belge okumayi uygun maliyetle sunar. Vision tarafinda hiz ve butce oncelikli urunler icin mantiklidir. ## GLM-4.5V (zai/glm-4.5v) URL: /models/zai/glm-4.5v Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.6 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.8 USD Summary: Image, video ve GUI gorevleri icin guclu reasoning odakli vision modeli. Description: Gorsel reasoning, belge anlama ve arayuz gorevlerinde daha yuksek kalite isteyen ekipler icin uygundur. Multimodal analizde onceki GLM vision katmanlarina gore daha iddiali davranir. ## DeepSeek Chat (deepseek/deepseek-chat) URL: /models/deepseek/deepseek-chat Provider: DeepSeek Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.14 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.0028 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.28 USD Summary: Eski DeepSeek entegrasyonları için V4-Flash non-thinking kimliği. Description: `deepseek-chat` resmi API'de DeepSeek-V4-Flash non-thinking moduna map edilir. Mevcut entegrasyonlari kirmamak icin listede tutulur; yeni projelerde `deepseek-v4-flash` tercih edin. Fiyatlandirmasi V4-Flash ile birebir aynidir; duyurulan yogun saat carpani da ayni sekilde gecerlidir. ## DeepSeek R1 (deepseek/deepseek-reasoner) URL: /models/deepseek/deepseek-reasoner Provider: DeepSeek Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.14 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.0028 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.28 USD Summary: Eski DeepSeek reasoning entegrasyonları için V4-Flash thinking kimliği. Description: `deepseek-reasoner` resmi API'de DeepSeek-V4-Flash thinking moduna map edilir. Yeni entegrasyonlarda `deepseek-v4-flash` ile thinking yapilandirmasini kullanin. Fiyatlandirmasi V4-Flash ile birebir aynidir; duyurulan yogun saat carpani da ayni sekilde gecerlidir. ## Magistral Medium 1.2 (mistral/magistral-medium-latest) URL: /models/mistral/magistral-medium-latest Provider: Mistral Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 5 USD Summary: Alan uzmanlığı gerektiren analizler için en güçlü Magistral modeli. Description: Seffaf dusunme, cok dilli reasoning ve alan bilgisi agirlikli islerde gucludur. Analiz kalitesini hizdan onde tutan ekipler icin Mistral'in reasoning odakli premium secenegidir. ## Sonar Deep Research (perplexity/sonar-deep-research) URL: /models/perplexity/sonar-deep-research Provider: Perplexity Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 8 USD; CHAT_COMPLETIONS/CITATION_TOKENS/PER_1M_TOKENS: 2 USD; CHAT_COMPLETIONS/REASONING_TOKENS/PER_1M_TOKENS: 3 USD; CHAT_COMPLETIONS/SEARCH_QUERY/PER_1K_CALLS: 5 USD Summary: Otonom arastirma ve kapsamli raporlar icin Sonar modeli. Description: Yuzlerce kaynagi tarayip alintili, uzun arastirma ciktilari uretmek icin tasarlanmistir. Kisa cevaplardan cok detayli briefing, rapor ve pazar arastirmasi isteyen ekipler icin uygundur. ## Magistral Small 1.2 (mistral/magistral-small-latest) URL: /models/mistral/magistral-small-latest Provider: Mistral Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.5 USD Summary: Maliyet kontrollü alan analizleri için hafif Magistral modeli. Description: Alan odakli analiz ve mantik gorevlerinde Magistral davranisini daha dusuk maliyetle sunar. Reasoning isteyen ama premium tier'a cikmak istemeyen ekipler icin mantiklidir. ## PPLX Embed v1 0.6B (perplexity/pplx-embed-v1-0.6b) URL: /models/perplexity/pplx-embed-v1-0.6b Provider: Perplexity Context window: 32000 Operations: EMBEDDINGS Modalities: text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.004 USD Summary: Bagimsiz metinler icin uygun maliyetli standart embedding modeli. Description: Semantik arama, basit RAG ve kisa metin benzerligi islerinde butce dostu secenektir. Maliyet oncelikliyse iyi bir temel embedding tercihidir. ## PPLX Embed v1 4B (perplexity/pplx-embed-v1-4b) URL: /models/perplexity/pplx-embed-v1-4b Provider: Perplexity Context window: 32000 Operations: EMBEDDINGS Modalities: text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.03 USD Summary: Daha doğru semantik arama ve RAG için yüksek kaliteli embedding modeli. Description: Daha iyi semantik ayrim ve retrieval kalitesi istendiginde 0.6B varyantinin ustune cikar. Kaliteyi butcenin biraz onune koyan arama sistemleri icin uygundur. ## Devstral Small 2 (mistral/devstral-small-latest) URL: /models/mistral/devstral-small-latest Provider: Mistral Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.3 USD Summary: Kod ajanlari icin hafif ve acik kaynak odakli secenek. Description: Daha kucuk butceli coding yardimcilari ve otomasyonlarda verimli calisir. Devstral ailesinin daha erisilebilir ve hizli varyantidir. ## PPLX Embed Context v1 0.6B (perplexity/pplx-embed-context-v1-0.6b) URL: /models/perplexity/pplx-embed-context-v1-0.6b Provider: Perplexity Context window: 32000 Operations: EMBEDDINGS Modalities: text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.008 USD Summary: Dokuman chunk'lari icin baglam farkindali embedding modeli. Description: Ayni dokumandaki bolumlerin birbirine bagli okunmasi gereken RAG senaryolarinda faydalidir. Paragraf duzeyinde retrieval isteyen belge sistemleri icin uygundur. ## Codestral (mistral/codestral-latest) URL: /models/mistral/codestral-latest Provider: Mistral Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.3 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.9 USD Summary: Kod tamamlama ve FIM isleri icin saf kod modeli. Description: Kod uretimi, tamamlama ve editor entegrasyonlari icin odakli bir secenektir. Genel sohbetten cok yazilim gelistirme akislarinda deger uretir. ## PPLX Embed Context v1 4B (perplexity/pplx-embed-context-v1-4b) URL: /models/perplexity/pplx-embed-context-v1-4b Provider: Perplexity Context window: 32000 Operations: EMBEDDINGS Modalities: text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.05 USD Summary: Belge tabanli retrieval icin yuksek kaliteli baglamsal embedding. Description: Daha buyuk ve daha kaliteli contextualized embedding isteyen belge agirlikli sistemler icin gucludur. Buyuk RAG kurulumlarinda kalite odakli secimdir. ## Pixtral Large (mistral/pixtral-large-latest) URL: /models/mistral/pixtral-large-latest Provider: Mistral Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 6 USD Summary: Belge, ekran ve görsel analiz için premium Pixtral modeli. Description: Ekran goruntusu, belge ve gorsel analiz gerektiren daha agir gorevlerde gucludur. Mistral ekosisteminde vision agirlikli premium secenek arayan ekipler icin uygundur. ## Pixtral 12B (mistral/pixtral-12b) URL: /models/mistral/pixtral-12b Provider: Mistral Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.15 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.15 USD Summary: Gorsel anlama icin daha hafif Pixtral secenegi. Description: Resim yorumlama, temel OCR benzeri anlama ve daha hizli multimodal yardimci akislarda verimli calisir. Vision tarafina dusuk maliyetle girmek icin uygundur. ## Ministral 3 14B (mistral/ministral-14b-latest) URL: /models/mistral/ministral-14b-latest Provider: Mistral Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.2 USD Summary: Kenar veya ozel dagitimlar icin guclu Ministral modeli. Description: Boyutunu makul tutarken metin ve gorsel yetenekte iyi kalite sunar. Daha kisitli kaynaklarla saglam genel performans isteyen dagitimlar icin mantiklidir. ## Ministral 3 8B (mistral/ministral-8b-latest) URL: /models/mistral/ministral-8b-latest Provider: Mistral Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.15 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.15 USD Summary: Edge yardımcıları ve düşük kaynaklı otomasyonlar için orta boy Ministral modeli. Description: Gecikme ve kaynak kullanimini daha iyi kontrol etmek isteyen ekipler icin uygun orta nokta sunar. Edge, ozel hosting ve maliyet kontrollu urunlerde iyi calisir. ## Ministral 3 3B (mistral/ministral-3b-latest) URL: /models/mistral/ministral-3b-latest Provider: Mistral Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.1 USD Summary: Hafif dagitimlar icin en kucuk Ministral secenegi. Description: En dusuk kaynakla calisan yardimci, otomasyon ve yerel deneyler icin uygundur. Kalite tavani buyuk modellere gore daha dusuktur ama dagitim esnekligi yuksektir. ## Voxtral Small (mistral/voxtral-small-latest) URL: /models/mistral/voxtral-small-latest Provider: Mistral Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.3 USD Summary: Transkripsiyon ve sesli yardımcılar için Mistral'in güçlü ses modeli. Description: Ses girdisini anlamlandirma, transkripsiyon ve ses tabanli yardimci akislarda daha guclu secenektir. Ses odakli urunlerde genel text model kullanmaktan daha mantiklidir. ## Voxtral Mini (mistral/voxtral-mini-latest) URL: /models/mistral/voxtral-mini-latest Provider: Mistral Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.04 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.04 USD Summary: Düşük gecikmeli ses tanıma ve voice UX için hafif Voxtral modeli. Description: Cihaz yakininda, daha dusuk gecikme isteyen ses tanima veya sesli yardimci deneylerinde verimli davranir. Ses tarafinda maliyet ve hiz onceligini dengeler. ## Recraft V4 Vector (recraft/recraft-v4-vector) URL: /models/recraft/recraft-v4-vector Provider: Recraft Context window: 10000 Operations: IMAGES_GENERATIONS Modalities: image, text Pricing: IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.08 USD Summary: Vector logo, ikon ve illüstrasyon için güncel Recraft modeli. Description: Ölçeklenebilir grafik çıktısı isteyen tasarım ekipleri için uygundur. Logo, ikon seti ve düz illüstrasyon işlerinde raster modellerden daha doğrudan değer üretir. ## Recraft V4 Pro Vector (recraft/recraft-v4-pro-vector) URL: /models/recraft/recraft-v4-pro-vector Provider: Recraft Context window: 10000 Operations: IMAGES_GENERATIONS Modalities: image, text Pricing: IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.3 USD Summary: En yüksek kontrollü vector üretim için Recraft V4 Pro Vector. Description: Daha temiz çizgiler, daha güçlü komut takibi ve premium tasarım çıktısı isteyen ekipler için uygundur. Marka sistemi ve teslim kalitesi yüksek vector işlerinde öne çıkar. ## Recraft V3 (recraft/recraft-v3) URL: /models/recraft/recraft-v3 Provider: Recraft Context window: 1000 Operations: IMAGES_GENERATIONS Modalities: image, text Pricing: IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.04 USD Summary: Erişilebilir görsel üretim ve olgun davranış için önceki Recraft raster modeli. Description: Güncel V4 çizgisine çıkmadan önce daha olgun ve sade bir Recraft davranışı isteyen ekipler için hâlâ anlamlı olabilir. Genel görsel üretim işlerinde erişilebilir bir seçenektir. ## Recraft V3 Vector (recraft/recraft-v3-vector) URL: /models/recraft/recraft-v3-vector Provider: Recraft Context window: 1000 Operations: IMAGES_GENERATIONS Modalities: image, text Pricing: IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.08 USD Summary: Önceki nesil vector üretim için Recraft modeli. Description: Vector illüstrasyon ve grafik çıktıda daha eski nesil ama erişilebilir bir seçenek sunar. Güncel V4 Vector'a çıkmadan önce maliyet ve alışılmış davranış isteyen ekipler için uygundur. ## Recraft V2 (recraft/recraft-v2) URL: /models/recraft/recraft-v2 Provider: Recraft Context window: 1000 Operations: IMAGES_GENERATIONS Modalities: image, text Pricing: IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.022 USD Summary: Hafif yaratıcı işler ve eski entegrasyonlar için Recraft raster modeli. Description: Eski entegrasyonlar ve daha hafif yaratıcı işlerde yeterli olabilir. En yeni kalite çıtasını istemeyen sistemlerde maliyet ve uyumluluk odaklı bir seçenek olarak anlamlıdır. ## Recraft V2 Vector (recraft/recraft-v2-vector) URL: /models/recraft/recraft-v2-vector Provider: Recraft Context window: 1000 Operations: IMAGES_GENERATIONS Modalities: image, text Pricing: IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.044 USD Summary: Temel logo, ikon ve düz illüstrasyon üretimi için Recraft vector modeli. Description: Temel vector üretiminde daha eski ama bütçe dostu bir katman sunar. Yeni kurulumlardan çok mevcut tasarım entegrasyonlarını korumak için mantıklıdır. ## Apertus v1.5 8B Thinking (publicai/apertus-v1.5-8b-thinking) URL: /models/publicai/apertus-v1.5-8b-thinking Provider: PublicAI Context window: 262144 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.2 USD Summary: Kapatılabilir adım adım düşünme, görsel okuma ve 262K bağlam sunan Apertus modeli. Description: Apertus v1.5 8B Thinking, yanıtı vermeden önce adım adım düşünen bir muhakeme modelidir. Düşünme adımları yanıtın içine karışmaz; ayrı bir alanda döner. Matematik, mantık soruları, çok adımlı analiz ve dikkatli okuma gerektiren görevlerde standart 8B sürümünden daha isabetli sonuç verir. Düşünme varsayılan olarak açıktır; gerekmediğinde model kimliğine `:fast` ekleyerek (`publicai/apertus-v1.5-8b-thinking:fast`) veya istek gövdesinde `reasoning: false` göndererek kapatılabilir. Kapalıyken yanıtlar belirgin biçimde kısalır ve daha az çıktı tokenı harcar. Metin ve görsel girdiyi işler, 262.144 token bağlam penceresi sunar ve JSON formatında çıktı üretebilir. Bu sürüm araç çağırmayı (function calling) desteklemez; araç kullanan akışlar için Apertus v1.5 8B tercih edilmelidir. Görseller yalnızca base64 data URL olarak gönderilir. ## Apertus 8B Instruct (publicai/apertus-8b-instruct) URL: /models/publicai/apertus-8b-instruct Provider: PublicAI Context window: 65536 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.2 USD Summary: Genel sohbet, ozetleme ve hafif otomasyon icin Apertus 8B modeli. Description: Apertus 8B Instruct, genel amacli metin isleri icin kullanilabilen acik agirlikli bir instruction modelidir. Kisa sohbetler, ozetleme, siniflandirma, veri donusumu ve hafif otomasyon akislarinda pratik bir secenek sunar. Chat Completions ve function calling kullanan uygulamalarla uyumludur. ## Apertus 70B Instruct (publicai/apertus-70b-instruct) URL: /models/publicai/apertus-70b-instruct Provider: PublicAI Context window: 65536 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.82 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.92 USD Summary: Genel metin uretimi, analiz ve yapilandirilmis cikti icin Apertus 70B. Description: Apertus 70B Instruct, genel amacli metin uretimi, analiz, cok dilli yardimci akislar ve yapilandirilmis cikti gerektiren uygulamalar icin kullanilabilen acik agirlikli bir instruction modelidir. Sohbet, bilgi sentezi, icerik taslagi, kod yardimi ve JSON formatinda cevap bekleyen urun akislarinda tercih edilebilir. Chat Completions, function calling ve JSON mode kullanan entegrasyonlarla uyumludur. ## MiniMax M2.7 Highspeed (minimax/minimax-m2.7-highspeed) URL: /models/minimax/minimax-m2.7-highspeed Provider: MiniMax Context window: 204800 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.6 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.06 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.4 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.375 USD Summary: Daha dusuk gecikmeli kod ve ajan isleri icin MiniMax M2.7 varyanti. Description: MiniMax M2.7 Highspeed, M2.7 davranisini daha hizli cevap suresiyle isteyen ekipler icindir. Kod yardimi, refactor, canli debug ve interaktif ajan deneyimlerinde gecikme daha kritik oldugunda tercih edilir; ayni 204.800 token baglam penceresini korur. ## MiniMax M2.5 (minimax/minimax-m2.5) URL: /models/minimax/minimax-m2.5 Provider: MiniMax Context window: 204800 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.3 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.03 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.2 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.375 USD Summary: Kod uretimi ve refactor isleri icin dengeli MiniMax M2 modeli. Description: MiniMax M2.5, kod uretimi, refactor, teknik yardim ve genel metin tabanli urun akislarinda fiyat-performans dengesi arayan ekipler icin uygundur. 204.800 token baglam penceresiyle uzun talimatlari ve buyuk proje baglamlarini tasiyabilir. ## MiniMax M2.5 Highspeed (minimax/minimax-m2.5-highspeed) URL: /models/minimax/minimax-m2.5-highspeed Provider: MiniMax Context window: 204800 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.6 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.03 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.4 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.375 USD Summary: Hiz oncelikli kod yardimi ve refactor icin MiniMax M2.5 varyanti. Description: MiniMax M2.5 Highspeed, M2.5 ailesinin daha hizli inference varyantidir. Editor yardimi, kisa refactor donguleri, hizli teknik cevaplar ve gecikme hassas chat deneyimleri icin anlamlidir; 204.800 token baglam penceresini korur. ## Llama 3.1 8B (meta/llama-3.1-8b) URL: /models/meta/llama-3.1-8b Provider: Meta Context window: 131072 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0 USD Summary: Hafif metin işleri ve hızlı denemeler için günlük kotayla ücretsiz küçük Llama modeli. Description: Llama 3.1 8B, kısa sohbet, sınıflandırma, veri dönüşümü ve hafif otomasyon gibi düşük gecikme isteyen metin işleri için küçük bir açık ağırlıklı modeldir. JSON formatında çıktı destekler; prototip ve deneme akışlarında pratik bir başlangıç noktasıdır. Günlük kullanım kotasıyla ücretsiz sunulur. ## Nemotron 3 Super 120B A12B (nvidia/nemotron-3-super-120b-a12b) URL: /models/nvidia/nemotron-3-super-120b-a12b Provider: NVIDIA Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0 USD Summary: Uzun bağlam ve araç kullanımı için dengeli, günlük kotayla ücretsiz Nemotron modeli. Description: Nemotron 3 Super (120B toplam, 12B aktif parametre), 1M token bağlam penceresi sunan dengeli bir açık ağırlıklı modeldir. Genel sohbet, özetleme, kod yardımı, function calling ve JSON formatında çıktı bekleyen ürün akışları için uygundur. Günlük kullanım kotasıyla ücretsiz sunulur. ## Nemotron 3 Nano 30B A3B (nvidia/nemotron-3-nano-30b-a3b) URL: /models/nvidia/nemotron-3-nano-30b-a3b Provider: NVIDIA Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0 USD Summary: Hızlı yardımcı akışlar ve hafif otomasyon için günlük kotayla ücretsiz Nemotron modeli. Description: Nemotron 3 Nano (30B toplam, 3B aktif parametre), düşük gecikmeli yardımcı akışlar için tasarlanmış hafif bir açık ağırlıklı modeldir. Sınıflandırma, veri dönüşümü, kısa sohbet, function calling ve JSON çıktı gerektiren hafif otomasyon işlerinde pratik bir seçenektir. Günlük kullanım kotasıyla ücretsiz sunulur. ## Nemotron Nano 12B V2 VL (nvidia/nemotron-nano-12b-v2-vl) URL: /models/nvidia/nemotron-nano-12b-v2-vl Provider: NVIDIA Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0 USD Summary: Görsel girdili işler için günlük kotayla ücretsiz Nemotron vision modeli. Description: Nemotron Nano 12B V2 VL, metinle birlikte görsel girdi kabul eden açık ağırlıklı bir vision-language modelidir. Görsel açıklama, ekran görüntüsü okuma, doküman görseli analizi ve function calling kullanan multimodal akışlar için uygundur. Günlük kullanım kotasıyla ücretsiz sunulur. ## Step 3.5 Flash (stepfun/step-3.5-flash) URL: /models/stepfun/step-3.5-flash Provider: StepFun Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.02 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.3 USD Summary: Uzun baglamli, metin odakli StepFun chat ve reasoning modeli. Description: Step 3.5 Flash, metin tabanli chat, kod yardimi, bilgi sentezi ve uzun baglamli asistan akislari icin konumlanan StepFun modelidir. Chat Completions, tool calling ve JSON mode destekler; controllable reasoning_effort capability'si bu varyantta acik edilmez. ## Step 3.5 Flash 2603 (stepfun/step-3.5-flash-2603) URL: /models/stepfun/step-3.5-flash-2603 Provider: StepFun Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.02 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.3 USD Summary: Metin analizi, kod ve kontrollu reasoning icin Step 3.5 Flash varyanti. Description: Step 3.5 Flash 2603, Step 3.5 Flash ailesinin controllable reasoning varyantidir. Metin tabanli Chat Completions, tool calling ve JSON mode destekler; reasoning_effort low ve high seviyeleriyle hiz/derinlik tercihi istek parametreleriyle secilebilir. ## AionLabs: Aion 2.5 (aion-labs/aion-2.5) URL: /models/aion-labs/aion-2.5 Provider: AionLabs Context window: 131072 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.35 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 3 USD Summary: Dogal diyalog ve karakter sesi isteyen roleplay uygulamalari icin Aion modeli. Description: Aion 2.5, Aion 2.0'a gore daha dogal cevap akisi ve daha hizli donus hedefleyen roleplay odakli modeldir. Karakter sesini koruma, sahne ici gerilim kurma, uzun sohbetlerde ton devam ettirme ve yaratici metin uretme islerinde kullanilir. 128K context, 32K maksimum cikti ve cache-read fiyatlandirmasi destekler. ## AionLabs: Aion 2.0 (aion-labs/aion-2.0) URL: /models/aion-labs/aion-2.0 Provider: AionLabs Context window: 131072 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.8 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.6 USD Summary: Kontrollu reasoning ile roleplay ve hikaye uretimi icin Aion modeli. Description: Aion 2.0, DeepSeek V3.2 tabanli roleplay ve hikaye uretimi modeli olarak uzun karakter diyaloglari, gerilimli sahne ilerleyisi ve daha koyu temalari isleyen yaratici akislarda kullanilir. Aion API bu modelde none, low, medium ve high reasoning_effort seviyelerini destekler; LLMTR'de suffix veya body alaniyla kontrol edilebilir. 128K context, 32K maksimum cikti ve cache-read fiyatlandirmasi destekler. ## AionLabs: Aion-RP 1.0 (8B) (aion-labs/aion-rp-llama-3.1-8b) URL: /models/aion-labs/aion-rp-llama-3.1-8b Provider: AionLabs Context window: 32768 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.8 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.6 USD Summary: Kisa ve orta uzunlukta roleplay sohbetleri icin Llama 3.1 8B tabanli model. Description: Aion-RP 1.0 (8B), Llama 3.1 8B tabanli roleplay modelidir. Daha kucuk context penceresiyle kisa ve orta uzunlukta karakter sohbetleri, NPC yanitlari, yaratici denemeler ve maliyeti ongorulebilir roleplay akislari icin uygundur. 32K context ve 32K maksimum cikti destekler; cache-read veya controllable reasoning capability'si kataloglanmaz. ## Grok 4.20 Multi-Agent (xai/grok-4.20-multi-agent) URL: /models/xai/grok-4.20-multi-agent Provider: xAI Context window: 2000000 Operations: RESPONSES Modalities: text Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 1.25 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 2.5 USD Summary: Araştırma akışları için çok ajanlı Grok modeli. Description: Birden fazla alt görevi paralel yürütüp daha kapsamlı araştırma çıktısı üretmek isteyen ekipler için konumlanır. Kısa yanıtlardan çok derin tarama, sentez ve briefing hazırlığında öne çıkar. ## Grok 4.20 Reasoning 0309 (xai/grok-4.20-0309-reasoning) URL: /models/xai/grok-4.20-0309-reasoning Provider: xAI Context window: 2000000 Operations: RESPONSES Modalities: text Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 1.25 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 2.5 USD Summary: Derin düşünme gerektiren işler için Grok reasoning modeli. Description: Daha zor analiz, karşılaştırma ve çok adımlı problem çözme senaryolarında daha dikkatli çıktı üretmek isteyen ekipler için uygundur. Hızdan çok muhakeme kalitesine öncelik verir. ## Grok 4.20 Non-Reasoning 0309 (xai/grok-4.20-0309-non-reasoning) URL: /models/xai/grok-4.20-0309-non-reasoning Provider: xAI Context window: 2000000 Operations: RESPONSES Modalities: text Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 1.25 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 2.5 USD Summary: Hızlı genel metin işleri için Grok varyantı. Description: Sohbet, özetleme ve günlük ürün akışlarında reasoning sürümüne göre daha hızlı dönüş verir. Daha hafif görevlerde maliyet ve gecikmeyi kontrol etmek isteyen ekipler için uygundur. ## Grok Imagine Image (xai/grok-imagine-image) URL: /models/xai/grok-imagine-image Provider: xAI Context window: 0 Operations: IMAGES_GENERATIONS Modalities: image, text Pricing: IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.02 USD Summary: Günlük görsel üretim ve düzenleme için Grok Imagine modeli. Description: Metinden görsel üretimi ve konuşmalı düzenleme işlerinde erişilebilir bir xAI görsel katmanı sunar. Hızlı yaratıcı iterasyon ve genel ürün görseli akışlarında uygundur. ## Grok Imagine Image Quality (xai/grok-imagine-image-quality) URL: /models/xai/grok-imagine-image-quality Provider: xAI Context window: 0 Operations: IMAGES_GENERATIONS Modalities: image, text Pricing: IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.04 USD Summary: Premium görsel üretim ve daha sıkı komut takibi için Grok Imagine modeli. Description: Daha ayrıntılı ve kontrollü görsel sonuçlar isteyen ekipler için standart Imagine sürümünün üstünde konumlanır. Premium yaratıcı çıktı beklentisi olan akışlarda daha anlamlıdır. ## Grok Imagine Video (xai/grok-imagine-video) URL: /models/xai/grok-imagine-video Provider: xAI Context window: 0 Operations: VIDEO_GENERATIONS Modalities: video, text Pricing: VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.05 USD Summary: Prompt tabanlı video üretimi için Grok Imagine modeli. Description: Yaratıcı video denemeleri, tanıtım sahneleri ve kısa konsept anlatımları üretmek isteyen ekipler için uygundur. Metinden videoya üretim gerektiren akışlarda xAI tarafındaki doğrudan seçenektir. ## Grok Voice TTS (xai/grok-voice-tts) URL: /models/xai/grok-voice-tts Provider: xAI Context window: 100000 Operations: AUDIO_SPEECH Modalities: text, audio Pricing: AUDIO_SPEECH/INPUT_TEXT/PER_1M_CHARACTERS: 4.2 USD Summary: Metinden sese dönüşüm için Grok Voice modeli. Description: Uygulama içi seslendirme, okuma ve yardımcı ses akışlarında yazıyı doğal sese çevirmek için uygundur. Voice UX eklemek isteyen ürün ekipleri için pratik bir temel sunar. ## Grok Voice STT (xai/grok-voice-stt) URL: /models/xai/grok-voice-stt Provider: xAI Context window: 0 Operations: AUDIO_TRANSCRIPTIONS Modalities: audio, text Pricing: AUDIO_TRANSCRIPTIONS/INPUT_AUDIO/PER_HOUR: 0.1 USD Summary: Ses dosyalarını metne çevirmek için Grok Voice modeli. Description: Konuşma çözümleme, not çıkarma ve ses girişini yazıya dönüştüren ürün akışlarında kullanılır. Genel sesli arayüzlerde temel speech-to-text ihtiyacını karşılar. ## Perceptron Mk1 (perceptron/perceptron-mk1) URL: /models/perceptron/perceptron-mk1 Provider: Perceptron Context window: 32000 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.15 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.5 USD Summary: Gorsel ve video anlama icin Perceptron vision-language modeli. Description: Perceptron Mk1, gorsel ve video girdilerini anlamak icin kullanilan bir vision-language modelidir. Gorsel soru-cevap, OCR benzeri metin okuma, nesne konumlama, aciklama uretimi ve zamana yayilan video analizi gibi islerde gorsel kanit uzerinden reasoning gerektiren ekipler icin uygundur.