# LLMTR Full Model Catalog Generated for search and AI retrieval. Internal links are origin-relative and contain only public catalog data. Brand assets, colour tokens, and logo usage rules for this platform are published separately at /design.md. ## About LLMTR LLMTR is an OpenAI-compatible LLM gateway that serves Turkey-hosted and global models from one catalog, one API key, and one usage and billing surface. Every model below is reachable at /v1 by changing only the base URL and the model identifier. It fits organisations that need language models alongside data-control and auditability requirements: public institutions and local government, law firms and in-house legal teams, financial institutions, and other data-sensitive sectors such as health, defence supply chain, and critical infrastructure operators. Data-control properties: user prompts and model response bodies are not written to the usage and billing database; customer API keys are stored as SHA-256 hashes; provider keys are held only in environment variables; models marked as Turkey-hosted run on LLMTR infrastructure located in Turkey. Model unit prices below are catalog values and are not marked up; an 8% platform margin applies to credit top-ups only. ## Gemma 4 (llmtr/gemma-4) URL: /models/llmtr/gemma-4 Provider: LLMTR Context window: 131072 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 5 USD Summary: Türkiye'de barindirilan Gemma 4; 128K baglam, gorsel girdi ve arac cagrisi. Description: Türkiye'de barindirilan birinci taraf modeldir; istemleriniz ucuncu taraf rotaya cikmadan islenir. 128K baglam, gorsel girdi ve function calling destekler, bu yuzden kurum ici yardimci, dokuman analizi ve arac kullanan ajan akislarinda yerli bir default olarak kullanilabilir. Gorselleri base64 `data:image/...` biciminde gonderin; uzak https adresleri desteklenmez. Tekrar eden istemler onek onbelleginden indirimli ve cok daha hizli doner. Model kendi donanimimizda calisir ve kapasitesi paylasimlidir. Kutu bostayken 256 tokenlik bir cikti yaklasik 8 saniyede doner (saniyede ~30 token); yogun saatlerde ayni is birkac kat uzayabilir, uretim ortalamasi saniyede ~7 tokendir. Uzun istemler ek maliyet getirir: 20.000 tokenlik ve onbellege girmemis bir istem, cevap uretilmeden once tek basina ~45 saniye harcar; ayni istemin tekrari onek onbelleginden hem indirimli hem cok daha hizli doner. Bu yuzden `stream: true` kullanin, gerekmedigi durumlarda `max_tokens` ile ciktiyi sinirlayin ve istemci okuma zaman asiminizi en az 300 saniyeye cikarin; cogu HTTP istemcisinin 60 saniyelik varsayilani bu modelde yetersiz kalir. ## Qwen 3.6 35B-A3B (llmtr/qwen3-6-35b) URL: /models/llmtr/qwen3-6-35b Provider: LLMTR Context window: 262144 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 5 USD Summary: Türkiye'de barindirilan kod ve mantik agirlikli isler icin yerli Qwen modeli. Description: Türkiye'de barindirilan bu MoE model, Gemma 4'e gore daha agir kod ve mantik islerinde guclu bir alternatif sunar. Veri egemenligini korurken daha derin analiz isteyen ekipler icin uygundur. Uretim hizi saniyede yaklasik 8 tokendir ve model uzun yanitlar uretme egilimindedir: 1000 tokeni asan ciktilar iki dakikanin uzerine cikar. Bu modelde `stream: true` kullanmanizi, istemci okuma zaman asimini en az 300 saniyeye cikarmanizi ve gerekmeyen durumlarda `max_tokens` ile yanit uzunlugunu sinirlamanizi oneririz. ## Trendyol Asure 12B (llmtr/trendyol-asure-12b) URL: /models/llmtr/trendyol-asure-12b Provider: LLMTR Context window: 40960 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.025 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.5 USD Summary: Turkce sohbet, RAG chatbot ve e-ticaret metin isleri icin Turkiye'de barindirilan, gorsel okuyabilen 12B model. Description: Trendyol Asure 12B, Trendyol tarafindan uretilen ve Turkiye'de barindirilan 12B sohbet modelidir. 40.960 tokenlik baglam penceresiyle Turkce sohbet, RAG chatbot, musteri destek yardimcilari, e-ticaret bilgi akislari, ozetleme, urun aciklamasi ve kategori/etiket isleri icin uygundur. Gorselleri okuyabilir: gorsel girdi base64 data URL olarak gonderilir, uzak gorsel URL'leri kabul edilmez. Tekrar eden istem baslangiclari onbellekten karsilanir ve daha dusuk cache fiyatindan faturalanir. Ses ve video girdisi, gorsel uretimi ve arac cagirma desteklenmez. ## Magibu 11B v8 (llmtr/magibu-11b-v8) URL: /models/llmtr/magibu-11b-v8 Provider: LLMTR Context window: 8192 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.5 USD Summary: Turkce sohbet ve yardimci akislar icin Magibu ekibi tarafindan gelistirilmis 11B LLMTR modeli. Description: Magibu 11B v8, Magibu ekibi tarafindan gelistirilmis Turkce'ye ozel bir LLMTR modelidir. OpenAI uyumlu Chat Completions semasiyla sohbet, ozetleme, taslak uretimi, siniflandirma ve genel yardimci akislarinda kullanilir. Bu endpoint text-only calisir; gorsel, ses ve video girdisi desteklenmez. Model detaylari: https://huggingface.co/magibu/magibu-11b-v0.8 ## Muse Glimmer 30B (Türkiye) (llmtr/muse-glimmer-30b-tr) URL: /models/llmtr/muse-glimmer-30b-tr Provider: LLMTR Context window: 131072 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 5 USD Summary: Verilerin Türkiye'de işlenmesi gereken ajan ve akıl yürütme işleri için 128K bağlamlı, görsel okuyabilen 30B model. Description: LLMTR Muse Glimmer 30B, Meta'nın Apache 2.0 lisansıyla yayınladığı açık ağırlıklı modelin Türkiye'de barındırdığımız sürümüdür. OpenAI uyumlu Chat Completions şemasıyla çağrılır; istekleriniz üçüncü taraf bir sağlayıcıya yönlendirilmez. 131.072 tokenlik bağlam penceresi sunar (istek başına prompt ve cevap birlikte). Araç çağırma (tool calling) yapar ve görsel okur: görsel girdi base64 data URL olarak gönderilir, uzak görsel adresi kabul edilmez. Model her yanıttan önce adım adım düşünür; bu düşünme `reasoning_content` alanında size döner, `max_tokens` bütçenizden harcanır ve kapatılamaz. Tekrar eden istem başlangıçları önbellekten karşılanır ve indirimli fiyatlanır. Aynı isteği kısa süre içinde tekrar gönderirseniz sunucu önceki yanıtı aynen döndürebilir. Ses ve video girdisi desteklenmez. ## EmbeddingGemma 300M (llmtr/embeddinggemma-300m) URL: /models/llmtr/embeddinggemma-300m Provider: LLMTR Context window: 2048 Operations: EMBEDDINGS Modalities: text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD Summary: Semantik arama ve RAG icin Turkiye'de barindirilan embedding modeli. Description: EmbeddingGemma 300M, Turkiye'de barindirilan bir embedding modelidir ve metni 768 boyutlu sayisal vektore cevirir. Semantik arama, RAG, benzerlik karsilastirma, siniflandirma ve kumeleme islerinde kullanilir. Batch input desteklenir; vektor boyutu MRL ile 512/256/128'e kirpilabilir. Metin basina en fazla 2048 token kabul eder ve Turkce dahil 100'den fazla dili destekler. ## Qwen 3.5 4B (llmtr/qwen3-5-4b) URL: /models/llmtr/qwen3-5-4b Provider: LLMTR Context window: 131072 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.25 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 3 USD Summary: Türkçe sohbet, RAG ve araç çağırma akışları için Türkiye'de barındırılan 128K bağlamlı 4B model. Description: LLMTR Qwen 3.5 4B, sunucuları Türkiye'de konumlanmış birinci taraf dil modelidir. OpenAI uyumlu Chat Completions şemasıyla çağrılır; istekleriniz üçüncü taraf bir sağlayıcıya yönlendirilmez. 128K bağlam penceresi sunar (istek başına prompt ve cevap birlikte). Küçük ve hızlı bir modeldir: Türkçe sohbet, özetleme, sınıflandırma, RAG chatbot ve araç çağırma (tool calling) gerektiren ajan akışları için uygundur. Yalnızca metin girdisi kabul eder; görsel, ses ve video gönderilirse istek 400 ile reddedilir. Aynı prompt önekini tekrar gönderdiğinizde prompt cache devreye girer ve cache'ten okunan tokenlar indirimli fiyatlanır; bu, uzun sistem promptu kullanan akışlarda maliyeti belirgin şekilde düşürür. Düşünme (thinking) modu varsayılan olarak açıktır: model yanıttan önce bir akıl yürütme üretir, bunu `reasoning_content` alanında size döndürür ve bu tokenlar `max_tokens` bütçenizden harcanır. Bu nedenle varsayılan modda `max_tokens` değerini en az 2048 verin; daha küçük bir bütçede akıl yürütme bütçeyi tüketir ve içerik boş dönebilir. Düşünmeyi kapatmak için `llmtr/qwen3-5-4b:fast` kullanın veya istek gövdesine `reasoning: false` ekleyin. ## GPT-6 Astra (openai/gpt-6-astra) URL: /models/openai/gpt-6-astra Provider: OpenAI Context window: 1050000 Operations: RESPONSES Modalities: text, image Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 10 USD; RESPONSES/CACHE_READ/PER_1M_TOKENS: 1 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 50 USD; RESPONSES/CACHE_WRITE/PER_1M_TOKENS: 12.5 USD Summary: Uçtan uca zor işler, ajan akışları ve bilgisayar kullanımı için OpenAI'nin en yetenekli modeli. Description: GPT-6 Astra, OpenAI'nin uçtan uca en zor işler için konumlandırdığı en yetenekli modelidir; karmaşık akıl yürütme, ajan tabanlı kodlama, bilgisayar kullanımı, araştırma ve doküman üretimi için kullanılır. 1.05M bağlam penceresi, 128K maksimum çıktı, metin ve görsel girdi, prompt cache ve low'dan max'a uzanan beş reasoning effort seviyesi sunar. ## GPT-6 Astra (Ücretsiz) (openai/gpt-6-astra-free) URL: /models/openai/gpt-6-astra-free Provider: OpenAI Context window: 200000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0 USD Summary: 10 Eylül 2026'ya kadar günlük kotayla ücretsiz sunulan GPT-6 Astra; zor akıl yürütme, kod ve ajan işleri için. Description: GPT-6 Astra'nın günlük kullanım kotasıyla ücretsiz sunulan sürümüdür ve 10 Eylül 2026'ya kadar açıktır. O tarihten sonra bu kimlik istek kabul etmez ve aldığınız hata ücretli GPT-6 Astra satırını önerir; geçiş otomatik değildir, model kimliğini siz değiştirirsiniz ve o zamana kadar hesabınızdan hiçbir ücret çıkmaz. Karmaşık akıl yürütme, ajan tabanlı kodlama, araştırma ve doküman üretimi için kullanılır; 1.05M bağlam penceresi, metin ve görsel girdi, araç çağrısı, JSON çıktı ve low'dan max'a beş akıl yürütme seviyesi sunar. Yalnızca sohbet tamamlama ucundan çağrılır; PDF girdisi kabul etmez ve tek yanıtta en fazla 128.000 token üretir. Kota dolduğunda aldığınız hata, ne zaman yeniden deneyebileceğinizi söyler. Süreklilik, PDF girdisi veya daha yüksek çıktı tavanı gerekiyorsa ücretli satırı kullanın. ## GPT-5.6 Sol (openai/gpt-5.6-sol) URL: /models/openai/gpt-5.6-sol Provider: OpenAI Context window: 1050000 Operations: RESPONSES Modalities: text, image Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 4 USD; RESPONSES/CACHE_READ/PER_1M_TOKENS: 0.4 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 20 USD Summary: GPT-5.6 Sol: zor reasoning, kod ve ajan akışları için OpenAI GPT-5.6 preview modeli. Description: GPT-5.6 Sol, OpenAI GPT-5.6 ailesinde zor profesyonel analiz, agentic kodlama, araç kullanan çok adımlı akışlar ve uzun bağlamlı işler için uygundur. 1.05M bağlam, 128K maksimum çıktı, metin/görsel girdi, prompt cache ve gerçek max reasoning effort desteği sunar. ## GPT-5.6 Sol Pro (openai/gpt-5.6-sol-pro) URL: /models/openai/gpt-5.6-sol-pro Provider: OpenAI Context window: 1050000 Operations: RESPONSES Modalities: text, image Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 4 USD; RESPONSES/CACHE_READ/PER_1M_TOKENS: 0.4 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 20 USD Summary: GPT-5.6 Sol Pro: pro modda zor reasoning, kod ve ajan akışları için OpenAI GPT-5.6 preview modeli. Description: GPT-5.6 Sol Pro, OpenAI GPT-5.6 ailesinde Sol kalitesini Responses API reasoning.mode=pro ile kullanan kalite öncelikli işler için uygundur. 1.05M bağlam, 128K maksimum çıktı, metin/görsel girdi, prompt cache ve gerçek max reasoning effort desteği sunar. Bu LLMTR wrapper modeli ayrı bir OpenAI native slug'ı değildir; upstream base GPT-5.6 modeline gider ve pro mode varsayılanını body'de açar. ## GPT-5.6 Terra (openai/gpt-5.6-terra) URL: /models/openai/gpt-5.6-terra Provider: OpenAI Context window: 1050000 Operations: RESPONSES Modalities: text, image Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 2 USD; RESPONSES/CACHE_READ/PER_1M_TOKENS: 0.2 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 12 USD Summary: GPT-5.6 Terra: zeka ve maliyet dengesi isteyen üretim işleri için OpenAI GPT-5.6 preview modeli. Description: GPT-5.6 Terra, OpenAI GPT-5.6 ailesinde güçlü performans isterken Sol maliyetine çıkmaması gereken kod, ajan, analiz ve yüksek hacimli yardımcı akışları için uygundur. 1.05M bağlam, 128K maksimum çıktı, metin/görsel girdi, prompt cache ve gerçek max reasoning effort desteği sunar. ## GPT-5.6 Terra Pro (openai/gpt-5.6-terra-pro) URL: /models/openai/gpt-5.6-terra-pro Provider: OpenAI Context window: 1050000 Operations: RESPONSES Modalities: text, image Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 2 USD; RESPONSES/CACHE_READ/PER_1M_TOKENS: 0.2 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 12 USD Summary: GPT-5.6 Terra Pro: pro modda zeka-maliyet dengesi isteyen işler için OpenAI GPT-5.6 preview modeli. Description: GPT-5.6 Terra Pro, OpenAI GPT-5.6 ailesinde Terra fiyat dengesini Responses API reasoning.mode=pro ile kullanan kalite öncelikli işler için uygundur. 1.05M bağlam, 128K maksimum çıktı, metin/görsel girdi, prompt cache ve gerçek max reasoning effort desteği sunar. Bu LLMTR wrapper modeli ayrı bir OpenAI native slug'ı değildir; upstream base GPT-5.6 modeline gider ve pro mode varsayılanını body'de açar. ## GPT-5.6 Luna (openai/gpt-5.6-luna) URL: /models/openai/gpt-5.6-luna Provider: OpenAI Context window: 1050000 Operations: RESPONSES Modalities: text, image Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 0.2 USD; RESPONSES/CACHE_READ/PER_1M_TOKENS: 0.02 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 1.2 USD Summary: GPT-5.6 Luna: maliyet hassas ve yüksek hacimli işler için OpenAI GPT-5.6 preview modeli. Description: GPT-5.6 Luna, OpenAI GPT-5.6 ailesinde yüksek hacimli yardımcılar, sınıflandırma, özetleme, routing ve maliyet kontrollü üretim akışları için uygundur. 1.05M bağlam, 128K maksimum çıktı, metin/görsel girdi, prompt cache ve gerçek max reasoning effort desteği sunar. ## GPT-5.6 Luna Pro (openai/gpt-5.6-luna-pro) URL: /models/openai/gpt-5.6-luna-pro Provider: OpenAI Context window: 1050000 Operations: RESPONSES Modalities: text, image Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 0.2 USD; RESPONSES/CACHE_READ/PER_1M_TOKENS: 0.02 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 1.2 USD Summary: GPT-5.6 Luna Pro: pro modda maliyet hassas yüksek hacimli işler için OpenAI GPT-5.6 preview modeli. Description: GPT-5.6 Luna Pro, OpenAI GPT-5.6 ailesinde Luna maliyet avantajını Responses API reasoning.mode=pro ile kullanan seçici kalite artışı işleri için uygundur. 1.05M bağlam, 128K maksimum çıktı, metin/görsel girdi, prompt cache ve gerçek max reasoning effort desteği sunar. Bu LLMTR wrapper modeli ayrı bir OpenAI native slug'ı değildir; upstream base GPT-5.6 modeline gider ve pro mode varsayılanını body'de açar. ## GPT-5.5 (openai/gpt-5.5) URL: /models/openai/gpt-5.5 Provider: OpenAI Context window: 1050000 Operations: RESPONSES Modalities: text, image Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 5 USD; RESPONSES/CACHE_READ/PER_1M_TOKENS: 0.5 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 30 USD Summary: Kod, derin analiz ve ajan orkestrasyonu için olgun OpenAI frontier modeli. Description: Kod, arac yogun ajan akislar, uzun baglamli analiz ve kalite odakli profesyonel isler icin olgun bir OpenAI secenegidir. 1.05M baglam, 128K maksimum cikti ve none'dan xhigh'a uzanan reasoning eforlariyla zor uretim islerinde kullanilir; daha yuksek yetenek gerektiren islerde GPT-6 Astra tercih edilebilir. ## GPT-5.5 Pro (openai/gpt-5.5-pro) URL: /models/openai/gpt-5.5-pro Provider: OpenAI Context window: 1050000 Operations: RESPONSES Modalities: text, image Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 30 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 180 USD Summary: En zor reasoning, kod ve uzun bağlamlı analiz için GPT-5.5 Pro. Description: GPT-5.5 Pro, OpenAI tarafındaki en yüksek derinlikli GPT-5.5 varyantıdır. Zor profesyonel reasoning, kod, uzun bağlamlı analiz ve kalite öncelikli ajan işlerinde kullanılır. 1.05M bağlam, 128K maksimum çıktı ve Responses API üzerinden metin/görsel girdi desteği sunar; cached input indirimi bulunmadığı için maliyet planlamasında standart input fiyatını esas alın. ## GPT-5.4 (openai/gpt-5.4) URL: /models/openai/gpt-5.4 Provider: OpenAI Context window: 272000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2.5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 15 USD Summary: Zor muhakeme ve üretim ajanları için olgun ve dengeli OpenAI modeli. Description: Karmasik reasoning, agent akislar ve kod agirlikli profesyonel isler icin olgun bir OpenAI secenegidir. 272K baglami yeterliyse kalite, arac kullanimi ve uzun cok adimli execution icin saglam bir varsayilandir; daha genis baglam veya daha yuksek yetenek gerekiyorsa GPT-6 Astra tercih edilir. ## GPT-5.4 mini (openai/gpt-5.4-mini) URL: /models/openai/gpt-5.4-mini Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.75 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 4.5 USD Summary: Kod yardımcıları ve alt ajan akışları için en dengeli GPT-5.4 mini modeli. Description: Kod, bilgisayar kullanimi ve alt ajan akislarinda ciddi guc sunarken gecikme ve maliyeti daha kontrollu tutar. Uretimde kaliteli ama daha hizli bir default ariyorsaniz iyi secimdir. ## GPT-5.2 (openai/gpt-5.2) URL: /models/openai/gpt-5.2 Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.75 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 14 USD Summary: Kod üretimi ve çok adımlı ajan işleri için üst seviye GPT-5 modeli. Description: Genel zeka, arac kullanimi ve kod kalitesinde GPT-5 ailesinin daha guclu seceneklerinden biridir. Zor cok adimli gorevler, urun kalitesinde cikti ve yuksek dogruluk isteyen ekipler icin uygundur. ## GPT-4.1 (openai/gpt-4.1) URL: /models/openai/gpt-4.1 Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 8 USD Summary: Talimat takibi ve araç çağrıları için güçlü GPT-4.1 modeli. Description: Talimat takibi, arac cagirma ve deterministik urun akislarinda cok guclu bir secenektir. Daha az dusunme overhead'i ile hizli ve duzenli cevap istendiginde iyi default olur. ## GPT-4o (openai/gpt-4o) URL: /models/openai/gpt-4o Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2.5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 10 USD Summary: Sohbet, içerik üretimi ve görsel anlama için esnek multimodal OpenAI modeli. Description: Sohbet, icerik uretimi, gorsel farkindalik ve genel urun entegrasyonlari icin oldukca esnek bir secenektir. Tek modelle cok farkli kullanimi kapsamak isteyen ekipler icin guclu default olur. ## o4-mini (openai/o4-mini) URL: /models/openai/o4-mini Provider: OpenAI Context window: 200000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 4.4 USD Summary: Kod, matematik ve görsel akıl yürütme için hızlı kompakt reasoning modeli. Description: Kod, matematik ve gorsel akil yurutme gerektiren islerde kucuk boyuta gore etkileyici performans verir. Daha pahali reasoning modellerine cikmadan once guclu bir ara secenektir. Dusunme derinligini `reasoning_effort` ile `low`, `medium` veya `high` olarak ayarlayabilirsiniz. ## o3 (openai/o3) URL: /models/openai/o3 Provider: OpenAI Context window: 200000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 8 USD Summary: Zor teknik analiz ve çok adımlı problem çözümü için güçlü reasoning modeli. Description: Matematik, bilim, teknik yazim ve kod analizi gibi alanlarda cok adimli dusunme isteyen gorevler icin uygundur. Derin analiz ve saglam muhakeme gereken durumlarda guclu secimdir. Dusunme derinligini `reasoning_effort` ile `low`, `medium` veya `high` olarak ayarlayabilirsiniz. ## GPT-5.3-Codex (openai/gpt-5.3-codex) URL: /models/openai/gpt-5.3-codex Provider: OpenAI Context window: 400000 Operations: RESPONSES Modalities: text, image Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 1.75 USD; RESPONSES/CACHE_READ/PER_1M_TOKENS: 0.175 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 14 USD Summary: Depo ölçekli kod düzenlemeleri ve zor mühendislik işleri için Codex modeli. Description: Depo capinda anlayis, uzun duzenleme zincirleri ve agentic kodlama akislarinda ust seviye performansa oynar. Kod urunu gelistiren ekipler icin en iddiali Codex seceneklerinden biridir. ## GPT Image 2 (openai/gpt-image-2) URL: /models/openai/gpt-image-2 Provider: OpenAI Context window: 32000 Operations: IMAGES_GENERATIONS Modalities: text, image Pricing: IMAGES_GENERATIONS/INPUT_TEXT/PER_1M_TOKENS: 5 USD; IMAGES_GENERATIONS/INPUT_IMAGE/PER_1M_TOKENS: 8 USD; IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_1M_TOKENS: 30 USD Summary: Üretim kalitesinde görsel üretim için OpenAI görüntü modeli. Description: Metinden ürün görseli, kampanya kreatifi ve uygulama içi illüstrasyon üretmek isteyen ekipler için uygundur. Boyut, kalite ve çıktı formatı üzerinde kontrol gereken text-to-image akışlarında güçlüdür. ## Gemini 3.8 Flash (google/gemini-3.8-flash) URL: /models/google/gemini-3.8-flash Provider: Google Context window: 1048576 Operations: CHAT_COMPLETIONS, RESPONSES Modalities: image, video, audio, text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.75 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.075 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 3.75 USD; CHAT_COMPLETIONS/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 0.5 USD; CHAT_COMPLETIONS/INPUT_AUDIO/PER_1M_TOKENS: 0.75 USD; CHAT_COMPLETIONS/INPUT_IMAGE/PER_1M_TOKENS: 0.75 USD; CHAT_COMPLETIONS/INPUT_VIDEO/PER_1M_TOKENS: 0.75 USD; CHAT_COMPLETIONS/TOOL_CALL/PER_1K_CALLS: 14 USD Summary: Uzun soluklu kod işleri ve otonom ajanlar için Google'ın güncel Flash modeli. Description: 1M context ve 65K output tavanıyla uçtan uca yazılım görevleri, çok adımlı ajan döngüleri ve görsel/video/ses/PDF analizi için konumlanır. Düşünme seviyesi low, medium ve high olarak ayarlanabilir; varsayılan medium'dur. Zor görevlerde ek akıl yürütme adımı atıp araçları daha çok çağırdığı için aynı işi Gemini 3.7 Flash'tan daha fazla token harcayarak bitirebilir; token maliyeti birinci kısıtsa düşük seviyelerle çalışmak ya da 3.7 Flash'ta kalmak daha uygundur. Tanıtım fiyatı 31 Aralık 2026'ya kadar geçerlidir, 1 Ocak 2027'den itibaren standart tarifeye geçer. ## Gemini 3.7 Flash (google/gemini-3.7-flash) URL: /models/google/gemini-3.7-flash Provider: Google Context window: 1048576 Operations: CHAT_COMPLETIONS, RESPONSES Modalities: image, video, audio, text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.75 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.075 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 3.75 USD; CHAT_COMPLETIONS/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 0.5 USD; CHAT_COMPLETIONS/INPUT_AUDIO/PER_1M_TOKENS: 0.75 USD; CHAT_COMPLETIONS/INPUT_IMAGE/PER_1M_TOKENS: 0.75 USD; CHAT_COMPLETIONS/INPUT_VIDEO/PER_1M_TOKENS: 0.75 USD; CHAT_COMPLETIONS/TOOL_CALL/PER_1K_CALLS: 14 USD Summary: Ajan ve kod işleri için Google'ın güncel Flash modeli. Description: 1M context ve 65K output tavanıyla araç kullanan üretim uygulamaları, kod döngüleri ve görsel/video/ses/PDF analizi için konumlanır. Düşünme seviyesi low, medium ve high olarak ayarlanabilir; varsayılan medium'dur. Tanıtım fiyatı 31 Aralık 2026'ya kadar geçerlidir, 1 Ocak 2027'den itibaren standart tarifeye geçer. ## Gemini 2.5 Flash (google/gemini-2.5-flash) URL: /models/google/gemini-2.5-flash Provider: Google Context window: 1048576 Operations: CHAT_COMPLETIONS, RESPONSES Modalities: text, image, video, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.3 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.5 USD; CHAT_COMPLETIONS/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 1 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.03 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.03 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.03 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/INPUT_AUDIO/PER_1M_TOKENS: 1 USD Summary: Günlük multimodal yardımcılar ve araçlı ürün akışları için dengeli Gemini modeli. Description: Düşük gecikme, yüksek hacim ve araç kullanımı isteyen ürün akışlarında çok yönlü davranır. Google bu modeli 16 Ekim 2026'da kullanımdan kaldırıyor; o tarihten sonra istekler 410 model_retired ile reddedilir. Yeni entegrasyonlarda google/gemini-3.6-flash tercih edilmelidir. ## Gemini 2.5 Flash Image (google/gemini-2.5-flash-image) URL: /models/google/gemini-2.5-flash-image Provider: Google Context window: 0 Operations: IMAGES_GENERATIONS Modalities: text, image Pricing: IMAGES_GENERATIONS/INPUT_TEXT/PER_1M_TOKENS: 0.3 USD; IMAGES_GENERATIONS/INPUT_IMAGE/PER_1M_TOKENS: 0.3 USD; IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.039 USD Summary: Hızlı görsel üretim ve düzenleme için Gemini görüntü modeli. Description: Metinden görsel üretimi ile konuşmalı düzenlemeyi tek akışta birleştirmek isteyen ekipler için uygundur. Hızlı iterasyon, ürün görseli ve yaratıcı yardımcı senaryolarında güçlüdür. ## Gemini 2.5 Flash-Lite (google/gemini-2.5-flash-lite) URL: /models/google/gemini-2.5-flash-lite Provider: Google Context window: 1048576 Operations: CHAT_COMPLETIONS, RESPONSES Modalities: text, image, video, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.4 USD; CHAT_COMPLETIONS/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 1 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.01 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.01 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.01 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.03 USD Summary: Yüksek hacimli işler için en ekonomik Gemini 2.5 seçeneği. Description: Basit ajan akışları, veri çıkarma ve yoğun API trafiğinde maliyeti düşük tutmak için konumlanır. Google bu modeli 16 Ekim 2026'da kullanımdan kaldırıyor; o tarihten sonra istekler 410 model_retired ile reddedilir. Yeni entegrasyonlarda google/gemini-3.5-flash-lite tercih edilmelidir. ## Gemini 2.5 Flash Native Audio (Live API) (google/gemini-2.5-flash-native-audio-preview-12-2025) URL: /models/google/gemini-2.5-flash-native-audio-preview-12-2025 Provider: Google Context window: 128000 Operations: REALTIME_SESSION Modalities: text, audio, video Pricing: REALTIME_SESSION/INPUT_TEXT/PER_1M_TOKENS: 0.5 USD; REALTIME_SESSION/OUTPUT_TEXT/PER_1M_TOKENS: 2 USD; REALTIME_SESSION/INPUT_AUDIO/PER_1M_TOKENS: 3 USD; REALTIME_SESSION/INPUT_VIDEO/PER_1M_TOKENS: 3 USD; REALTIME_SESSION/OUTPUT_AUDIO/PER_1M_TOKENS: 12 USD Summary: Gerçek zamanlı sesli diyalog için Gemini Live ses modeli. Description: Doğal konuşma akışı, ses tonu ve düşük gecikmeli sesli etkileşim isteyen uygulamalar için tasarlanmıştır. Realtime sesli asistan, voice UX ve çağrı benzeri deneylerde öne çıkar. ## Gemini 2.5 Flash Preview TTS (google/gemini-2.5-flash-preview-tts) URL: /models/google/gemini-2.5-flash-preview-tts Provider: Google Context window: 0 Operations: AUDIO_SPEECH Modalities: text, audio Pricing: AUDIO_SPEECH/INPUT_TEXT/PER_1M_TOKENS: 0.5 USD; AUDIO_SPEECH/OUTPUT_AUDIO/PER_1M_TOKENS: 10 USD Summary: Hızlı ve yönlendirilebilir konuşma üretimi için Gemini TTS modeli. Description: Metinden sese dönüşümde düşük gecikme ve maliyet verimliliği arayan ekipler için uygundur. Uygulama içi seslendirme, okuma ve yardımcı ses akışlarında pratik bir seçenektir. ## Gemini 2.5 Pro (google/gemini-2.5-pro) URL: /models/google/gemini-2.5-pro Provider: Google Context window: 1048576 Operations: CHAT_COMPLETIONS, RESPONSES Modalities: text, image, audio, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.25 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 10 USD; CHAT_COMPLETIONS/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 4.5 USD; CHAT_COMPLETIONS/TOOL_CALL/PER_1K_CALLS: 25 USD; CHAT_COMPLETIONS/TOOL_CALL/PER_1K_CALLS: 35 USD; RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 1.25 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 10 USD; RESPONSES/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 4.5 USD Summary: Kod, bilim ve zor muhakeme için en güçlü Gemini düşünme modeli. Description: Uzun bağlam, büyük belge analizi ve daha zor problem çözme işlerinde Google tarafındaki üst seviye seçenektir. Google bu modeli 16 Ekim 2026'da kullanımdan kaldırıyor; o tarihten sonra istekler 410 model_retired ile reddedilir. Yeni entegrasyonlarda google/gemini-3.1-pro-preview tercih edilmelidir. ## Gemini 2.5 Pro Preview TTS (google/gemini-2.5-pro-preview-tts) URL: /models/google/gemini-2.5-pro-preview-tts Provider: Google Context window: 0 Operations: AUDIO_SPEECH Modalities: text, audio Pricing: AUDIO_SPEECH/INPUT_TEXT/PER_1M_TOKENS: 1 USD; AUDIO_SPEECH/OUTPUT_AUDIO/PER_1M_TOKENS: 20 USD Summary: Daha doğal ve güçlü ses çıkışı için Gemini Pro TTS modeli. Description: Daha ifade zenginliği ve yönlendirilebilirlik isteyen text-to-speech senaryolarında öne çıkar. Premium ses deneyimi gerektiren uygulamalar için Flash TTS'e göre daha güçlü bir seçenektir. ## Gemini 3 Flash Preview (google/gemini-3-flash-preview) URL: /models/google/gemini-3-flash-preview Provider: Google Context window: 1048576 Operations: CHAT_COMPLETIONS, RESPONSES Modalities: text, image, video, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 3 USD; CHAT_COMPLETIONS/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 1 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.05 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.05 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.05 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/INPUT_AUDIO/PER_1M_TOKENS: 1 USD Summary: Hızlı multimodal yardımcılar ve ajan deneyleri için Gemini 3 preview modeli. Description: Görsel anlama, araç kullanımı ve hızlı üretim akışlarını tek modelde toplamak isteyen ekipler için uygundur. Kararlı sürüm öncesinde yeni Gemini davranışını erken değerlendirmek için iyi bir preview seçeneğidir. ## Gemini 3.1 Flash-Lite (google/gemini-3.1-flash-lite) URL: /models/google/gemini-3.1-flash-lite Provider: Google Context window: 1048576 Operations: CHAT_COMPLETIONS, RESPONSES Modalities: text, image, video, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.25 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.5 USD; CHAT_COMPLETIONS/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 1 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.025 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.025 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.025 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.05 USD; CHAT_COMPLETIONS/INPUT_AUDIO/PER_1M_TOKENS: 0.5 USD Summary: Yuksek hacimli hafif multimodal isler icin GA Gemini 3.1 secenegi. Description: Basit veri cikarma, hizli ajan gorevleri, ceviri ve cok sik cagrilan multimodal akislar icin dusuk gecikme ve maliyet verimliligi saglar. Preview yerine kararlı GA model kimligiyle kullanilmalidir. ## Gemini 3.1 Pro Preview (google/gemini-3.1-pro-preview) URL: /models/google/gemini-3.1-pro-preview Provider: Google Context window: 1048576 Operations: CHAT_COMPLETIONS, RESPONSES Modalities: text, image, audio, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 12 USD; CHAT_COMPLETIONS/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 4.5 USD; CHAT_COMPLETIONS/TOOL_CALL/PER_1K_CALLS: 14 USD; CHAT_COMPLETIONS/TOOL_CALL/PER_1K_CALLS: 14 USD; RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 2 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 12 USD; RESPONSES/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 4.5 USD Summary: Yazılım, araştırma ve grounded reasoning için üst seviye Gemini 3.1 preview modeli. Description: Daha güvenilir düşünme, daha iyi token verimliliği ve karmaşık görevlerde daha tutarlı çıktı isteyen ekipler için konumlanır. Kod tabanları, araştırma akışları ve yoğun araç kullanımı gerektiren ürünlerde güçlüdür. ## Gemini 3.1 Pro Preview (google/gemini-3.1-pro-preview-customtools) URL: /models/google/gemini-3.1-pro-preview-customtools Provider: Google Context window: 1048576 Operations: CHAT_COMPLETIONS, RESPONSES Modalities: text, image, audio, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 12 USD; CHAT_COMPLETIONS/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 4.5 USD; CHAT_COMPLETIONS/TOOL_CALL/PER_1K_CALLS: 14 USD; CHAT_COMPLETIONS/TOOL_CALL/PER_1K_CALLS: 14 USD; RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 2 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 12 USD; RESPONSES/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 4.5 USD Summary: Yazılım, araştırma ve grounded reasoning için üst seviye Gemini 3.1 preview modeli. Description: Daha güvenilir düşünme, daha iyi token verimliliği ve karmaşık görevlerde daha tutarlı çıktı isteyen ekipler için konumlanır. Kod tabanları, araştırma akışları ve yoğun araç kullanımı gerektiren ürünlerde güçlüdür. ## Gemini 3.5 Flash (google/gemini-3.5-flash) URL: /models/google/gemini-3.5-flash Provider: Google Context window: 1048576 Operations: CHAT_COMPLETIONS, RESPONSES Modalities: image, video, audio, text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.5 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.15 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 9 USD; CHAT_COMPLETIONS/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 1 USD; CHAT_COMPLETIONS/INPUT_AUDIO/PER_1M_TOKENS: 1.5 USD; CHAT_COMPLETIONS/INPUT_IMAGE/PER_1M_TOKENS: 1.5 USD; CHAT_COMPLETIONS/INPUT_VIDEO/PER_1M_TOKENS: 1.5 USD; CHAT_COMPLETIONS/TOOL_CALL/PER_1K_CALLS: 14 USD Summary: Ajan, kod ve multimodal ürün akışları için kararlı Gemini Flash modeli. Description: 1M context ve 65K output tavanıyla araç kullanımı, PDF ve medya girdileriyle çalışan üretim uygulamaları için konumlanır. Gemini 3 Flash Preview'dan kararlı kimliğe geçmek isteyen ekiplerde hız, kalite ve maliyet dengesini koruyan ana Flash seçeneğidir. ## Gemini 3.5 Flash-Lite (google/gemini-3.5-flash-lite) URL: /models/google/gemini-3.5-flash-lite Provider: Google Context window: 1048576 Operations: CHAT_COMPLETIONS, RESPONSES Modalities: image, video, audio, text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.3 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.5 USD; CHAT_COMPLETIONS/INPUT_AUDIO/PER_1M_TOKENS: 0.3 USD; CHAT_COMPLETIONS/INPUT_IMAGE/PER_1M_TOKENS: 0.3 USD; CHAT_COMPLETIONS/INPUT_VIDEO/PER_1M_TOKENS: 0.3 USD; CHAT_COMPLETIONS/TOOL_CALL/PER_1K_CALLS: 14 USD; CHAT_COMPLETIONS/TOOL_CALL/PER_1K_CALLS: 14 USD; RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 0.3 USD Summary: Yüksek hacimli ajan ve belge işleme için en uygun maliyetli Gemini modeli. Description: Gecikme ve maliyetin birinci kısıt olduğu işler için konumlanır: toplu belge ayrıştırma, veri çıkarımı, çeviri, sınıflandırma ve alt-ajan görevleri. 1M context, 65K output, görsel/video/ses/PDF girdisi ve araç çağrısı desteğini Flash sınıfının çok altında bir token fiyatıyla sunar; düşünme seviyesi minimal'e çekilerek daha da hızlandırılabilir. ## Gemini 3.6 Flash (google/gemini-3.6-flash) URL: /models/google/gemini-3.6-flash Provider: Google Context window: 1048576 Operations: CHAT_COMPLETIONS, RESPONSES Modalities: image, video, audio, text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.5 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.15 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 7.5 USD; CHAT_COMPLETIONS/CACHE_STORAGE/PER_1M_TOKEN_HOURS: 1 USD; CHAT_COMPLETIONS/INPUT_AUDIO/PER_1M_TOKENS: 1.5 USD; CHAT_COMPLETIONS/INPUT_IMAGE/PER_1M_TOKENS: 1.5 USD; CHAT_COMPLETIONS/INPUT_VIDEO/PER_1M_TOKENS: 1.5 USD; CHAT_COMPLETIONS/TOOL_CALL/PER_1K_CALLS: 14 USD Summary: Ajan ve kod akışlarında daha az token harcayan kararlı Gemini Flash modeli. Description: 1M context ve 65K output tavanıyla araç kullanan üretim uygulamaları, kod döngüleri ve belge/medya analizi için konumlanır. Aynı çok adımlı işi Gemini 3.5 Flash'a göre daha az çıktı tokenı ve daha az araç çağrısıyla bitirdiği için ajan başına maliyeti düşürür; çıktı fiyatı da 3.5 Flash'ın altındadır. ## Gemini Embedding (google/gemini-embedding-001) URL: /models/google/gemini-embedding-001 Provider: Google Context window: 2048 Operations: EMBEDDINGS Modalities: text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.15 USD Summary: Metin tabanlı arama ve RAG için temel Gemini embedding modeli. Description: Semantik arama, öneri ve klasik metin retrieval senaryolarında güvenli bir başlangıç sağlar. Görsel yerine yazı odaklı embedding ihtiyacında pratik bir varsayılandır. ## Gemini Embedding 2 Preview (google/gemini-embedding-2-preview) URL: /models/google/gemini-embedding-2-preview Provider: Google Context window: 8192 Operations: EMBEDDINGS Modalities: image, audio, video, text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.2 USD; EMBEDDINGS/OUTPUT_TEXT/PER_1M_TOKENS: 12 USD; EMBEDDINGS/INPUT_AUDIO/PER_SECOND: 0.00016 USD; EMBEDDINGS/INPUT_IMAGE/PER_IMAGE: 0.00012 USD; EMBEDDINGS/INPUT_VIDEO/PER_1M_TOKENS: 12 USD Summary: Metin, görsel ve belge araması için multimodal Gemini embedding modeli. Description: Çok modlu arama, belge eşleme ve farklı veri türlerini birlikte retrieve etmek isteyen sistemler için uygundur. Görsel, PDF ve ses benzeri içerikleri aynı retrieval katmanında toplamak isteyen ekiplerde öne çıkar. ## Veo 3.1 (google/veo-3.1-fast-generate-001) URL: /models/google/veo-3.1-fast-generate-001 Provider: Google Context window: 0 Operations: VIDEO_GENERATIONS Modalities: text, image, video Pricing: VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.1 USD; VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.12 USD; VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.3 USD Summary: Hız odaklı Veo 3.1 Fast video üretimi. Description: Google Veo 3.1 Fast; en güncel Veo neslinde hız ve maliyet öncelikli sesli video üretir. Metin veya görsel referans (image_url, base64) girdisi alır. İterasyon, taslak ve sosyal içerik akışları için uygundur. 720p $0.10, 1080p $0.12, 4k $0.30/saniye fiyatlanır. ## Veo 3.1 (google/veo-3.1-generate-001) URL: /models/google/veo-3.1-generate-001 Provider: Google Context window: 0 Operations: VIDEO_GENERATIONS Modalities: text, image, video Pricing: VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.4 USD; VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.4 USD; VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.6 USD Summary: En güncel Veo 3.1 ile yüksek kaliteli sesli video üretimi. Description: Google Veo 3.1; metinden veya görsel referanstan (image_url, base64) sesli video üreten en güncel Veo modelidir. Sinematik kalite, karmaşık sahne kurgusu ve reklam prodüksiyonu için uygundur. 720p/1080p $0.40, 4k $0.60/saniye fiyatlanır. ## Veo 3.1 (google/veo-3.1-lite-generate-001) URL: /models/google/veo-3.1-lite-generate-001 Provider: Google Context window: 0 Operations: VIDEO_GENERATIONS Modalities: text, image, video Pricing: VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.05 USD; VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.08 USD Summary: En ekonomik Veo katmanı: Veo 3.1 Lite. Description: Google Veo 3.1 Lite; en düşük birim maliyetle sesli video üreten Veo katmanıdır. Metin veya görsel referans (image_url, base64) girdisi alır. Yüksek hacimli, maliyet duyarlı üretim akışları için uygundur. 720p $0.05, 1080p $0.08/saniye fiyatlanır; 4k desteklenmez. ## Claude Fable 5.1 (anthropic/claude-fable-5.1) URL: /models/anthropic/claude-fable-5.1 Provider: Anthropic Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 10 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.25 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 50 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 12.5 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 20 USD Summary: Anthropic'in en güçlü genel erişimli Claude modeli; Fable 5'in halefi. Description: Claude Fable 5.1; uzun soluklu ajan gorevleri, buyuk kod tabanlari, karmasik bilgi isleri ve gorsel anlama gerektiren uretim akislarinda Anthropic'in en guclu genel erisimli modelidir. 1M context, 128K maksimum cikti, her zaman acik adaptive thinking, gorsel ve dokuman girdisi, tool calling ve prompt cache destegi sunar. Effort seviyesi low'dan max'a kadar ayarlanabilir; kisa islerde dusuk, zor ajan islerinde yuksek seviye tercih edilir. Prompt cache okuma ucreti Fable 5'in dortte biri oldugu icin ayni baglami tekrar tekrar okuyan ajan donguleri belirgin sekilde ucuza gelir. Anthropic'in 30 gunluk retention sartina tabidir. ## Claude Fable 5 (anthropic/claude-fable-5) URL: /models/anthropic/claude-fable-5 Provider: Anthropic Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 10 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 50 USD Summary: Fable serisinin önceki nesli; uzun soluklu ajan ve kod işleri için oturmuş seçenek. Description: Claude Fable 5; uzun soluklu ajan gorevleri, buyuk kod tabanlari, karmasik bilgi isleri ve gorsel anlama gerektiren uretim akislarinda Fable serisinin onceki neslidir. 1M context, 128K maksimum cikti, adaptive thinking, gorsel girdi ve konfigure edilebilir effort seviyeleri sunar. Bu nesle gore ayarlanmis mevcut entegrasyonlarda guclu kalir; yeni islerde Fable 5.1 ayni fiyata daha yetenekli ve prompt cache okumasi dort kat ucuzdur. En yuksek yetenegin gerekmedigi islerde Opus 5 yari maliyetle daha uygun bir secimdir. Anthropic'in 30 gunluk retention sartina tabidir. ## Claude Opus 5 (anthropic/claude-opus-5) URL: /models/anthropic/claude-opus-5 Provider: Anthropic Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 5 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 25 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 6.25 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 10 USD Summary: Karmaşık ajan kodlaması ve kurumsal işler için yeni nesil Opus. Description: Cok dosyali kod degisiklikleri, uzun soluklu ajan gorevleri, kod incelemesi ve kurumsal bilgi isleri icin Anthropic'in yeni nesil Opus modelidir. 1M context, 128K maksimum cikti, varsayilan olarak acik adaptive thinking, gorsel ve dokuman girdisi, tool calling ve prompt cache destegi sunar. Effort seviyesi low'dan max'a kadar ayarlanabilir; kisa isler icin dusuk, zor ajan islerinde yuksek seviye tercih edilir. ## Claude Opus 4.8 (anthropic/claude-opus-4.8) URL: /models/anthropic/claude-opus-4.8 Provider: Anthropic Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 25 USD Summary: Zor reasoning, kod ve uzun soluklu ajan işleri için stabil Opus modeli. Description: Karmasik reasoning, buyuk kod tabanlari, uzun sureli ajan gorevleri ve profesyonel bilgi isleri icin oturmus Opus secenegidir. 1M context, 128K maksimum cikti ve gorsel girdi sunar. Mevcut entegrasyonlarda guclu kalir; yeni entegrasyonlarda Opus 5 daha guncel secimdir. ## Claude Opus 4.7 (anthropic/claude-opus-4.7) URL: /models/anthropic/claude-opus-4.7 Provider: Anthropic Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 25 USD Summary: Zor kod, derin analiz ve uzun soluklu ajan işleri için önceki nesil Opus. Description: Karmasik reasoning, buyuk kod tabanlari, uzun sureli ajan gorevleri ve profesyonel bilgi isleri icin onceki nesil Opus modelidir. 1M context, 128K maksimum cikti ve yuksek cozunurluklu gorsel anlama sunar. Bu nesle gore ayarlanmis mevcut entegrasyonlarda anlamli kalir; yeni islerde Opus 5 daha guncel secimdir. ## Claude Opus 4.6 (anthropic/claude-opus-4.6) URL: /models/anthropic/claude-opus-4.6 Provider: Anthropic Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 25 USD Summary: Uzun soluklu ajanlar ve ağır kod işleri için en güçlü Claude modeli. Description: Buyuk kod tabanlari, zor code review, hata ayiklama ve uzun sureli agent gorevleri icin Anthropic'in en guclu Opus secenegidir. Kaliteden taviz vermeden zor profesyonel is akislari yuruten ekipler icin uygundur. ## Claude Opus 4.5 (anthropic/claude-opus-4.5) URL: /models/anthropic/claude-opus-4.5 Provider: Anthropic Context window: 200000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 25 USD Summary: Derin analiz ve üst seviye kod kalitesi için premium Opus modeli. Description: Derin analiz, kod kalitesi ve bilgi islerinde Opus kalitesini isteyen ekipler icin guclu secenektir. Yeni 4.6 ciksa da hala zor islerde yuksek tavan sunar. ## Claude Sonnet 5 (anthropic/claude-sonnet-5) URL: /models/anthropic/claude-sonnet-5 Provider: Anthropic Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 10 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 2.5 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 4 USD Summary: Kod, ajan ve uzun bağlamlı işler için yeni nesil Sonnet. Description: Sonnet 4.6'dan gecis icin konumlanan yeni nesil Sonnet modelidir. Kodlama, arac kullanan ajanlar, uzun dokuman analizi ve uretim asistanlarinda guclu hiz-kalite dengesi sunar. 1M context, 128K maksimum cikti, varsayilan adaptive thinking, gorsel girdi, tool calling ve prompt cache destegi vardir. ## Claude Sonnet 4.6 (anthropic/claude-sonnet-4.6) URL: /models/anthropic/claude-sonnet-4.6 Provider: Anthropic Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 3 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 15 USD Summary: Mevcut entegrasyonlar için güçlü, stabil Sonnet 4.6 seçeneği. Description: Kod, agent, bilgisayar kullanimi ve profesyonel ofis islerinde dengeli kalite-fiyat sunan onceki Sonnet amiral gemisidir. Mevcut sistemlerde guclu kalir; yeni entegrasyonlarda Sonnet 5 daha guncel secimdir. ## Claude Sonnet 4.5 (anthropic/claude-sonnet-4.5) URL: /models/anthropic/claude-sonnet-4.5 Provider: Anthropic Context window: 200000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 3 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 15 USD Summary: Kod yardımı ve günlük ajan işleri için güçlü önceki Sonnet modeli. Description: Uretimde cogu is yukunu tasiyabilecek dengeli bir Claude secenegidir. 4.6'ya cikmadan once oturmus Sonnet davranisi isteyen ekipler icin mantiklidir. ## Claude Haiku 4.5 (anthropic/claude-haiku-4.5) URL: /models/anthropic/claude-haiku-4.5 Provider: Anthropic Context window: 200000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 5 USD Summary: Gunluk gorevler icin hizli ve ekonomik Claude. Description: Siniflandirma, destek akislar, ozetleme ve hizli yardimci senaryolarinda iyi calisir. Sonnet veya Opus'a cikmadan once butce dostu ilk Claude secenegidir. ## Qwen3.8-Max (qwen/qwen3.8-max) URL: /models/qwen/qwen3.8-max Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.25 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 6 USD Summary: Uzun soluklu ajan görevleri, görsel anlama ve kod üretimi için Qwen'in üst seviye modeli. Description: Qwen3.8-Max, metnin yanında görsel ve video girdilerini de anlayan üst seviye Qwen modelidir. Uzun soluklu ajan görevleri, çok adımlı kod çalışmaları, uzun dokümanların analizi ve araç kullanan akışlar için uygundur. 1M bağlam penceresi sunar ve tek yanıtta en fazla 128K token üretir. Varsayılan olarak thinking açık gelir; daha düşük gecikme gereken işlerde model son eki veya istek gövdesi üzerinden kapatılabilir. ## Qwen3.7-Max (qwen/qwen3.7-max) URL: /models/qwen/qwen3.7-max Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2.5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 7.5 USD Summary: Zor ajan gorevleri ve kontrollu thinking icin Qwen'in en yeni Max modeli. Description: Qwen3.7-Max, Qwen ailesinin yeni ust seviye metin modelidir. Varsayilan olarak thinking acik gelir; daha dusuk gecikme gereken islerde slug suffix veya body uzerinden thinking kapatilabilir. Kod, arastirma, arac kullanimi ve cok adimli talimat takibi icin uygundur. ## Qwen3.8 2.4T A95B (qwen/qwen3.8-2.4t-a95b) URL: /models/qwen/qwen3.8-2.4t-a95b Provider: Qwen Context window: 262144 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 6 USD Summary: Kodlama, arastirma ve uzun soluklu ajan akislari icin 262K baglamli, acik agirlikli Qwen3.8 modeli. Description: Qwen3.8 2.4T A95B, Qwen3.8 neslinin acik agirlikli surumudur: 2,4 trilyon parametrenin token basina 95 milyari calisan seyrek bir Mixture-of-Experts modelidir. Kod yazma, arastirma ve cok adimli bir isi sonuna kadar goturmesi gereken uzun soluklu ajan akislari icin tasarlanmistir. 262.144 tokenlik baglam penceresi, yerel arac cagrisi, JSON Schema ile sema zorlamali cikti ve tekrarlanan onekleri ucuzlatan prompt cache sunar. Adim adim dusunme her zaman aciktir ve yanittan ayri doner; bu yuzden kisa bir soru bile dusunme tokeni harcayabilir, `max_tokens` degerini buna gore verin. Yalnizca metin kabul eder: gorsel, ses ve video girdisi desteklemez. Cikti icin ayri bir tavan yoktur, sinir baglam penceresinin kendisidir. ## Qwen3.7-Plus (qwen/qwen3.7-plus) URL: /models/qwen/qwen3.7-plus Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.4 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.6 USD Summary: Gorsel, video ve metin girdili ajan akislari icin dengeli Qwen3.7 modeli. Description: Qwen3.7-Plus, metinle birlikte gorsel ve video girdilerini anlayan Qwen3.7 modelidir. Ekran okuma, GUI tabanli ajanlar, gorsel referanstan kod uretimi, arac kullanimi ve uzun baglamli yardimci akislar icin dengeli bir secenektir. Varsayilan olarak thinking acik gelir; daha dusuk gecikme gereken islerde slug suffix veya body uzerinden kapatilabilir. ## Qwen3.8-Flash (qwen/qwen3.8-flash) URL: /models/qwen/qwen3.8-flash Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.16 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.016 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.47 USD Summary: Uzun belgeler, görsel analiz ve araç kullanan uygulamalar için 1M bağlamlı Qwen Flash modeli. Description: Qwen3.8-Flash, uzun belgeleri, görselleri ve videoları aynı konuşmada inceleyen uygulamalar için Qwen'in düşük maliyetli Flash modelidir. 1.000.000 token bağlam ve 131.072 token çıktı sınırı sunar. Kod yardımı, belge özeti, görsel soru yanıtlama ve araç kullanan akışlarda kullanılabilir; JSON Schema ile yapılandırılmış metin üretir. Thinking varsayılan açıktır ve kapatılabilir. Tekrarlanan istem öneklerinde cache isabeti girdi maliyetini düşürür; uzun girdiler için ayrı bir fiyat kademesi yoktur. ## Qwen3.6-Flash (qwen/qwen3.6-flash) URL: /models/qwen/qwen3.6-flash Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.25 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.5 USD Summary: Gunluk metin isleri ve yardimci akislari icin genel Qwen modeli. Description: Qwen3.6-Flash, Qwen ailesi icinde genel kullanimli bir model secenegidir. Fiyat, hiz ve kapasite dengesi slug varyantina gore degisir. ## Qwen-Plus (qwen/qwen-plus) URL: /models/qwen/qwen-plus Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.040000 USD Summary: Uzun baglamli yardimcilar ve aracli urun akislari icin dengeli Qwen modeli. Description: Qwen-Plus, guclu reasoning, uzun baglam ve arac kullanimi ile cok amacli gorevler icin dengeli bir genel modeldir. Tek modelle genis urun yuzeyi kapsamak isteyen ekipler icin iyi default olur. ## Qwen-Plus-2025-01-25 (qwen/qwen-plus-2025-01-25) URL: /models/qwen/qwen-plus-2025-01-25 Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.4 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.2 USD Summary: Uzun baglamli yardimcilar ve aracli urun akislari icin dengeli Qwen modeli; tarihli snapshot surumu. Description: Qwen-Plus-2025-01-25, guclu reasoning, uzun baglam ve arac kullanimi ile cok amacli gorevler icin dengeli bir genel modeldir. Tek modelle genis urun yuzeyi kapsamak isteyen ekipler icin iyi default olur. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen-Plus-2025-04-28 (qwen/qwen-plus-2025-04-28) URL: /models/qwen/qwen-plus-2025-04-28 Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.4 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.2 USD Summary: Uzun baglamli yardimcilar ve aracli urun akislari icin dengeli Qwen modeli; tarihli snapshot surumu. Description: Qwen-Plus-2025-04-28, guclu reasoning, uzun baglam ve arac kullanimi ile cok amacli gorevler icin dengeli bir genel modeldir. Tek modelle genis urun yuzeyi kapsamak isteyen ekipler icin iyi default olur. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen-Plus-2025-07-14 (qwen/qwen-plus-2025-07-14) URL: /models/qwen/qwen-plus-2025-07-14 Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.4 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.2 USD Summary: Uzun baglamli yardimcilar ve aracli urun akislari icin dengeli Qwen modeli; tarihli snapshot surumu. Description: Qwen-Plus-2025-07-14, guclu reasoning, uzun baglam ve arac kullanimi ile cok amacli gorevler icin dengeli bir genel modeldir. Tek modelle genis urun yuzeyi kapsamak isteyen ekipler icin iyi default olur. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen-Plus-2025-07-28 (qwen/qwen-plus-2025-07-28) URL: /models/qwen/qwen-plus-2025-07-28 Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.400000 USD Summary: Uzun baglamli yardimcilar ve aracli urun akislari icin dengeli Qwen modeli; tarihli snapshot surumu. Description: Qwen-Plus-2025-07-28, guclu reasoning, uzun baglam ve arac kullanimi ile cok amacli gorevler icin dengeli bir genel modeldir. Tek modelle genis urun yuzeyi kapsamak isteyen ekipler icin iyi default olur. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen-Plus-2025-09-11 (qwen/qwen-plus-2025-09-11) URL: /models/qwen/qwen-plus-2025-09-11 Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.400000 USD Summary: Uzun baglamli yardimcilar ve aracli urun akislari icin dengeli Qwen modeli; tarihli snapshot surumu. Description: Qwen-Plus-2025-09-11, guclu reasoning, uzun baglam ve arac kullanimi ile cok amacli gorevler icin dengeli bir genel modeldir. Tek modelle genis urun yuzeyi kapsamak isteyen ekipler icin iyi default olur. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen-Plus-Character-Ja (qwen/qwen-plus-character-ja) URL: /models/qwen/qwen-plus-character-ja Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.5 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.4 USD Summary: Karakter tutarliligi ve rol yapma icin ozel Qwen modeli. Description: Qwen-Plus-Character-Ja, karakter sesi, uzun diyalog tutarliligi ve rol yapma senaryolari icin optimize edilmistir. Ozellikle yaratici yazim ve persona tabanli uygulamalarda one cikar. ## Qwen-Plus-Latest (qwen/qwen-plus-latest) URL: /models/qwen/qwen-plus-latest Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.400000 USD Summary: Uzun baglamli yardimcilar ve aracli urun akislari icin dengeli Qwen modeli. Description: Qwen-Plus-Latest, guclu reasoning, uzun baglam ve arac kullanimi ile cok amacli gorevler icin dengeli bir genel modeldir. Tek modelle genis urun yuzeyi kapsamak isteyen ekipler icin iyi default olur. ## Qwen3-Max (qwen/qwen3-max) URL: /models/qwen/qwen3-max Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.120000 USD Summary: Zor ajan gorevleri ve derin reasoning icin ust seviye Qwen modeli. Description: Qwen3-Max, derin reasoning, arac kullanimi ve daha zor talimat takibi isteyen gorevler icin Qwen ailesinin ust seviye seceneklerinden biridir. Yuksek kalite isteyen agent ve arastirma akislarinda anlamlidir. ## Qwen3-Max-2025-09-23 (qwen/qwen3-max-2025-09-23) URL: /models/qwen/qwen3-max-2025-09-23 Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 1.200000 USD Summary: Zor ajan gorevleri ve derin reasoning icin ust seviye Qwen modeli; tarihli snapshot surumu. Description: Qwen3-Max-2025-09-23, derin reasoning, arac kullanimi ve daha zor talimat takibi isteyen gorevler icin Qwen ailesinin ust seviye seceneklerinden biridir. Yuksek kalite isteyen agent ve arastirma akislarinda anlamlidir. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen3-Max-2026-01-23 (qwen/qwen3-max-2026-01-23) URL: /models/qwen/qwen3-max-2026-01-23 Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 1.200000 USD Summary: Zor ajan gorevleri ve derin reasoning icin ust seviye Qwen modeli; tarihli snapshot surumu. Description: Qwen3-Max-2026-01-23, derin reasoning, arac kullanimi ve daha zor talimat takibi isteyen gorevler icin Qwen ailesinin ust seviye seceneklerinden biridir. Yuksek kalite isteyen agent ve arastirma akislarinda anlamlidir. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen3-Max-Preview (qwen/qwen3-max-preview) URL: /models/qwen/qwen3-max-preview Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.240000 USD Summary: Zor ajan gorevleri ve derin reasoning icin ust seviye Qwen modeli; preview surumu. Description: Qwen3-Max-Preview, derin reasoning, arac kullanimi ve daha zor talimat takibi isteyen gorevler icin Qwen ailesinin ust seviye seceneklerinden biridir. Yuksek kalite isteyen agent ve arastirma akislarinda anlamlidir. Preview varyanti, genel kullanima acilmadan once yeni davranislari erken denemek isteyen ekipler icindir. ## Qwen3.6-Plus (qwen/qwen3.6-plus) URL: /models/qwen/qwen3.6-plus Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.050000 USD Summary: Uzun baglamli yardimcilar ve aracli urun akislari icin dengeli Qwen modeli. Description: Qwen3.6-Plus, guclu reasoning, uzun baglam ve arac kullanimi ile cok amacli gorevler icin dengeli bir genel modeldir. Tek modelle genis urun yuzeyi kapsamak isteyen ekipler icin iyi default olur. ## Qwen3.6-Plus-2026-04-02 (qwen/qwen3.6-plus-2026-04-02) URL: /models/qwen/qwen3.6-plus-2026-04-02 Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.500000 USD Summary: Uzun baglamli yardimcilar ve aracli urun akislari icin dengeli Qwen modeli; tarihli snapshot surumu. Description: Qwen3.6-Plus-2026-04-02, guclu reasoning, uzun baglam ve arac kullanimi ile cok amacli gorevler icin dengeli bir genel modeldir. Tek modelle genis urun yuzeyi kapsamak isteyen ekipler icin iyi default olur. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## GLM-5.3-Flash (zai/glm-5.3-flash) URL: /models/zai/glm-5.3-flash Provider: Z.AI Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.075 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.015 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.25 USD Summary: 1M bağlamlı görsel kodlama ve hızlı ajan işleri için GLM-5.3-Flash. Description: GLM-5.3-Flash; ekran görüntüsü, arayüz ve diyagram gibi görselleri kod ve metinle birlikte işleyen, function calling destekli bir Z.AI modelidir. 1M bağlam penceresi uzun çalışma oturumlarına alan açar. Akıl yürütme her yanıtta çalışır; düz isteklerde low kullanılır, daha zor görevler için high veya max seçilebilir. ## GLM-5.3 (zai/glm-5.3) URL: /models/zai/glm-5.3 Provider: Z.AI Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.26 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.234 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 3.96 USD Summary: 1M baglamli kod ve uzun soluklu ajan isleri icin GLM-5.3. Description: GLM-5.3, 1M context penceresiyle uzun kod tabanlari, cok adimli ajan akislari, function calling ve terminal isleri icin Z.AI'nin amiral gemisi metin modelidir. Akil yurutme her yanitta calisir ve kapatilamaz; derinligi low, high ve max seviyeleriyle ayarlarsiniz. LLMTR duz istekleri low ile gonderir, zor gorevlerde :high veya :max secebilirsiniz. Gorsel girdi kabul etmez. ## GLM-5.2 (zai/glm-5.2) URL: /models/zai/glm-5.2 Provider: Z.AI Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.26 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.234 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 3.96 USD Summary: 1M contextli uzun kod, ajan ve function calling işleri için GLM-5.2. Description: GLM-5.2, 1M context penceresiyle uzun kod tabanları, çok adımlı ajan akışları, function calling ve üretim mühendisliği işleri için Z.AI'nin en yeni metin amiral gemisidir. Düz isteklerde thinking kapalı tutulabilir; zor görevlerde reasoning effort seviyesi seçilebilir. ## GLM-5.1 (zai/glm-5.1) URL: /models/zai/glm-5.1 Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.26 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.234 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 3.96 USD Summary: Agentic engineering icin Z.AI'nin en guclu modeli. Description: Kod yazmaktan proje cikarmaya giden daha uzun akislarda, arac kullanimi ve sistematik execution ile gucludur. Z.AI tarafinda en iddiali genel secenektir. ## GLM-5 (zai/glm-5) URL: /models/zai/glm-5 Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.9 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.18 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.88 USD Summary: Uzun ufuklu kod ve ajan isleri icin guclu GLM modeli. Description: Arka uclarda refactor, derin hata ayiklama ve cok adimli muhendislik islerinde guclu davranir. Acik agirlik cephesinde ust seviye performans isteyen ekipler icin dikkat cekici secenektir. ## GLM-5-Turbo (zai/glm-5-turbo) URL: /models/zai/glm-5-turbo Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.08 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.216 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 3.6 USD Summary: Uzun görev zincirleri ve araç kullanımı için hızlı GLM modeli. Description: Komut takibi, arac cagirma ve uzun gorev zincirlerinde ozellikle iyi ayarlanmis bir varyanttir. Agent altyapisinda hiz ile yetenegi birlikte isteyen ekipler icin uygundur. ## GLM-5V-Turbo (zai/glm-5v-turbo) URL: /models/zai/glm-5v-turbo Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.08 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.216 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 3.6 USD Summary: Gorsel kodlama ve GUI anlama icin GLM'nin guclu multimodal modeli. Description: Ekran goruntusu, video, dosya ve metni birlikte anlayarak planning ve coding gorevlerinde deger uretir. Ozellikle vision tabanli agent ve tasarimdan koda akislarda one cikar. ## DeepSeek V4 Flash (deepseek/deepseek-v4-flash) URL: /models/deepseek/deepseek-v4-flash Provider: DeepSeek Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.22 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.007 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.66 USD Summary: Uzun bağlamlı ajan akışları ve hızlı reasoning için DeepSeek V4 modeli. Description: DeepSeek-V4-Flash: genis baglam, arac cagrilari, JSON cikti ve istege bagli thinking. Maliyet ve gecikme hassas is yukleri icin Pro'ya gore daha uygun giris noktasidir. DeepSeek bu model icin yogun saat fiyatlandirmasi uyguluyor: hafta ici (Pazartesi-Cuma, Pekin saati) 01:00-04:00 ve 06:00-10:00 UTC arasinda tum token kalemleri iki katina cikar. Hafta sonlari gun boyu normal fiyattan faturalanir. ## DeepSeek V4 Flash Vision Exp (deepseek/deepseek-v4-flash-vision-exp) URL: /models/deepseek/deepseek-v4-flash-vision-exp Provider: DeepSeek Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.22 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.007 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.66 USD Summary: Görsel analiz, uzun bağlam ve multimodal görevler için deneysel DeepSeek V4 Flash Vision modeli. Description: Deneysel DeepSeek V4 Flash Vision modeli. 1M token bağlam penceresi ve 384K'ya kadar maksimum çıktı desteği sunar. Araç çağırma ve prompt önbellekleme desteği içerir. Görsel girdiler hem base64 data URI hem de uzak https adresi olarak kabul edilir ve görüntü boyutlarına göre tokenlaştırılarak giriş tokenlarına dahil edilir. ## DeepSeek V4 Pro (deepseek/deepseek-v4-pro) URL: /models/deepseek/deepseek-v4-pro Provider: DeepSeek Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.66 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.022 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.98 USD Summary: Agir muhakeme ve kod icin premium DeepSeek V4. Description: DeepSeek-V4-Pro, zor reasoning, ajan ve kod islerinde Flash'a gore daha yuksek kalite hedefleyen ekipler icin konumlanir. Ayni 1M baglam ve benzer kabiliyet setiyle daha yuksek birim fiyatla gelir. DeepSeek bu model icin yogun saat fiyatlandirmasi uyguluyor: hafta ici (Pazartesi-Cuma, Pekin saati) 01:00-04:00 ve 06:00-10:00 UTC arasinda tum token kalemleri iki katina cikar. Hafta sonlari gun boyu normal fiyattan faturalanir. ## Mistral Large 3 (mistral/mistral-large-latest) URL: /models/mistral/mistral-large-latest Provider: Mistral Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.5 USD Summary: Genel ürün yardımcıları ve görsel farkındalık için üst seviye Mistral modeli. Description: Genel amacli, multimodal ve yuksek kaliteli cikti isteyen ekipler icin Mistral tarafindaki en guclu secenektir. Hem ciddi urun islerinde hem de gorsel farkindalik gereken senaryolarda iyi calisir. ## Sonar (perplexity/sonar) URL: /models/perplexity/sonar Provider: Perplexity Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1 USD; CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 5 USD; CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 8 USD; CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 12 USD Summary: Hizli, kaynakli web cevaplari icin temel Sonar modeli. Description: Gercek zamanli web aramasi ile hizli ve uygun maliyetli grounded cevaplar verir. Guncel bilgi, hizli ozet ve dogrudan soru-cevap ihtiyaclarinda en pratik Perplexity girisidir. ## Mistral Small 4 (mistral/mistral-small-latest) URL: /models/mistral/mistral-small-latest Provider: Mistral Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.15 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.6 USD Summary: Günlük sohbet, reasoning ve kod yardımı için verimli hibrit Mistral modeli. Description: Tek modelle sohbet, kod ve akil yurutme islerini tasimak isteyen ekipler icin verimli bir Mistral secenegidir. Kaliteyi korurken maliyeti amiral geminin altinda tutar. ## Sonar Pro (perplexity/sonar-pro) URL: /models/perplexity/sonar-pro Provider: Perplexity Context window: 200000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 3 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 15 USD; CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 6 USD; CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 10 USD; CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 14 USD; CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 14 USD; CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 18 USD; CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 22 USD Summary: Karmasik sorgular icin daha derin arama yapan Sonar. Description: Standart Sonar'a gore daha zengin arama ve daha derin icerik anlama sunar. Urun karsilastirma, piyasa tarama ve cok adimli bilgi toplama islerinde daha guclu davranir. ## Mistral Medium 3.1 (mistral/mistral-medium-latest) URL: /models/mistral/mistral-medium-latest Provider: Mistral Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.4 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2 USD Summary: Araçlı ürün akışları ve planning için frontier seviye Mistral modeli. Description: Multimodal anlayis, daha guclu planning ve araca dayali akislarda amiral gemi ile kucuk modeller arasinda iyi denge sunar. Uretim olceginde akilli genel model arayan ekipler icin uygundur. ## Sonar Reasoning Pro (perplexity/sonar-reasoning-pro) URL: /models/perplexity/sonar-reasoning-pro Provider: Perplexity Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 8 USD; CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 6 USD; CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 10 USD; CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 14 USD Summary: Web kaynaklarını sentezleyerek zor karşılaştırmalar yapmak için Sonar modeli. Description: Kaynak toplamayi adim adim muhakeme ile birlestirdigi icin zor karsilastirma ve sentez islerinde gucludur. Hizdan biraz feragat edip daha dusunulmus cevap istendiginde tercih edilir. ## Devstral 2 (mistral/devstral-medium-latest) URL: /models/mistral/devstral-medium-latest Provider: Mistral Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.4 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2 USD Summary: Yazilim muhendisligi ve kod ajanlari icin guclu Mistral modeli. Description: Depo anlama, uygulama, refactor ve hata ayiklama gibi yazilim islerinde agentic calisma tarziyla gucludur. Kod odakli urunler icin Mistral tarafindaki ana seceneklerden biridir. ## Inkling (thinkingmachines/inkling) URL: /models/thinkingmachines/inkling Provider: Thinking Machines Context window: 262144 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.87 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.374 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 4.68 USD Summary: Thinking Machines'in 975B açık ağırlıklı MoE hibrit reasoning modeli; reasoning eforu none–xhigh arası ayarlanır. Description: Inkling, Thinking Machines'in açık ağırlıklı amiral gemisi modelidir: 975 milyar toplam, token başına 41 milyar aktif parametreli bir Mixture-of-Experts mimarisi. Yanıt vermeden önce adım adım düşünür ve bu düşünme eforunu istek başına ayarlayabilirsiniz — `reasoning_effort` ile none (kapalı) ile xhigh arasında altı seviye. Görseli base64 veri URL'si olarak, sesi WAV olarak kabul eder; araç/fonksiyon çağrısı yapar, JSON nesne çıktısı üretir ve prompt cache okumasını destekler. 256K bağlam penceresi sunar. Reasoning tokenları `completion_tokens` içinde döner ve çıktı olarak ücretlendirilir. ## Inkling Small (thinkingmachines/inkling-small) URL: /models/thinkingmachines/inkling-small Provider: Thinking Machines Context window: 262144 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.58 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.116 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.44 USD Summary: Yüksek hacimli reasoning işleri için Inkling'in üçte bir fiyatlı 276B açık ağırlıklı MoE modeli. Description: Inkling Small, Thinking Machines'in açık ağırlıklı MoE ailesinin küçük üyesidir: 276 milyar toplam, token başına 12 milyar aktif parametre. Inkling ile aynı mimariyi ve hibrit reasoning davranışını taşır, yaklaşık üçte bir fiyata çalışır. Yanıt vermeden önce adım adım düşünür ve bu eforu `reasoning_effort` ile none (kapalı) ile xhigh arasında altı seviyede ayarlarsınız. Görseli base64 veri URL'si olarak, sesi WAV olarak kabul eder; araç/fonksiyon çağrısı yapar, JSON nesne çıktısı üretir ve prompt cache okumasını destekler. 256K bağlam penceresi sunar. Reasoning tokenları `completion_tokens` içinde döner ve çıktı olarak ücretlendirilir. ## MiMo V2.5 Pro (mimo/mimo-v2.5-pro) URL: /models/mimo/mimo-v2.5-pro Provider: Xiaomi MiMo Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 5 USD Summary: Uzun bağlamlı üretim yardımcıları için üst seviye MiMo 2.5 modeli. Description: Uzun bağlam, araç kullanımı ve daha kaliteli üretim isteyen ekipler için MiMo 2.5 çizgisinin amiral gemisi seçeneğidir. `mimo/mimo-v2-pro` yerine kullanılacak yeni canonical kimliktir ve güncel pay-as-you-go fiyatlarıyla çalışır. ## Recraft V4 (recraft/recraft-v4) URL: /models/recraft/recraft-v4 Provider: Recraft Context window: 10000 Operations: IMAGES_GENERATIONS Modalities: image, text Pricing: IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.04 USD Summary: Marka görselleri ve ürün sahneleri için güncel Recraft raster modeli. Description: Marka görselleri, kampanya kreatifleri ve ürün sahneleri için hızlı ama kaliteli text-to-image üretimi sunar. Güncel Recraft çizgisinde genel amaçlı güvenli başlangıç noktasıdır. ## Recraft V4 Pro (recraft/recraft-v4-pro) URL: /models/recraft/recraft-v4-pro Provider: Recraft Context window: 10000 Operations: IMAGES_GENERATIONS Modalities: image, text Pricing: IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.25 USD Summary: Premium kampanya kreatifi ve detaylı sahneler için Recraft V4 Pro. Description: Detay, kontrol ve premium çıktı kalitesi daha önemli olduğunda standart V4'ün üstüne çıkar. Pazarlama kreatifi ve yüksek görünürlüklü görsel üretiminde güçlüdür. ## MiMo V2.5 (mimo/mimo-v2.5) URL: /models/mimo/mimo-v2.5 Provider: Xiaomi MiMo Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio, video Pricing: CHAT_COMPLETIONS/REQUEST/PER_1K_CALLS: 5 USD Summary: Metin, görsel ve web destekli yardımcılar için dengeli MiMo 2.5 modeli. Description: Metin, görsel ve daha zengin yardımcı akışlarını tek modelde toplamak isteyen ekipler için dengeli bir seçenektir. `mimo/mimo-v2-omni` ve `mimo/mimo-v2-flash` yerine kullanılacak yeni canonical kimliktir. ## Krea 2 Medium (krea/krea-2-medium) URL: /models/krea/krea-2-medium Provider: Krea Context window: 10000 Operations: IMAGES_GENERATIONS Modalities: image, text Pricing: IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.03 USD Summary: Hizli ve uygun maliyetli metinden gorsel uretimi icin Krea 2 Medium. Description: Krea 2 ailesinin hizli varyantidir; illustrasyon, anime ve ifade gucu yuksek stillerde uretimler arasinda istikrarli ciktilar verir. Hizli iterasyon ve genel amacli gorsel uretimi icin uygun bir baslangic noktasidir. ## Krea 2 Large (krea/krea-2-large) URL: /models/krea/krea-2-large Provider: Krea Context window: 10000 Operations: IMAGES_GENERATIONS Modalities: image, text Pricing: IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.06 USD Summary: Fotograf gercekciligi ve en esnek ciktilar icin Krea 2 Large. Description: Krea 2 ailesinin daha buyuk varyantidir; fotograf gercekciligi, ham dokular ve daha esnek ciktilar gerektiginde one cikar. Kalite ve dokusal zenginligin oncelikli oldugu islerde tercih edilir. ## Fugu Ultra (sakana/fugu-ultra) URL: /models/sakana/fugu-ultra Provider: Sakana AI Context window: 1000000 Operations: CHAT_COMPLETIONS, RESPONSES Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 5 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 30 USD; RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 5 USD; RESPONSES/CACHE_READ/PER_1M_TOKENS: 0.5 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 30 USD Summary: Sakana AI'nin zor reasoning, kodlama ve arastirma isleri icin multi-agent modeli. Description: Fugu Ultra, Sakana AI'nin OpenAI uyumlu multi-agent reasoning modelidir. Zor kodlama, guvenlik analizi, bilimsel arastirma ve uzun baglamli sentez islerinde daha derin uzman ajan havuzu kullanir. ## Apertus v1.5 8B (publicai/apertus-v1.5-8b) URL: /models/publicai/apertus-v1.5-8b Provider: PublicAI Context window: 262144 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.2 USD Summary: Görsel okuma, araç kullanımı ve 262K bağlam sunan hızlı Apertus modeli. Description: Apertus v1.5 8B, metin ve görsel girdiyi birlikte işleyebilen açık ağırlıklı bir modeldir. 262.144 token bağlam penceresiyle uzun dokümanları tek istekte değerlendirebilir; görselleri okuyup içeriğini açıklayabilir. Sohbet, özetleme, sınıflandırma, veri dönüştürme ve JSON formatında çıktı bekleyen akışlar için hızlı ve ekonomik bir seçenektir. Function calling desteklediği için araç çağıran kod ve sohbet uygulamalarıyla birlikte kullanılabilir. Görseller yalnızca base64 data URL olarak gönderilir. ## Apertus v1.5 70B (publicai/apertus-v1.5-70b) URL: /models/publicai/apertus-v1.5-70b Provider: PublicAI Context window: 262144 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.82 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.92 USD Summary: Görsel okuma, araç kullanımı ve 262K bağlam sunan büyük Apertus modeli. Description: Apertus v1.5 70B, ailenin en büyük modeli olup metin ve görsel girdiyi birlikte işler. 262.144 token bağlam penceresiyle uzun dokümanları, kod tabanlarını ve çok turlu konuşmaları tek istekte değerlendirebilir. Bilgi sentezi, analiz, çok dilli yardımcı akışlar, içerik taslağı ve kod yardımı gibi kalitenin öne çıktığı işlerde 8B sürümünden daha güçlü sonuç verir. Function calling ve JSON formatında çıktı desteklediği için araç çağıran kod ve sohbet uygulamalarıyla birlikte kullanılabilir. Görseller yalnızca base64 data URL olarak gönderilir. ## MiniMax M3 (minimax/minimax-m3) URL: /models/minimax/minimax-m3 Provider: MiniMax Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.3 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.06 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.2 USD Summary: Kod, ajan akislari ve 1M baglamli multimodal isler icin MiniMax frontier modeli. Description: MiniMax M3, kodlama, ajan tabanli is akislari, uzun baglamli analiz ve gorsel/video girdili uygulamalar icin konumlanan MiniMax frontier modelidir. 1 milyon token baglam penceresi, OpenAI uyumlu Chat Completions cagrilari, function calling, prompt cache ve adaptive thinking kontroluyle uretim entegrasyonlarinda kullanilir. ## MiniMax M3 (Ucretsiz) (minimax/minimax-m3-free) URL: /models/minimax/minimax-m3-free Provider: MiniMax Context window: 1048576 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0 USD Summary: Kod, ajan akislari ve 1M baglamli multimodal isler icin MiniMax M3'un ucretsiz surumu. Gunluk kotali. Description: MiniMax M3'un ucretsiz sunulan surumudur. Model kodlama, ajan tabanli is akislari, uzun baglamli analiz ve gorsel/video girdili uygulamalar icin kullanilir; 1 milyon token baglam penceresi, function calling, prompt cache ve adaptive thinking kontrollerini destekler. Tek yanit en fazla 524.288 token olabilir. Ucretli MiniMax M3 satirindan tek farki calisma sekli degil, sunulus bicimidir: bu satir gunluk paylasimli bir kullanim kotasina tabidir ve kota dolunca istekler 429 ile reddedilir, faturaniza hicbir sey yansimaz. Istekler yurt disindaki ucuncu taraf bir altyapi uzerinden islenir. Kesintisiz ve kotasiz kullanim icin ucretli MiniMax M3 satirini tercih edin. ## MiniMax M2.7 (minimax/minimax-m2.7) URL: /models/minimax/minimax-m2.7 Provider: MiniMax Context window: 204800 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.3 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.06 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.2 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.375 USD Summary: Kod, ofis isleri ve uzun baglamli ajan akislari icin MiniMax M2 modeli. Description: MiniMax M2.7, kodlama, dokuman uretimi, hata ayiklama, cok adimli is akislari ve uzun baglamli asistan senaryolari icin konumlanan metin modelidir. 204.800 token baglam penceresiyle buyuk konusma gecmisi, genis talimat setleri ve agent odakli muhakeme gerektiren islerde kullanilir. ## Muse Spark 1.3 (meta/muse-spark-1.3) URL: /models/meta/muse-spark-1.3 Provider: Meta Context window: 1048576 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.25 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.15 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 4.25 USD Summary: Uzun soluklu kodlama ve cok adimli ajan isleri icin ayarlanmis, 1M token baglamli guncel Muse Spark checkpoint'i; 1.2 ile ayni fiyattadir. Description: Muse Spark 1.3, Meta'nin kodlama ve ajan akislari icin ayarlanmis Muse Spark ailesinin guncel checkpoint'idir. Uzun soluklu kodlama gorevleri ve cok adimli ajan donguleri (arac, tarayici ve bilgisayar kullanimi dahil) icin ayarlanmistir; Meta'nin duyurusuna gore ayni isi 1.2'den daha az token harcayarak bitirebilir. 1.048.576 tokenlik baglam penceresi, gorsel/video/PDF girdisi, arac cagrisi, JSON ve yapilandirilmis cikti destegi ve fiyati 1.2 ile aynidir. Yanit vermeden once adim adim dusunur; bu dusunme eforunu `reasoning_effort` ile minimal, low, medium, high ve xhigh arasinda ayarlarsiniz. Ayni istemi tekrar gonderdiginizde prompt cache indirimi devreye girebilir. Reasoning tokenlari `completion_tokens` icinde doner ve cikti olarak ucretlendirilir. ## Muse Glimmer 30B (meta/muse-glimmer-30b) URL: /models/meta/muse-glimmer-30b Provider: Meta Context window: 131072 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.35 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.04 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.5 USD Summary: Uzun soluklu ajan akislari icin ayarlanmis, 131K baglamli acik agirlikli reasoning modeli; gorsel ve video okur. Description: Muse Glimmer 30B, Meta'nin Apache 2.0 lisansiyla yayinladigi 29,8 milyar parametreli acik agirlikli modelidir. Saatlerce suren, arac cagirarak ilerleyen ajan akislari icin ayarlanmistir: guvenilir arac kullanimi, uzun gorevlerde durum takibi ve hatadan toparlanma bu modelin oncelikleridir. 131.072 tokenlik baglam penceresiyle genis bir kod tabanini veya uzun bir arac dongusunu tek oturumda tutabilirsiniz. Metnin yani sira gorsel ve video girdisi kabul eder; arac/fonksiyon cagrisi yapar, JSON nesne ciktisi ve semaya uyan yapilandirilmis cikti uretir. Yanit vermeden once adim adim dusunur ve bu eforu `reasoning_effort` ile none, minimal, low, medium, high, xhigh ve max arasinda ayarlarsiniz. Dikkat: `none` seviyesi dusunmeyi kapatmaz, yalnizca en dusuk kademedir; model her durumda bir dusunme izi uretir ve bu tokenlar cikti olarak ucretlendirilir. Ayni istemi tekrar gonderdiginizde prompt cache indirimi devreye girer. ## Nemotron 3 Ultra 550B A55B (nvidia/nemotron-3-ultra-550b-a55b) URL: /models/nvidia/nemotron-3-ultra-550b-a55b Provider: NVIDIA Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0 USD Summary: Zor reasoning ve ajan görevleri için günlük kotayla ücretsiz sunulan en büyük Nemotron modeli. Description: Nemotron 3 Ultra, NVIDIA'nın en büyük açık ağırlıklı modelidir (550B toplam, 55B aktif parametre). 1M token bağlam penceresiyle uzun doküman analizi, çok adımlı reasoning, function calling ve JSON çıktı gerektiren ajan akışlarında kullanılır. Günlük kullanım kotasıyla ücretsiz sunulur; kota dolduğunda istekler ertesi güne kadar sınırlandırılır. ## Kimi K3 (moonshot/kimi-k3) URL: /models/moonshot/kimi-k3 Provider: Moonshot AI (Kimi) Context window: 1048576 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 3 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.3 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 15 USD Summary: 1M token context ve kapatılabilir thinking ile Kimi amiral gemisi. Description: Moonshot AI Kimi K3; uzun bağlamlı analiz, çok adımlı ajan akışları ve görsel anlama için güncel Kimi amiral gemisi modelidir. 1.048.576 token context, görsel girdi (base64 data URL), function calling, JSON çıktı ve otomatik prompt cache destekler. Thinking varsayılan açıktır; istek gövdesinde reasoning:false veya :fast suffix'i ile kapatılabilir. Sampling değerleri sabittir (temperature=1, top_p=0.95); tool_choice auto, none veya required olabilir. Web araması bu modelde desteklenmez. Cached input $0.30/1M, cache miss input $3.00/1M ve output $15.00/1M olarak fiyatlanır. Reasoning tokenları output olarak faturalanır; kısa yanıtlarda bile max_tokens değerini yüksek tutun. ## Kimi K2.7 Code (moonshot/kimi-k2.7-code) URL: /models/moonshot/kimi-k2.7-code Provider: Moonshot AI (Kimi) Context window: 262144 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.95 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.19 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 4 USD; CHAT_COMPLETIONS/REQUEST/PER_CALL: 0.005 USD Summary: Kod ajanları, uzun bağlam ve araçlı teknik işler için güncel Kimi Code modeli. Description: Kimi K2.7 Code, kod üretimi, çok adımlı araç kullanımı, web araması ve uzun bağlamlı teknik analiz için Moonshot tarafındaki güncel üst seviye seçenektir. 262K context, görsel ve video girdisi, JSON çıktı, cache ve varsayılan thinking desteğiyle üretim ajanları için konumlanır. ## Kimi K2.6 (moonshot/kimi-k2.6) URL: /models/moonshot/kimi-k2.6 Provider: Moonshot AI (Kimi) Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.95 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.16 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 4 USD; CHAT_COMPLETIONS/REQUEST/PER_CALL: 0.005 USD Summary: Uzun bağlamlı araştırma ve araçlı multimodal işler için Kimi ailesinin amiral gemisi modeli. Description: Uzun bağlam, araç kullanımı, web araması ve daha zor görevlerde Moonshot tarafındaki en güçlü genel seçenek olarak konumlanır. Hem araştırma hem üretim odaklı ajan akışlarında üst seviye kalite arayan ekipler için uygundur. ## Step 3.7 Flash (stepfun/step-3.7-flash) URL: /models/stepfun/step-3.7-flash Provider: StepFun Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.2 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.04 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.15 USD Summary: Gorsel ve video girdili agent, kod ve reasoning isleri icin StepFun modeli. Description: Step 3.7 Flash, metin, gorsel ve video girdilerini Chat Completions uzerinden isleyebilen multimodal reasoning modelidir. Kod yardimi, cok adimli agent akislari, belge veya ekran goruntusu yorumlama ve uzun baglamli analizlerde kullanilir; reasoning_effort low, medium ve high seviyeleriyle gecikme/derinlik dengesi ayarlanabilir. ## Kimi K2.5 (moonshot/kimi-k2.5) URL: /models/moonshot/kimi-k2.5 Provider: Moonshot AI (Kimi) Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.6 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 3 USD; CHAT_COMPLETIONS/REQUEST/PER_CALL: 0.005 USD Summary: Metin ve görsel akışları için dengeli Kimi modeli. Description: Multimodal yardımcılar, belge yorumlama ve web destekli günlük işlerde güçlü bir orta katman sunar. K2.6'ya çıkmadan önce daha erişilebilir bir kalite seviyesi isteyen ekipler için mantıklıdır. ## Laguna XS 2.1 (poolside/laguna-xs-2.1) URL: /models/poolside/laguna-xs-2.1 Provider: Poolside Context window: 262144 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0 USD Summary: Hızlı ajan kodlama için Poolside'ın hafif modeli. Description: Kısa döngülü kod düzenleme, test yazma ve hızlı iterasyon gereken ajan akışları için tasarlanmıştır. S sınıfıyla aynı 262K bağlamı ve araç çağrısını korurken belirgin biçimde daha hızlı yanıt verir; ağır düşünme gerektirmeyen işlerde reasoning'i kapatarak gecikmeyi daha da düşürebilirsiniz. ## AionLabs: Aion 3.0 (aion-labs/aion-3.0) URL: /models/aion-labs/aion-3.0 Provider: AionLabs Context window: 131072 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 3 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.75 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 6 USD Summary: Uzun kurgu, roleplay ve karakter odakli diyaloglar icin AionLabs modeli. Description: Aion 3.0, uzun diyaloglar, karakter tutarliligi, gerilim kurma ve dallanan hikaye akislari icin konumlanan AionLabs modelidir. GLM ailesi uzerine kurulu coklu model yaklasimi, yazar asistanlari, interaktif kurgu urunleri ve roleplay uygulamalarinda daha yapili sahne ilerleyisi isteyen ekipler icin uygundur. 128K context, 32K maksimum cikti ve cache-read fiyatlandirmasi destekler. ## AionLabs: Aion 3.0 Mini (aion-labs/aion-3.0-mini) URL: /models/aion-labs/aion-3.0-mini Provider: AionLabs Context window: 131072 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.7 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.18 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.4 USD Summary: Yuksek hacimli roleplay ve kurgu akislari icin ekonomik Aion 3 modeli. Description: Aion 3.0 Mini, Aion 3 ailesinin daha dusuk maliyetli secenegidir. DeepSeek ailesi uzerine kurulu coklu model yapisi, roleplay, hikaye taslagi, karakter cevabi ve uzun sohbetlerde maliyeti kontrol ederken daha guclu anlatim yapisi isteyen urunler icin uygundur. 128K context, 32K maksimum cikti ve cache-read fiyatlandirmasi destekler. ## Grok 4.6 (xai/grok-4.6) URL: /models/xai/grok-4.6 Provider: xAI Context window: 500000 Operations: RESPONSES Modalities: text, image Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 2 USD; RESPONSES/CACHE_READ/PER_1M_TOKENS: 0.5 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 6 USD Summary: Kod, ajanlar ve bilgi işleri için xAI'nin en yetenekli Grok modeli. Description: Uzun kodlama oturumları, çok adımlı ajan akışları ve yoğun araştırma işleri için xAI'nin amiral modelidir. Metin ve görseli birlikte okur, araç çağrısı ve şemaya kısıtlı çıktı ile üretim akışlarına oturur. Düşünme derinliğini low, medium, high ve xhigh seviyeleriyle ayarlayarak hız ile derinlik arasında denge kurabilirsiniz; varsayılan seviye high'tır. ## Grok 4.5 (xai/grok-4.5) URL: /models/xai/grok-4.5 Provider: xAI Context window: 500000 Operations: RESPONSES Modalities: text, image Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 2 USD; RESPONSES/CACHE_READ/PER_1M_TOKENS: 0.3 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 6 USD Summary: Kod, ajanlar ve bilgi işleri için önceki nesil Grok modeli. Description: Kodlama, ajan akışları ve bilgi işleri için güçlü bir Grok seçeneğidir; yerini Grok 4.6 aldı. Metin ve görseli birlikte okur, araç çağrısı ve şemaya kısıtlı çıktı destekler. Düşünme derinliği low, medium ve high seviyeleriyle ayarlanır, varsayılan seviye high'tır. ## Grok 4.3 (xai/grok-4.3) URL: /models/xai/grok-4.3 Provider: xAI Context window: 1000000 Operations: RESPONSES Modalities: text Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 1.25 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 2.5 USD Summary: Uzun bağlamlı analiz ve kod için güçlü Grok modeli. Description: Büyük bağlam penceresi ile araştırma, belge analizi ve daha ağır yazılım işlerinde güçlü bir genel seçenektir. xAI ekosisteminde metin odaklı üst seviye kullanım isteyen ekipler için uygundur. ## Grok Imagine Video 1.5 (xai/grok-imagine-video-1.5) URL: /models/xai/grok-imagine-video-1.5 Provider: xAI Context window: 0 Operations: VIDEO_GENERATIONS Modalities: video, text, image, audio Pricing: VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.08 USD Summary: Sesli, görselden videoya üretim için Grok Imagine 1.5 modeli. Description: Bir başlangıç karesini akıcı harekete dönüştürmek isteyen ekipler için uygundur; ses, ambiyans ve konuşma aynı geçişte üretilir. Ürün tanıtımı, kısa sahne ve konsept animasyonlarında xAI'nin güncel image-to-video seçeneğidir. ## Voyage 4 Large (voyageai/voyage-4-large) URL: /models/voyageai/voyage-4-large Provider: Voyage AI Context window: 32000 Operations: EMBEDDINGS Modalities: text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.12 USD Summary: Voyage 4 ailesinin en yüksek doğruluklu genel amaçlı embedding modeli. Description: Voyage 4 Large, arama ve retrieval sistemleri için tasarlanmış genel amaçlı bir metin embedding modelidir. 32.000 tokenlık bağlam penceresiyle uzun dokümanları tek parça halinde vektörleştirir ve 256, 512, 1024 veya 2048 boyutlu çıktı üretebilir. Sorgu ile dokümanı ayrı ayrı işaretlemek için input_type parametresini destekler; bu, RAG yığınlarında isabet oranını artırır. int8, uint8 ve binary niceleme seçenekleriyle vektör veritabanı maliyetini düşürebilirsiniz. Katalogdaki en doğru sonucu veren Voyage embedding modelidir. ## Voyage 4 (voyageai/voyage-4) URL: /models/voyageai/voyage-4 Provider: Voyage AI Context window: 32000 Operations: EMBEDDINGS Modalities: text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.06 USD Summary: Doğruluk ile maliyet arasında dengeli genel amaçlı embedding modeli. Description: Voyage 4, üretim yükü altındaki arama ve retrieval sistemleri için dengeli bir seçimdir. Voyage 4 Large ile aynı 32.000 tokenlık pencereyi, aynı esnek boyut setini (256/512/1024/2048) ve aynı niceleme seçeneklerini sunar, milyon token başına yarı fiyata çalışır. Büyük doküman koleksiyonlarını baştan indekslerken maliyetin belirleyici olduğu işlerde tercih edilir. ## Voyage Code 4 (voyageai/voyage-code-4) URL: /models/voyageai/voyage-code-4 Provider: Voyage AI Context window: 32000 Operations: EMBEDDINGS Modalities: text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.12 USD Summary: Kodlama ajanları için eğitilmiş yeni nesil kod embedding modeli. Description: Voyage Code 4, Voyage Code 3'ün yerini alan ve özellikle kodlama ajanlarının ihtiyaç duyduğu retrieval için eğitilmiş bir embedding modelidir. Eğitim verisi, tamamlanmış pull request'lerden derlenmiştir; model bir hata bildirimi gibi belirsiz bir semptomdan yola çıkıp değiştirilmesi gereken dosyayı bulmayı öğrenir - grep'in "ne bozuk" türü sorgularda yetersiz kaldığı tam da bu adımdır. 256, 512, 1024 ve 2048 boyutlu çıktı (Matryoshka öğrenme) ile float32, int8, uint8 ve binary niceleme seçeneklerini destekler; 32.000 tokenlık pencere çoğu kaynak dosyayı tek parça halinde işler. Voyage Code 3'e göre milyon token başına üçte bir daha ucuzdur. ## Voyage Code 3 (voyageai/voyage-code-3) URL: /models/voyageai/voyage-code-3 Provider: Voyage AI Context window: 32000 Operations: EMBEDDINGS Modalities: text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.18 USD Summary: Kod arama ve depo indeksleme için özelleşmiş embedding modeli. Description: Voyage Code 3, kaynak kodu ve teknik doküman retrieval'ı için eğitilmiş bir embedding modelidir. Fonksiyon gövdeleri, tip tanımları ve doğal dilde yazılmış geliştirici sorguları arasındaki ilişkiyi genel amaçlı modellerden daha iyi yakalar. 32.000 tokenlık pencere çoğu kaynak dosyayı tek parça halinde işlemeye yeter. Kod asistanları, depo geneli arama ve teknik doküman retrieval'ı kuran ekipler için uygundur. ## Voyage Context 4 (voyageai/voyage-context-4) URL: /models/voyageai/voyage-context-4 Provider: Voyage AI Context window: 32000 Operations: EMBEDDINGS Modalities: text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.18 USD Summary: Parçaları ait oldukları dokümanın bağlamıyla birlikte vektörleştirir. Description: Voyage Context 4, bir dokümanın parçalarını tek tek değil, hepsini birden görerek vektörleştirir. Böylece her parçanın vektörü, o parçanın doküman içindeki yerini de taşır; bir paragrafta geçen "bu oran" veya "söz konusu taraf" gibi ifadeler, tanımın geçtiği başka bir parçaya bağlanabilir. Klasik parçalama yönteminde kaybolan bu bağlam, uzun teknik doküman ve sözleşme retrieval'ında isabeti belirgin biçimde artırır. Girdi, diğer embedding modellerinden farklı olarak iç içe dizi biçiminde verilir: dış liste dokümanları, iç liste o dokümanın parçalarını gösterir. ## Voyage Multimodal 3.5 (voyageai/voyage-multimodal-3.5) URL: /models/voyageai/voyage-multimodal-3.5 Provider: Voyage AI Context window: 32000 Operations: EMBEDDINGS Modalities: image, text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.12 USD; EMBEDDINGS/INPUT_IMAGE/PER_1B_PIXELS: 0.6 USD Summary: Metin ve görseli tek bir vektör uzayında birleştiren embedding modeli. Description: Voyage Multimodal 3.5, metni ve görseli aynı vektör uzayına yerleştirir; böylece metinle görsel arayabilir veya bir görselle benzer görselleri bulabilirsiniz. Ekran görüntüsü, tablo, grafik ve şema içeren sayfalarda, içeriği önce metne çevirmeye gerek kalmadan doğrudan retrieval yapar. Bir girdi hem metin hem görsel parçaları içerebilir. Faturalama iki kalemlidir: metin token başına, görsel ise piksel başına ücretlendirilir; 50.000 pikselin altındaki görseller 50.000 piksele yükseltilir, 2 milyon pikselin üzerindekiler 2 milyon piksele indirilir. ## Voyage Rerank 2.5 (voyageai/rerank-2.5) URL: /models/voyageai/rerank-2.5 Provider: Voyage AI Context window: 32768 Operations: RERANK Modalities: text Pricing: RERANK/INPUT_TEXT/PER_1M_TOKENS: 0.05 USD Summary: Retrieval sonuçlarını alaka düzeyine göre yeniden sıralayan model. Description: Voyage Rerank 2.5, bir sorgu ile aday doküman listesini birlikte değerlendirip her doküman için alaka puanı üretir. Embedding araması hız için sorgu ve dokümanı ayrı ayrı vektörleştirir; reranker ikisini aynı anda okuduğu için daha isabetli bir sıralama verir. Tipik kullanım, embedding ile ilk 50-100 adayı çekip bunları rerank ederek dil modeline yalnızca en alakalı birkaçını göndermektir; bu hem yanıt kalitesini artırır hem de üretim modelinin token maliyetini düşürür. Tek istekte en fazla 1000 doküman değerlendirilir. Ücretlendirme işlenen toplam token üzerindendir: (sorgu tokenı x doküman sayısı) + tüm dokümanların token toplamı. ## Solar Pro 4 (upstage/solar-pro4) URL: /models/upstage/solar-pro4 Provider: Upstage Context window: 524288 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.03 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.006 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.12 USD Summary: Ajan islerine ayarlanmis amiral gemisi; 524K baglam, 128K cikti, yedi kademeli ayarlanabilir dusunme ve arac cagrisi. Description: Solar Pro 4, Upstage'in ajan is akislari icin ayarlanmis amiral gemisi modelidir. Dokuman uzerinden calisma, kodlama ve kurumsal islerde Solar Pro 3'e gore belirgin sekilde daha iyi sonuc verir. 524.288 tokenlik baglam penceresi buyuk bir kod tabanini ya da uzun bir belge yiginini tek oturumda tutar; tek yanitta en fazla 128K token uretebilir ki bu ailedeki tek ayri cikti tavanidir. Dusunme varsayilan olarak kapalidir. `reasoning_effort` ile none, minimal, low, medium, high, xhigh ve max kademelerini kullanirsiniz, ancak model asil `low` kademesinden itibaren dusunmeye baslar: `none` ve `minimal` kabul edilir, 200 doner ve hic dusunme tokeni uretmez. Dusunme aciklken model dusunce izini yanitin `reasoning` alaninda ayrica doner, streaming sirasinda da parca parca gonderir. Arac/fonksiyon cagrisini yerel olarak destekler; `tool_choice` degerlerinin tamami (auto, required, none ve isimli secim) calisir. JSON nesne ciktisi ve semaya birebir uyan yapilandirilmis cikti uretir. Ayni istem onekini tekrar gonderdiginizde prompt cache devreye girer ve o tokenlar indirimli ucretlendirilir. Yalnizca metin kabul eder; gorsel ve ses girdisi desteklenmez. Resmi dil destegi Ingilizce, Korece ve Japoncadir. Dusunme tokenlari cikti sayilir ve `max_tokens` butcesinden harcanir; dusunme aciklken bu degeri bol tutun. ## Gemma 4 26B A4B (gemma/gemma-4-26b-a4b-it) URL: /models/gemma/gemma-4-26b-a4b-it Provider: Gemma Context window: 131072 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.042 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.22 USD Summary: Google'in acik agirlikli Gemma 4 MoE modeli: 131K baglam, yerel arac cagrisi, acilabilir reasoning ve JSON Schema cikti. Description: Gemma 4 26B A4B, Google'in Gemma 4 ailesindeki acik agirlikli Mixture-of-Experts modelidir: seyrek bir mimariyle 25,2 milyar parametresinin token basina yalnizca 3,8 milyarini calistirir, bu da ona cok daha buyuk bir model kapasitesiyle birlikte hizli cikarim saglar. 131.072 tokenlik baglam penceresi, yerel arac cagrisi, JSON nesne modu ve JSON Schema ile sema zorlamali cikti sunar. Adim adim dusunme desteklenir ama varsayilan olarak kapalidir; acildiginda dusunme izi yanittan ayri doner ve dusunme tokenlari cikti olarak faturalanir. Metin ve gorsel girdiyi degisken en-boy orani ve cozunurlukte kabul eder, yalnizca metin uretir; bu boyutta ses ve video girdisi desteklenmez. Baglam penceresinin altinda ayri bir cikti tavani yoktur ve prompt cache indirimi uygulanmaz — her istek tam girdi fiyatindan faturalanir. ## Gemma 4 31B (gemma/gemma-4-31b-it) URL: /models/gemma/gemma-4-31b-it Provider: Gemma Context window: 262144 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.14 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.4 USD Summary: Buyuk baglam penceresi isteyen sohbet, kodlama ve arac kullanan asistan akislari icin 262K baglamli Gemma 4 yogun (dense) model. Description: Gemma 4 31B, Google'in Gemma 4 ailesindeki acik agirlikli yogun (dense) modelidir; buyuk bir baglam penceresi isteyen genel amacli sohbet, kodlama ve arac kullanan asistan akislari icin tasarlanmistir. 262.144 tokenlik baglam penceresi, yerel arac cagrisi, JSON nesne modu ve JSON Schema ile sema zorlamali cikti sunar. Adim adim dusunme desteklenir ama varsayilan olarak kapalidir; acildiginda dusunme izi yanittan ayri doner ve dusunme tokenlari cikti olarak faturalanir. Metin ve gorsel girdiyi degisken en-boy orani ve cozunurlukte kabul eder, yalnizca metin uretir. Baglam penceresinin altinda ayri bir cikti tavani yoktur ve prompt cache indirimi uygulanmaz — her istek tam girdi fiyatindan faturalanir. ## Mercury 2.5 Preview (inception/mercury-2.5-preview) URL: /models/inception/mercury-2.5-preview Provider: Inception Labs Context window: 260000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.04 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.004 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.15 USD Summary: Uzun belge analizi ve düşük gecikmeli sohbet için difüzyon modeli; 260K bağlam, araç çağrısı, yapısal çıktı. Description: Mercury 2.5 Preview, Inception Labs'in difüzyon tabanlı dil modelinin (dLLM) yeni sürümüdür. Mercury 2 ile aynı paralel üretme ve adım adım netleştirme yaklaşımını kullanır, ancak bağlam penceresi iki katına çıkarılmıştır: 260.000 token. Tek yanıt en fazla 65.536 token olabilir. Araç/fonksiyon çağrısını ve şema zorlamalı JSON çıktısını destekler; yalnızca metin kabul eder. Fiyatlandırmada dikkat edilmesi gereken bir nokta var: token başına fiyatı Mercury 2'den belirgin biçimde düşüktür, ancak model varsayılan olarak Mercury 2'ye kıyasla yaklaşık beş kat daha fazla gizli akıl yürütme token'ı üretir ve bu token'lar çıktı olarak faturalanır. Ölçümlerimizde kısa bir soruda iki modelin gerçek istek maliyeti neredeyse eşit çıktı. Akıl yürütmeyi tamamen kapatmak için `:none`, hafif tutmak için `:minimal` sonekini kullanın; varsayılan seviye `medium`'dur. Bu satırda yalnızca bu üç seviye ilan edilir, çünkü ölçümde `low` seviyesi `minimal` ile, `high` ise `medium` ile ayrışmamıştır. Önizleme sürümüdür; davranışı ve fiyatı sağlayıcı tarafından değiştirilebilir. ## Trendyol 7B (llmtr/trendyol-7b) URL: /models/llmtr/trendyol-7b Provider: LLMTR Context window: 32768 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.5 USD Summary: Yeni isler icin halefi Trendyol Asure 12B kullanilmalidir; bu satir emekliye ayriliyor. Description: Trendyol 7B, Trendyol tarafindan uretilen Qwen2.5 7B tabanli chat modelidir ve 32K baglam penceresine sahiptir. Bu satir yerini llmtr/trendyol-asure-12b modeline birakiyor: gecis suresince bu kimlige gelen istekler halef modelde ayni liste fiyatindan calisir, gecis bitince bu kimlik kabul edilmez. Yeni entegrasyonlarda dogrudan llmtr/trendyol-asure-12b kullanin. Model karti: https://huggingface.co/Trendyol/Trendyol-LLM-7B-chat-v4.1.0 ## GPT-5.4 nano (openai/gpt-5.4-nano) URL: /models/openai/gpt-5.4-nano Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.25 USD Summary: Hacimli basit gorevler icin en ucuz GPT-5.4 sinifi model. Description: Siniflandirma, yonlendirme, ozetleme ve hafif otomasyon gibi yuksek hacimli islerde maliyet odakli secenektir. Karmasik planning yerine hiz ve verimlilik onceliklidir. ## GPT-5.1 (openai/gpt-5.1) URL: /models/openai/gpt-5.1 Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.25 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 10 USD Summary: Kod yardımı ve araçlı otomasyon için dengeli önceki GPT-5 amiral gemisi. Description: Konfigure edilebilir reasoning ile kod, otomasyon ve genel profesyonel islerde guclu performans verir. En yeni modele cikmadan oturmus bir GPT-5 davranisi isteyen ekipler icin mantikli secimdir. ## GPT-5 (openai/gpt-5) URL: /models/openai/gpt-5 Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.25 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 10 USD Summary: Genel üretim işleri ve mevcut entegrasyonlar için olgun GPT-5 seçeneği. Description: Reasoning ve kod agirlikli gorevlerde hala guclu, olgun bir GPT-5 secenegidir. Mevcut entegrasyonlarini bozmadan saglam genel performans isteyen ekipler icin uygundur. ## GPT-5 mini (openai/gpt-5-mini) URL: /models/openai/gpt-5-mini Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.25 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2 USD Summary: Iyi tanimli isler icin hizli ve ekonomik GPT-5 modeli. Description: Net promptlar, yardimci akislar, veri donusumu ve gunluk copilot isleri icin verimli secenektir. Kaliteyi makul seviyede tutarken maliyeti ciddi bicimde dusurur. ## GPT-5 nano (openai/gpt-5-nano) URL: /models/openai/gpt-5-nano Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.05 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.4 USD Summary: Ozetleme ve siniflandirma icin ultra ekonomik GPT-5 modeli. Description: Basit kararlar, etiketleme, filtreleme ve kisa donusumler gibi yuksek throughput isteyen isler icin tasarlanmistir. En dusuk maliyetli GPT-5 yolunu arayan ekipler icin uygundur. ## GPT-4.1 mini (openai/gpt-4.1-mini) URL: /models/openai/gpt-4.1-mini Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.4 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.6 USD Summary: Günlük araçlı yardımcılar için daha düşük maliyetli GPT-4.1 modeli. Description: Talimat takibi ve arac kullanimi gereken hafif-orta seviye uretim isleri icin ekonomik secenektir. Kaliteyi korurken maliyeti ve gecikmeyi azaltmak isteyen ekipler icin uygundur. ## GPT-4.1 nano (openai/gpt-4.1-nano) URL: /models/openai/gpt-4.1-nano Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.4 USD Summary: Ekstraksiyon ve basit dönüşümler için en hafif GPT-4.1 modeli. Description: Ekstraksiyon, yeniden yazma ve basit donusumler gibi hafif gorevlerde hiz ve maliyet optimizasyonu sunar. Daha zor muhakeme gereken isler icin ust varyantlara cikmak gerekir. ## GPT-4o mini (openai/gpt-4o-mini) URL: /models/openai/gpt-4o-mini Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.15 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.6 USD Summary: Gunluk yardimci akislar icin hizli ve uygun maliyetli model. Description: Chat, ozetleme, siniflandirma ve basit multimodal yardimci akislarda hizli cevap verir. Diger amiral gemilere cikmadan once maliyet odakli iyi bir baslangic noktasi sunar. ## o3-mini (openai/o3-mini) URL: /models/openai/o3-mini Provider: OpenAI Context window: 200000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 4.4 USD Summary: Yapılandırılmış çıktı ve araçlı reasoning için ekonomik o3 modeli. Description: Yapilandirilmis cikti, arac kullanimi ve reasoning isteyen gorevlerde maliyet-verim dengesi sunar. O1 sinifindan daha erisilebilir reasoning isteyen urunler icin uygundur. Dusunme derinligini `reasoning_effort` ile `low`, `medium` veya `high` olarak ayarlayabilirsiniz. ## o1 (openai/o1) URL: /models/openai/o1 Provider: OpenAI Context window: 200000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 15 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 60 USD Summary: Derin teknik analiz ve ağır muhakeme için eski premium reasoning modeli. Description: Cevaptan once daha agir dusunme yapan bu model, pahali ama derin analiz odakli isler icin anlamlidir. Yeni GPT-5 reasoning ailesine gecmeden onceki premium referans noktalarindan biridir. Dusunme derinligini `reasoning_effort` ile `low`, `medium` veya `high` olarak ayarlayabilirsiniz. ## GPT-OSS Safeguard 20B (openai/gpt-oss-safeguard-20b) URL: /models/openai/gpt-oss-safeguard-20b Provider: OpenAI Context window: 131072 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0 USD Summary: Icerik siniflandirma ve politika denetimi icin egitilmis, kademeli dusunme seviyeli ucretsiz OpenAI acik agirlikli modeli. Description: GPT-OSS Safeguard 20B, OpenAI'nin acik agirlikli guvenlik modelidir: bir metnin verdiginiz politikaya uyup uymadigini degerlendirmek ve gerekcesini yazmak icin egitilmistir. Icerik moderasyonu, kural denetimi ve siniflandirma akislarinda kullanilir, ancak genel sohbet ve kod yardiminda da calisir. Varsayilan olarak dusunur ve dusunce zincirini yanitta ayri dondurur. Dusunme derinligini `reasoning_effort` ile `low`, `medium` veya `high` olarak ayarlayabilirsiniz - bu modelde uc seviyenin de etkisi olculmustur. `none` seviyesi bu modelde kabul edilmez. Arac/fonksiyon cagrisini ve sema zorunlu JSON ciktisini destekler. 131K baglam penceresi sunar, tek yanitta en fazla 65.536 token uretir. Yalnizca metin kabul eder. Gunluk kullanim kotasiyla ucretsiz sunulur. ## GPT-OSS 120B (openai/gpt-oss-120b-unmetered) URL: /models/openai/gpt-oss-120b-unmetered Provider: OpenAI Context window: 131072 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.05 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.25 USD Summary: Genel sohbet, kod yardımı, function calling ve JSON çıktı gerektiren akışlar için OpenAI'nin açık ağırlıklı modeli. Description: GPT-OSS 120B, OpenAI'nin açık ağırlıklı Mixture-of-Experts modelidir. Genel sohbet, özetleme, kod yardımı, function calling ve şema doğrulamalı JSON çıktı bekleyen ürün akışları için uygundur. Varsayılan olarak düşünür; reasoning_effort parametresiyle düşünme derinliği none (kapalı) veya high (daha derin) olarak ayarlanabilir. 128K bağlam penceresi sunar, tek yanıtta en fazla 32.768 token üretir. Yalnızca metin girdisi kabul eder. ## GPT-OSS 20B (openai/gpt-oss-20b-unmetered) URL: /models/openai/gpt-oss-20b-unmetered Provider: OpenAI Context window: 131072 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.03 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.14 USD Summary: Günlük kotası olmayan, kullandıkça ödenen; hızlı sohbet, function calling ve JSON çıktı gerektiren hafif otomasyon akışları için OpenAI'nin açık ağırlıklı küçük modeli. Description: GPT-OSS 20B, OpenAI'nin açık ağırlıklı küçük Mixture-of-Experts modelidir. Tokene göre ücretlendirilir, günlük kotası yoktur. Hızlı sohbet, sınıflandırma, veri dönüşümü ve şema doğrulamalı JSON çıktı gerektiren hafif otomasyonlar için uygundur. Varsayılan olarak düşünür; reasoning_effort none veya high alır. tool_choice auto ve required ile çalışır, ada göre fonksiyon zorlanamaz. 128K bağlam, yalnızca metin girdisi. ## GPT-4 Turbo (openai/gpt-4-turbo) URL: /models/openai/gpt-4-turbo Provider: OpenAI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 10 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 30 USD Summary: Uzun bağlamlı metin işleri ve eski entegrasyonlar için GPT-4 modeli. Description: Uzun metin isleme, tarihsel GPT-4 davranisi ve mevcut entegrasyonlari koruma gereken durumlarda anlamlidir. Yeni modellere gore daha pahali kalabilir, ancak uyumluluk odakli gecislerde hala faydali olabilir. ## GPT-3.5 Turbo (openai/gpt-3.5-turbo) URL: /models/openai/gpt-3.5-turbo Provider: OpenAI Context window: 16385 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.5 USD Summary: Basit yardimci isler icin butce dostu eski model. Description: Temel sohbet, kisa donusumler ve eski entegrasyonlar icin hala yeterli olabilir. Modern agent ve reasoning islerinde daha yeni modellere gore belirgin sekilde geride kalir. ## text-embedding-3-large (openai/text-embedding-3-large) URL: /models/openai/text-embedding-3-large Provider: OpenAI Context window: 8192 Operations: EMBEDDINGS Modalities: text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.13 USD Summary: Metinleri arama, kümeleme ve öneri sistemleri için en fazla 3072 boyutlu vektöre dönüştüren OpenAI'nin en yetenekli embedding modeli. Description: text-embedding-3-large, girdi metnini en fazla 3.072 boyutlu bir sayısal vektöre dönüştüren OpenAI'nin en yetenekli embedding modelidir. İki vektör arasındaki kosinüs benzerliği, ilgili metinlerin anlamsal olarak ne kadar yakın olduğunu ölçer; bu da arama, kümeleme, öneri sistemi ve anomali tespiti gibi işler için kullanılır. 8.192 tokenlık bir bağlam penceresi sunar ve `dimensions` parametresiyle vektörü kısaltmayı destekler; bu, biraz doğruluktan ödün verip depolama boyutunu küçültmeyi sağlar. Yalnızca metin girdisi kabul eder, vektör dışında bir çıktı üretmez. ## text-embedding-3-small (openai/text-embedding-3-small) URL: /models/openai/text-embedding-3-small Provider: OpenAI Context window: 8192 Operations: EMBEDDINGS Modalities: text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.02 USD Summary: Metinleri arama, kümeleme ve öneri sistemleri için en fazla 1536 boyutlu vektöre dönüştüren embedding modeli. Description: text-embedding-3-small, girdi metnini en fazla 1.536 boyutlu bir sayısal vektöre dönüştüren embedding modelidir. İki vektör arasındaki kosinüs benzerliği, ilgili metinlerin anlamsal olarak ne kadar yakın olduğunu ölçer; bu da arama, kümeleme, öneri sistemi ve anomali tespiti gibi işler için kullanılır. 8.192 tokenlık bir bağlam penceresi sunar ve `dimensions` parametresiyle vektörü kısaltmayı destekler; bu, biraz doğruluktan ödün verip depolama boyutunu küçültmeyi sağlar. Yalnızca metin girdisi kabul eder, vektör dışında bir çıktı üretmez. ## text-embedding-ada-002 (openai/text-embedding-ada-002) URL: /models/openai/text-embedding-ada-002 Provider: OpenAI Context window: 8192 Operations: EMBEDDINGS Modalities: text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD Summary: Metinleri arama, kümeleme ve öneri sistemleri için 1536 boyutlu vektöre dönüştüren OpenAI embedding modeli. Description: text-embedding-ada-002, girdi metnini 1536 boyutlu sabit uzunluklu bir sayısal vektöre dönüştüren OpenAI embedding modelidir. İki vektör arasındaki kosinüs benzerliği, ilgili metinlerin anlamsal olarak ne kadar yakın olduğunu ölçer; bu da arama, kümeleme, öneri sistemi ve anomali tespiti gibi işler için kullanılır. 8.192 tokenlık bir bağlam penceresi sunar, çıktı boyutu sabittir ve vektörü `dimensions` parametresiyle kısaltmayı desteklemez. Yalnızca metin girdisi kabul eder, vektör dışında bir çıktı üretmez. ## Gemini 2.5 Computer Use Preview (google/gemini-2.5-computer-use-preview-10-2025) URL: /models/google/gemini-2.5-computer-use-preview-10-2025 Provider: Google Context window: 1048576 Operations: COMPUTER_USE Modalities: text Pricing: COMPUTER_USE/INPUT_TEXT/PER_1M_TOKENS: 1.25 USD; COMPUTER_USE/OUTPUT_TEXT/PER_1M_TOKENS: 10 USD Summary: Tarayıcı ve arayüz otomasyonu için Gemini computer-use modeli. Description: Web sayfaları ve uygulama arayüzleri üzerinde adım adım işlem yapan ajanlar geliştirmek için tasarlanmıştır. Otomasyon, test ve görev tamamlama akışlarında metin modelinden daha doğrudan davranır. ## Gemini 3 Pro Image (google/gemini-3-pro-image) URL: /models/google/gemini-3-pro-image Provider: Google Context window: 65536 Operations: IMAGES_GENERATIONS Modalities: text, image Pricing: IMAGES_GENERATIONS/INPUT_TEXT/PER_1M_TOKENS: 2 USD; IMAGES_GENERATIONS/OUTPUT_TEXT/PER_1M_TOKENS: 12 USD; IMAGES_GENERATIONS/INPUT_IMAGE/PER_1M_TOKENS: 2 USD; IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.24 USD; IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_1M_TOKENS: 120 USD Summary: Karmaşık düzenleme ve yaratıcı kontrol için üst seviye Gemini görüntü modeli. Description: Profesyonel kaliteye yakın görsel düzenleme ve üretim isteyen ekipler için konumlanır. Daha hassas komut takibi ve kontrollü yaratıcı iş akışlarında güçlüdür; yeni entegrasyonlarda GA model kimliği kullanılmalıdır. ## Gemini 3.1 Flash Image (google/gemini-3.1-flash-image) URL: /models/google/gemini-3.1-flash-image Provider: Google Context window: 131072 Operations: IMAGES_GENERATIONS Modalities: text, image Pricing: IMAGES_GENERATIONS/INPUT_TEXT/PER_1M_TOKENS: 0.5 USD; IMAGES_GENERATIONS/OUTPUT_TEXT/PER_1M_TOKENS: 3 USD; IMAGES_GENERATIONS/INPUT_IMAGE/PER_1M_TOKENS: 0.5 USD; IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.045 USD; IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.067 USD; IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.101 USD; IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.151 USD; IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_1M_TOKENS: 60 USD Summary: Daha hızlı ve erişilebilir görsel üretim için Gemini image modeli. Description: Konuşmalı düzenleme ve günlük görsel üretim işlerinde düşük gecikmeyi korurken iyi kalite sunar. Geniş kullanıcı tabanına giden yaratıcı ürünler için verimli bir orta katmandır; yeni entegrasyonlarda GA model kimliği kullanılmalıdır. ## Gemini 3.1 Flash Live Preview (google/gemini-3.1-flash-live-preview) URL: /models/google/gemini-3.1-flash-live-preview Provider: Google Context window: 128000 Operations: REALTIME_SESSION Modalities: text, audio, image, video Pricing: REALTIME_SESSION/INPUT_TEXT/PER_1M_TOKENS: 0.75 USD; REALTIME_SESSION/OUTPUT_TEXT/PER_1M_TOKENS: 4.5 USD; REALTIME_SESSION/INPUT_AUDIO/PER_MINUTE: 0.005 USD; REALTIME_SESSION/INPUT_IMAGE/PER_MINUTE: 0.002 USD; REALTIME_SESSION/INPUT_VIDEO/PER_MINUTE: 0.002 USD; REALTIME_SESSION/OUTPUT_AUDIO/PER_MINUTE: 0.018 USD; REALTIME_SESSION/TOOL_CALL/PER_1K_CALLS: 14 USD Summary: Gerçek zamanlı sesli konuşma için düşük gecikmeli Gemini Live modeli. Description: Sesli diyalog, akustik nüans ve multimodal farkındalık gerektiren uygulamalarda öne çıkar. Realtime yardımcılar ve voice-first deneyimler için güçlü bir preview katmanıdır. ## Gemini Robotics-ER 1.5 Preview (google/gemini-robotics-er-1.5-preview) URL: /models/google/gemini-robotics-er-1.5-preview Provider: Google Context window: 1048576 Operations: ROBOTICS_SESSION Modalities: text, image, video, audio Pricing: ROBOTICS_SESSION/INPUT_TEXT/PER_1M_TOKENS: 0.3 USD; ROBOTICS_SESSION/OUTPUT_TEXT/PER_1M_TOKENS: 2.5 USD; ROBOTICS_SESSION/INPUT_AUDIO/PER_1M_TOKENS: 1 USD; ROBOTICS_SESSION/INPUT_IMAGE/PER_1M_TOKENS: 0.3 USD; ROBOTICS_SESSION/INPUT_VIDEO/PER_1M_TOKENS: 0.3 USD; ROBOTICS_SESSION/TOOL_CALL/PER_1K_CALLS: 35 USD Summary: Fiziksel dünyayı anlayan robotik reasoning için Gemini modeli. Description: Robotların çevresini yorumlaması, görev planlaması ve fiziksel etkileşim kararları için tasarlanmıştır. Yazılım asistanından çok embodied reasoning ve robotik araştırma akışlarında anlamlıdır. ## Qwen-Flash (qwen/qwen-flash) URL: /models/qwen/qwen-flash Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.005000 USD Summary: Gunluk sohbet ve yuksek hacimli yardimcilar icin hizli Qwen modeli. Description: Qwen-Flash, hizli yanit, dusuk gecikme ve yuksek hacimli kullanim icin optimize edilmis hafif bir modeldir. Basit yardimci akislar, otomasyon ve maliyet kontrollu urunler icin uygundur. ## Qwen-Flash-2025-07-28 (qwen/qwen-flash-2025-07-28) URL: /models/qwen/qwen-flash-2025-07-28 Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.050000 USD Summary: Gunluk sohbet ve yuksek hacimli yardimcilar icin hizli Qwen modeli; tarihli snapshot surumu. Description: Qwen-Flash-2025-07-28, hizli yanit, dusuk gecikme ve yuksek hacimli kullanim icin optimize edilmis hafif bir modeldir. Basit yardimci akislar, otomasyon ve maliyet kontrollu urunler icin uygundur. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen-Mt-Flash (qwen/qwen-mt-flash) URL: /models/qwen/qwen-mt-flash Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.16 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.49 USD Summary: Çok dilli çeviri ve lokalizasyon için Qwen modeli. Description: Qwen-Mt-Flash, terim koruma, bicim koruma ve lokalizasyon islerinde kullanilmak uzere tasarlanmis bir ceviri modelidir. Ulke bazli dil aktarimi ve icerik cevirisinde genel modellerden daha odakli davranir. ## Qwen-Mt-Plus (qwen/qwen-mt-plus) URL: /models/qwen/qwen-mt-plus Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2.46 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 7.37 USD Summary: Çok dilli çeviri ve lokalizasyon için Qwen modeli. Description: Qwen-Mt-Plus, terim koruma, bicim koruma ve lokalizasyon islerinde kullanilmak uzere tasarlanmis bir ceviri modelidir. Ulke bazli dil aktarimi ve icerik cevirisinde genel modellerden daha odakli davranir. ## Qwen3.6 35B-A3B (qwen/qwen3.6-35b-a3b) URL: /models/qwen/qwen3.6-35b-a3b Provider: Qwen Context window: 262144 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.07 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.7 USD Summary: Gorsel ve metni birlikte isleyen uzun baglamli isler icin acik agirlikli Qwen3.6 MoE modeli: 262K baglam, yerel arac cagrisi, varsayilan acik reasoning ve JSON Schema cikti. Description: Qwen3.6 35B-A3B, Alibaba Cloud'un Qwen3.6 ailesindeki acik agirlikli gorsel-dil Mixture-of-Experts modelidir: seyrek bir mimariyle 35 milyar parametresinin token basina yaklasik 3 milyarini calistirir, boylece cok daha buyuk bir model kapasitesini kucuk bir modelin cikarim hizina yakin maliyetle sunar. 262.144 tokenlik baglam penceresi, yerel arac cagrisi, JSON nesne modu ve JSON Schema ile sema zorlamali cikti sunar. Adim adim dusunme varsayilan olarak ACIKTIR; dusunme izi yanittan ayri bir alanda doner ve dusunme tokenlari cikti olarak faturalanir, gerek duyulmadiginda istek basina kapatilabilir. Metin ve gorsel girdiyi degisken en-boy orani ve cozunurlukte kabul eder, yalnizca metin uretir; bu satirda ses ve video girdisi desteklenmez. Arac cagrisi modelin kendi karariyla calisir, arac kullanimini istek tarafindan zorunlu kilan tool_choice bicimleri bu modelde desteklenmez. Baglam penceresi prompt ve cikti arasinda PAYLASILIR: altinda ayri bir cikti tavani yoktur, en buyuk cikti isteginiz prompt buyudukce kucululur. Prompt cache indirimi uygulanmaz, her istek tam giris fiyatindan faturalanir. ## Qwen-Vl-Ocr (qwen/qwen-vl-ocr) URL: /models/qwen/qwen-vl-ocr Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.07 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.16 USD Summary: OCR ve belge okuma icin ozel Qwen modeli. Description: Qwen-Vl-Ocr, gorselden metin cikarma, belge duzeni okuma ve OCR odakli isler icin optimize edilmistir. Genel multimodal sohbetten cok veri cikarma ve belge anlama tarafinda deger uretir. ## Qwen-Vl-Ocr-2025-11-20 (qwen/qwen-vl-ocr-2025-11-20) URL: /models/qwen/qwen-vl-ocr-2025-11-20 Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.07 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.16 USD Summary: OCR ve belge okuma icin ozel Qwen modeli; tarihli snapshot surumu. Description: Qwen-Vl-Ocr-2025-11-20, gorselden metin cikarma, belge duzeni okuma ve OCR odakli isler icin optimize edilmistir. Genel multimodal sohbetten cok veri cikarma ve belge anlama tarafinda deger uretir. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen3-Coder-30B-A3b-Instruct (qwen/qwen3-coder-30b-a3b-instruct) URL: /models/qwen/qwen3-coder-30b-a3b-instruct Provider: Qwen Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.450000 USD Summary: Kod yazma, duzenleme ve repo arama icin Qwen Coder modeli. Description: Qwen3-Coder-30B-A3b-Instruct, kod yazma, kod duzenleme ve repo anlama icin optimize edilmistir. Agentic coding, arac kullanimi ve yazilim yardimcisi senaryolarinda genel Qwen modellerinden daha odakli davranir. ## Qwen3-Coder-Flash (qwen/qwen3-coder-flash) URL: /models/qwen/qwen3-coder-flash Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.030000 USD Summary: Editor yardimi ve hizli duzeltmeler icin hafif Qwen Coder modeli. Description: Qwen3-Coder-Flash, editor yardimi, hizli duzeltmeler ve daha yuksek hacimli coding yardimi icin tasarlanmistir. Kaliteden bir miktar taviz verip hiz ve maliyeti onceliklendirir. ## Qwen3-Coder-Flash-2025-07-28 (qwen/qwen3-coder-flash-2025-07-28) URL: /models/qwen/qwen3-coder-flash-2025-07-28 Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.300000 USD Summary: Editor yardimi ve hizli duzeltmeler icin hafif Qwen Coder modeli; tarihli snapshot surumu. Description: Qwen3-Coder-Flash-2025-07-28, editor yardimi, hizli duzeltmeler ve daha yuksek hacimli coding yardimi icin tasarlanmistir. Kaliteden bir miktar taviz verip hiz ve maliyeti onceliklendirir. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen3-Coder-Plus (qwen/qwen3-coder-plus) URL: /models/qwen/qwen3-coder-plus Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.100000 USD Summary: Cok dosyali muhendislik isleri ve repo olcekli duzenlemeler icin ust seviye Qwen Coder modeli. Description: Qwen3-Coder-Plus, cok dosyali degisiklikler, repo capinda arama ve daha zor yazilim muhendisligi gorevlerinde Qwen tarafindaki daha guclu coding seceneklerinden biridir. ## Qwen3-Coder-Plus-2025-07-22 (qwen/qwen3-coder-plus-2025-07-22) URL: /models/qwen/qwen3-coder-plus-2025-07-22 Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 1.000000 USD Summary: Cok dosyali muhendislik isleri ve repo olcekli duzenlemeler icin ust seviye Qwen Coder modeli; tarihli snapshot surumu. Description: Qwen3-Coder-Plus-2025-07-22, cok dosyali degisiklikler, repo capinda arama ve daha zor yazilim muhendisligi gorevlerinde Qwen tarafindaki daha guclu coding seceneklerinden biridir. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen3-Coder-Plus-2025-09-23 (qwen/qwen3-coder-plus-2025-09-23) URL: /models/qwen/qwen3-coder-plus-2025-09-23 Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 1.000000 USD Summary: Cok dosyali muhendislik isleri ve repo olcekli duzenlemeler icin ust seviye Qwen Coder modeli; tarihli snapshot surumu. Description: Qwen3-Coder-Plus-2025-09-23, cok dosyali degisiklikler, repo capinda arama ve daha zor yazilim muhendisligi gorevlerinde Qwen tarafindaki daha guclu coding seceneklerinden biridir. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen3-Next-80B-A3b-Instruct (qwen/qwen3-next-80b-a3b-instruct) URL: /models/qwen/qwen3-next-80b-a3b-instruct Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.15 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.2 USD Summary: Verimli ajan ve arac kullanimi icin yeni nesil Qwen modeli. Description: Qwen3-Next-80B-A3b-Instruct, arac kullanimi, genel reasoning ve uzun akislarda verimli calisan yeni nesil bir Qwen secenegidir. ## Qwen3-Next-80B-A3b-Thinking (qwen/qwen3-next-80b-a3b-thinking) URL: /models/qwen/qwen3-next-80b-a3b-thinking Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.15 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.2 USD Summary: Verimli ajan ve arac kullanimi icin yeni nesil Qwen modeli. Description: Qwen3-Next-80B-A3b-Thinking, arac kullanimi, genel reasoning ve uzun akislarda verimli calisan yeni nesil bir Qwen secenegidir. Thinking varyanti, daha zor problemler ve daha dikkatli planning icin daha uygundur. ## Qwen3-Vl-235B-A22b-Instruct (qwen/qwen3-vl-235b-a22b-instruct) URL: /models/qwen/qwen3-vl-235b-a22b-instruct Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.4 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.6 USD Summary: Zor multimodal analiz ve derin gorsel reasoning icin buyuk Qwen VL modeli. Description: Qwen3-Vl-235B-A22b-Instruct, daha buyuk kapasite isteyen ekipler icin acik agirlik tarafinda iddiali bir Qwen VL secenegidir. Zor multimodal analiz ve daha derin gorsel reasoning islerinde anlamlidir. ## Qwen3-Vl-235B-A22b-Thinking (qwen/qwen3-vl-235b-a22b-thinking) URL: /models/qwen/qwen3-vl-235b-a22b-thinking Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.4 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 4 USD Summary: Zor multimodal analiz ve derin gorsel reasoning icin buyuk Qwen VL modeli. Description: Qwen3-Vl-235B-A22b-Thinking, daha buyuk kapasite isteyen ekipler icin acik agirlik tarafinda iddiali bir Qwen VL secenegidir. Zor multimodal analiz ve daha derin gorsel reasoning islerinde anlamlidir. Thinking varyanti, daha zor gorsel problemler ve daha dikkatli adim adim analiz icin daha uygundur. ## Qwen3-Vl-30B-A3b-Instruct (qwen/qwen3-vl-30b-a3b-instruct) URL: /models/qwen/qwen3-vl-30b-a3b-instruct Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.8 USD Summary: Gorsel anlama ve OCR icin Qwen VL modeli. Description: Qwen3-Vl-30B-A3b-Instruct, metin, gorsel ve video girdilerini anlayabilen bir vision-language modelidir. OCR, ekran goruntusu analizi, belge anlama ve multimodal yardimci akislar icin uygundur. ## Qwen3-Vl-30B-A3b-Thinking (qwen/qwen3-vl-30b-a3b-thinking) URL: /models/qwen/qwen3-vl-30b-a3b-thinking Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.4 USD Summary: Gorsel anlama ve OCR icin Qwen VL modeli. Description: Qwen3-Vl-30B-A3b-Thinking, metin, gorsel ve video girdilerini anlayabilen bir vision-language modelidir. OCR, ekran goruntusu analizi, belge anlama ve multimodal yardimci akislar icin uygundur. Thinking varyanti, daha zor gorsel problemler ve daha dikkatli adim adim analiz icin daha uygundur. ## Qwen3-Vl-32B-Instruct (qwen/qwen3-vl-32b-instruct) URL: /models/qwen/qwen3-vl-32b-instruct Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.16 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.64 USD Summary: Gorsel anlama ve OCR icin Qwen VL modeli. Description: Qwen3-Vl-32B-Instruct, metin, gorsel ve video girdilerini anlayabilen bir vision-language modelidir. OCR, ekran goruntusu analizi, belge anlama ve multimodal yardimci akislar icin uygundur. ## Qwen3-Vl-32B-Thinking (qwen/qwen3-vl-32b-thinking) URL: /models/qwen/qwen3-vl-32b-thinking Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.16 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.64 USD Summary: Gorsel anlama ve OCR icin Qwen VL modeli. Description: Qwen3-Vl-32B-Thinking, metin, gorsel ve video girdilerini anlayabilen bir vision-language modelidir. OCR, ekran goruntusu analizi, belge anlama ve multimodal yardimci akislar icin uygundur. Thinking varyanti, daha zor gorsel problemler ve daha dikkatli adim adim analiz icin daha uygundur. ## Qwen3-Vl-8B-Instruct (qwen/qwen3-vl-8b-instruct) URL: /models/qwen/qwen3-vl-8b-instruct Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.18 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.7 USD Summary: Gorsel anlama ve OCR icin Qwen VL modeli. Description: Qwen3-Vl-8B-Instruct, metin, gorsel ve video girdilerini anlayabilen bir vision-language modelidir. OCR, ekran goruntusu analizi, belge anlama ve multimodal yardimci akislar icin uygundur. ## Qwen3-Vl-8B-Thinking (qwen/qwen3-vl-8b-thinking) URL: /models/qwen/qwen3-vl-8b-thinking Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.18 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.1 USD Summary: Gorsel anlama ve OCR icin Qwen VL modeli. Description: Qwen3-Vl-8B-Thinking, metin, gorsel ve video girdilerini anlayabilen bir vision-language modelidir. OCR, ekran goruntusu analizi, belge anlama ve multimodal yardimci akislar icin uygundur. Thinking varyanti, daha zor gorsel problemler ve daha dikkatli adim adim analiz icin daha uygundur. ## Qwen3-Vl-Flash (qwen/qwen3-vl-flash) URL: /models/qwen/qwen3-vl-flash Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.005000 USD Summary: Hizli gorsel anlama ve OCR icin ekonomik Qwen VL modeli. Description: Qwen3-Vl-Flash, gorsel anlama ve OCR tarafina daha dusuk gecikme ve maliyetle girmek isteyen ekipler icin uygundur. Hizli multimodal yardimci akislar icin iyi secimdir. ## Qwen3-Vl-Flash-2025-10-15 (qwen/qwen3-vl-flash-2025-10-15) URL: /models/qwen/qwen3-vl-flash-2025-10-15 Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.050000 USD Summary: Hizli gorsel anlama ve OCR icin ekonomik Qwen VL modeli; tarihli snapshot surumu. Description: Qwen3-Vl-Flash-2025-10-15, gorsel anlama ve OCR tarafina daha dusuk gecikme ve maliyetle girmek isteyen ekipler icin uygundur. Hizli multimodal yardimci akislar icin iyi secimdir. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen3-Vl-Plus (qwen/qwen3-vl-plus) URL: /models/qwen/qwen3-vl-plus Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.020000 USD Summary: Zor belge sentezi ve gorsel reasoning icin ust seviye Qwen VL modeli. Description: Qwen3-Vl-Plus, Qwen tarafinda daha ust kalite isteyen vision-language gorevleri icin konumlanir. Gorsel reasoning, belge sentezi ve ekran goruntusu yorumunda daha guclu secenektir. ## Qwen3-Vl-Plus-2025-09-23 (qwen/qwen3-vl-plus-2025-09-23) URL: /models/qwen/qwen3-vl-plus-2025-09-23 Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.200000 USD Summary: Zor belge sentezi ve gorsel reasoning icin ust seviye Qwen VL modeli; tarihli snapshot surumu. Description: Qwen3-Vl-Plus-2025-09-23, Qwen tarafinda daha ust kalite isteyen vision-language gorevleri icin konumlanir. Gorsel reasoning, belge sentezi ve ekran goruntusu yorumunda daha guclu secenektir. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen3.5-122B-A10b (qwen/qwen3.5-122b-a10b) URL: /models/qwen/qwen3.5-122b-a10b Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.4 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 3.2 USD Summary: Genel sohbet, ozetleme ve yardimci akislar icin temel Qwen modeli. Description: Qwen3.5-122B-A10b, genel amacli metin gorevleri icin guclu bir temel modeldir; reasoning ve talimat takibinde dengeli performans sunar. Daha ozel coder veya VL varyantlarina cikmadan once genel kullanim icin mantiklidir. ## Qwen3.5-27B (qwen/qwen3.5-27b) URL: /models/qwen/qwen3.5-27b Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.3 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.4 USD Summary: Genel sohbet, ozetleme ve yardimci akislar icin temel Qwen modeli. Description: Qwen3.5-27B, genel amacli metin gorevleri icin guclu bir temel modeldir; reasoning ve talimat takibinde dengeli performans sunar. Daha ozel coder veya VL varyantlarina cikmadan once genel kullanim icin mantiklidir. ## Qwen3.5-35B-A3b (qwen/qwen3.5-35b-a3b) URL: /models/qwen/qwen3.5-35b-a3b Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.25 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2 USD Summary: Genel sohbet, ozetleme ve yardimci akislar icin temel Qwen modeli. Description: Qwen3.5-35B-A3b, genel amacli metin gorevleri icin guclu bir temel modeldir; reasoning ve talimat takibinde dengeli performans sunar. Daha ozel coder veya VL varyantlarina cikmadan once genel kullanim icin mantiklidir. ## Qwen3.5-397B-A17b (qwen/qwen3.5-397b-a17b) URL: /models/qwen/qwen3.5-397b-a17b Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.600000 USD Summary: Genel sohbet, ozetleme ve yardimci akislar icin temel Qwen modeli. Description: Qwen3.5-397B-A17b, genel amacli metin gorevleri icin guclu bir temel modeldir; reasoning ve talimat takibinde dengeli performans sunar. Daha ozel coder veya VL varyantlarina cikmadan once genel kullanim icin mantiklidir. ## Qwen3.5-Flash (qwen/qwen3.5-flash) URL: /models/qwen/qwen3.5-flash Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.01 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.4 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.125 USD Summary: Gunluk sohbet ve yuksek hacimli yardimcilar icin hizli Qwen modeli. Description: Qwen3.5-Flash, hizli yanit, dusuk gecikme ve yuksek hacimli kullanim icin optimize edilmis hafif bir modeldir. Basit yardimci akislar, otomasyon ve maliyet kontrollu urunler icin uygundur. ## Qwen3.5-Flash-2026-02-23 (qwen/qwen3.5-flash-2026-02-23) URL: /models/qwen/qwen3.5-flash-2026-02-23 Provider: Qwen Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.4 USD Summary: Gunluk sohbet ve yuksek hacimli yardimcilar icin hizli Qwen modeli; tarihli snapshot surumu. Description: Qwen3.5-Flash-2026-02-23, hizli yanit, dusuk gecikme ve yuksek hacimli kullanim icin optimize edilmis hafif bir modeldir. Basit yardimci akislar, otomasyon ve maliyet kontrollu urunler icin uygundur. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen3.5-Plus (qwen/qwen3.5-plus) URL: /models/qwen/qwen3.5-plus Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.040000 USD Summary: Uzun baglamli yardimcilar ve aracli urun akislari icin dengeli Qwen modeli. Description: Qwen3.5-Plus, guclu reasoning, uzun baglam ve arac kullanimi ile cok amacli gorevler icin dengeli bir genel modeldir. Tek modelle genis urun yuzeyi kapsamak isteyen ekipler icin iyi default olur. ## Qwen3.5-Plus-2026-02-15 (qwen/qwen3.5-plus-2026-02-15) URL: /models/qwen/qwen3.5-plus-2026-02-15 Provider: Qwen Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: starting: 0.400000 USD Summary: Uzun baglamli yardimcilar ve aracli urun akislari icin dengeli Qwen modeli; tarihli snapshot surumu. Description: Qwen3.5-Plus-2026-02-15, guclu reasoning, uzun baglam ve arac kullanimi ile cok amacli gorevler icin dengeli bir genel modeldir. Tek modelle genis urun yuzeyi kapsamak isteyen ekipler icin iyi default olur. Tarihli snapshot oldugu icin davranisi surum sabitligi isteyen entegrasyonlarda tercih edilir. ## Qwen3.6 27B (qwen/qwen3.6-27b-free) URL: /models/qwen/qwen3.6-27b-free Provider: Qwen Context window: 131072 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0 USD Summary: Reasoning, araç kullanımı, görsel girdi ve yapılandırılmış çıktı için günlük kotayla ücretsiz Qwen modeli. Description: Qwen3.6 27B, adım adım düşünme (reasoning) yeteneğine sahip açık ağırlıklı bir modeldir. Metnin yanında görsel girdi de kabul eder. Genel sohbet, analiz, kod yardımı, function calling ve JSON formatında çıktı bekleyen ürün akışları için dengeli bir seçenektir. 131K bağlam penceresi sunar ve tek yanıtta en fazla 16K token üretir. Günlük kullanım kotasıyla ücretsiz sunulur; kota dolduğunda istekler ertesi güne kadar sınırlandırılır. ## Qwen3 Reranker 8B (qwen/qwen3-reranker-8b) URL: /models/qwen/qwen3-reranker-8b Provider: Qwen Context window: 32768 Operations: RERANK Modalities: text Pricing: RERANK/INPUT_TEXT/PER_1M_TOKENS: 0.05 USD Summary: Bir sorguyla aday dokumanlari birlikte okuyup alaka puani ureten yeniden siralama modeli. Description: Qwen3 Reranker 8B, bir sorgu ile aday dokuman listesini birlikte degerlendirip her dokuman icin 0 ile 1 arasinda bir alaka puani uretir. Embedding aramasi hiz icin sorguyu ve dokumani ayri ayri vektorlestirir; reranker ikisini ayni anda okudugu icin daha isabetli bir siralama verir. Tipik kullanim, embedding ile ilk 50-100 adayi cekip bunlari yeniden siralamak ve dil modeline yalnizca en alakali birkacini gondermektir; bu hem yanit kalitesini artirir hem de uretim modelinin token maliyetini dusurur. Turkce dahil 100'den fazla dili okur ve her sorgu-dokuman cifti icin 32.768 tokene kadar metin alir. /v1/rerank ucundan cagrilir, metin uretmez. Faturalama islenen toplam token uzerindendir: her cift icin sorgu ve dokuman tokenlari birlikte sayilir. ## Wan3.0-Video-Prime (alibaba/wan3.0-video-prime) URL: /models/alibaba/wan3.0-video-prime Provider: Alibaba Context window: 0 Operations: VIDEO_GENERATIONS Modalities: text, image, audio, video Pricing: VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.068 USD; VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.14 USD; VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.28 USD Summary: Metin ve referans medyadan hizli video uretimi icin Alibaba modeli. Description: Wan3.0-Video-Prime, metin aciklamasindan video uretir ve ayni istekte referans medya kabul eder: ilk kare, son kare, referans gorsel, referans video veya referans ses. 2-30 saniye arasi cikti verir; 480P, 720P ve 1080P cozunurlukleri saniye bazli fiyatlanir ve goruntuyle birlikte ses de uretilir. Urun tanitimi, karakter tutarli sahneler ve mevcut bir kareden devam eden animasyonlar icin uygundur. ## HappyHorse-1.0-T2V (alibaba/happyhorse-1.0-t2v) URL: /models/alibaba/happyhorse-1.0-t2v Provider: Alibaba Context window: 0 Operations: VIDEO_GENERATIONS Modalities: text, video Pricing: VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.14 USD; VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.24 USD Summary: Metinden kisa video uretimi icin Alibaba modeli. Description: HappyHorse-1.0-T2V, metin aciklamalarindan akici ve detayli kisa videolar uretmek icin kullanilir. 720P ve 1080P ciktiyi saniye bazli fiyatlandirir; urun sahneleri, reklam taslaklari ve yaratici video prototipleri icin uygundur. ## GLM-4.7 (zai/glm-4.7) URL: /models/zai/glm-4.7 Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.6 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.2 USD Summary: Kod üretimi, prototipleme ve arayüz işleri için güçlendirilmiş GLM modeli. Description: Cok adimli execution, yazilim gorevleri ve daha iyi frontend ciktilari ile onceki GLM nesillerine gore daha gucludur. Ozellikle kod uretimi ve prototiplemede dikkat ceker. ## GLM-4.7-FlashX (zai/glm-4.7-flashx) URL: /models/zai/glm-4.7-flashx Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.07 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.4 USD Summary: Hafif kod yardımı ve hızlı ürün entegrasyonları için GLM-4.7 FlashX. Description: Daha hafif coding yardimi, yardimci akislar ve hiz odakli urun entegrasyonlari icin mantiklidir. GLM-4.7 davranisini daha dusuk maliyetle sunar. ## GLM-4.6 (zai/glm-4.6) URL: /models/zai/glm-4.6 Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.6 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.2 USD Summary: Günlük sohbet, analiz ve yardımcı akışlar için oturmuş GLM modeli. Description: Gundelik sohbet, analiz ve yardimci urun akislarinda dengeli davranir. En yeni seri kadar iddiali olmasa da stabil bir genel model arayan ekipler icin uygundur. ## GLM-4.5 (zai/glm-4.5) URL: /models/zai/glm-4.5 Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.6 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.2 USD Summary: Araç çağrıları ve yazılım ajanları için reasoning odaklı GLM modeli. Description: Tool invocation, web benzeri akislar ve yazilim muhendisligi islerinde guclu bir agent temelidir. Dusunen veya hizli modlar arasinda denge kurabilen ekipler icin esnektir. ## GLM-4.5-X (zai/glm-4.5-x) URL: /models/zai/glm-4.5-x Provider: Z.AI Context window: 96000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2.2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 8.9 USD Summary: Daha yuksek performans ve hiz isteyenler icin GLM-4.5-X. Description: GLM-4.5 ailesinde daha agresif performans arayan ekipler icin konumlanir. Zor reasoning ve hizli donuslerin birlikte onemli oldugu islerde iyi secimdir. ## GLM-4.5-Air (zai/glm-4.5-air) URL: /models/zai/glm-4.5-air Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.1 USD Summary: Kod, reasoning ve araç kullanımı için hafif GLM-4.5 agent modeli. Description: Kod, reasoning ve arac kullanimi isteyen ama maliyeti daha siki kontrol etmek isteyen ekipler icin uygundur. Ailenin butce dostu giris kapisidir. ## GLM-4.5-AirX (zai/glm-4.5-airx) URL: /models/zai/glm-4.5-airx Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 4.5 USD Summary: Dengeli hiz ve kalite icin GLM-4.5-AirX. Description: Air varyantina gore daha iddiali ama hala hafif bir secenek sunar. Orta zorluktaki agent ve coding gorevlerinde iyi fiyat-performans verir. ## GLM-4-32B-0414-128K (zai/glm-4-32b-0414-128k) URL: /models/zai/glm-4-32b-0414-128k Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.1 USD Summary: Basit sohbet ve temel özetleme için en ekonomik GLM modellerinden biri. Description: Basit sohbet, temel ozetleme ve maliyetin baskin oldugu akislar icin uygundur. Daha zor reasoning veya ajan gorevleri icin ust GLM serilerine cikmak gerekir. ## GLM-4.6V (zai/glm-4.6v) URL: /models/zai/glm-4.6v Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.3 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.9 USD Summary: Gorsel anlama icin dengeli Z.AI vision modeli. Description: Resim, belge ve ekran goruntusu yorumlama gibi gorevlerde genel amacli vision secenegi sunar. GLM-5V kadar iddiali olmayan ama daha erisilebilir bir katmandir. ## GLM-OCR (zai/glm-ocr) URL: /models/zai/glm-ocr Provider: Z.AI Context window: 32000 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.03 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.03 USD Summary: Belge ve gorsellerden metin cikarmak icin odakli GLM OCR modeli. Description: Metin cikarma, duzen okuma ve belge isleme odakli sistemlerde en dogrudan secenektir. Genel sohbetten cok veri cikarma islerinde anlamlidir. ## GLM-4.6V-FlashX (zai/glm-4.6v-flashx) URL: /models/zai/glm-4.6v-flashx Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.04 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.4 USD Summary: Gorsel isler icin dusuk maliyetli FlashX secenegi. Description: Temel gorsel anlama ve belge okumayi uygun maliyetle sunar. Vision tarafinda hiz ve butce oncelikli urunler icin mantiklidir. ## GLM-4.5V (zai/glm-4.5v) URL: /models/zai/glm-4.5v Provider: Z.AI Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.6 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.8 USD Summary: Image, video ve GUI gorevleri icin guclu reasoning odakli vision modeli. Description: Gorsel reasoning, belge anlama ve arayuz gorevlerinde daha yuksek kalite isteyen ekipler icin uygundur. Multimodal analizde onceki GLM vision katmanlarina gore daha iddiali davranir. ## DeepSeek Chat (deepseek/deepseek-chat) URL: /models/deepseek/deepseek-chat Provider: DeepSeek Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.22 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.007 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.66 USD Summary: Eski DeepSeek entegrasyonları için V4-Flash non-thinking kimliği. Description: `deepseek-chat` resmi API'de DeepSeek-V4-Flash non-thinking moduna map edilir. Mevcut entegrasyonlari kirmamak icin listede tutulur; yeni projelerde `deepseek-v4-flash` tercih edin. Fiyatlandirmasi V4-Flash ile birebir aynidir; hafta ici gecerli olan yogun saat carpani da ayni sekilde uygulanir. ## DeepSeek R1 (deepseek/deepseek-reasoner) URL: /models/deepseek/deepseek-reasoner Provider: DeepSeek Context window: 1000000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.22 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.007 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.66 USD Summary: Eski DeepSeek reasoning entegrasyonları için V4-Flash thinking kimliği. Description: `deepseek-reasoner` resmi API'de DeepSeek-V4-Flash thinking moduna map edilir. Yeni entegrasyonlarda `deepseek-v4-flash` ile thinking yapilandirmasini kullanin. Fiyatlandirmasi V4-Flash ile birebir aynidir; hafta ici gecerli olan yogun saat carpani da ayni sekilde uygulanir. ## DeepSeek V4 Pro 0813 (deepseek/deepseek-v4-pro-0813) URL: /models/deepseek/deepseek-v4-pro-0813 Provider: DeepSeek Context window: 1048576 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.32 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.132 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 3.96 USD Summary: 1M baglam ve 384K'ya kadar cikti sunan fp8 hassasiyetli DeepSeek-V4-Pro surumu. Description: DeepSeek-V4-Pro 0813, DeepSeek-V4-Pro ailesinin fp8 hassasiyetindeki tarihli surumudur. 1M token baglam ve 384K'ya kadar cikti ile zor muhakeme, ajan akislari ve kodlama isleri icin uygundur. Arac cagrisi ve yapilandirilmis (JSON Schema) cikti desteklenir. Tekrarlanan onek girdileri cache isabetinde daha dusuk fiyattan faturalanir. ## Magistral Medium 1.2 (mistral/magistral-medium-latest) URL: /models/mistral/magistral-medium-latest Provider: Mistral Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 5 USD Summary: Alan uzmanlığı gerektiren analizler için en güçlü Magistral modeli. Description: Seffaf dusunme, cok dilli reasoning ve alan bilgisi agirlikli islerde gucludur. Analiz kalitesini hizdan onde tutan ekipler icin Mistral'in reasoning odakli premium secenegidir. ## Sonar Deep Research (perplexity/sonar-deep-research) URL: /models/perplexity/sonar-deep-research Provider: Perplexity Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 8 USD; CHAT_COMPLETIONS/CITATION_TOKENS/PER_1M_TOKENS: 2 USD; CHAT_COMPLETIONS/REASONING_TOKENS/PER_1M_TOKENS: 3 USD; CHAT_COMPLETIONS/SEARCH_QUERY/PER_1K_CALLS: 5 USD Summary: Otonom arastirma ve kapsamli raporlar icin Sonar modeli. Description: Yuzlerce kaynagi tarayip alintili, uzun arastirma ciktilari uretmek icin tasarlanmistir. Kisa cevaplardan cok detayli briefing, rapor ve pazar arastirmasi isteyen ekipler icin uygundur. ## Magistral Small 1.2 (mistral/magistral-small-latest) URL: /models/mistral/magistral-small-latest Provider: Mistral Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.5 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.5 USD Summary: Maliyet kontrollü alan analizleri için hafif Magistral modeli. Description: Alan odakli analiz ve mantik gorevlerinde Magistral davranisini daha dusuk maliyetle sunar. Reasoning isteyen ama premium tier'a cikmak istemeyen ekipler icin mantiklidir. ## PPLX Embed v1 0.6B (perplexity/pplx-embed-v1-0.6b) URL: /models/perplexity/pplx-embed-v1-0.6b Provider: Perplexity Context window: 32000 Operations: EMBEDDINGS Modalities: text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.004 USD Summary: Bagimsiz metinler icin uygun maliyetli standart embedding modeli. Description: Semantik arama, basit RAG ve kisa metin benzerligi islerinde butce dostu secenektir. Maliyet oncelikliyse iyi bir temel embedding tercihidir. ## PPLX Embed v1 4B (perplexity/pplx-embed-v1-4b) URL: /models/perplexity/pplx-embed-v1-4b Provider: Perplexity Context window: 32000 Operations: EMBEDDINGS Modalities: text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.03 USD Summary: Daha doğru semantik arama ve RAG için yüksek kaliteli embedding modeli. Description: Daha iyi semantik ayrim ve retrieval kalitesi istendiginde 0.6B varyantinin ustune cikar. Kaliteyi butcenin biraz onune koyan arama sistemleri icin uygundur. ## Devstral Small 2 (mistral/devstral-small-latest) URL: /models/mistral/devstral-small-latest Provider: Mistral Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.3 USD Summary: Kod ajanlari icin hafif ve acik kaynak odakli secenek. Description: Daha kucuk butceli coding yardimcilari ve otomasyonlarda verimli calisir. Devstral ailesinin daha erisilebilir ve hizli varyantidir. ## PPLX Embed Context v1 0.6B (perplexity/pplx-embed-context-v1-0.6b) URL: /models/perplexity/pplx-embed-context-v1-0.6b Provider: Perplexity Context window: 32000 Operations: EMBEDDINGS Modalities: text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.008 USD Summary: Dokuman chunk'lari icin baglam farkindali embedding modeli. Description: Ayni dokumandaki bolumlerin birbirine bagli okunmasi gereken RAG senaryolarinda faydalidir. Paragraf duzeyinde retrieval isteyen belge sistemleri icin uygundur. ## Codestral (mistral/codestral-latest) URL: /models/mistral/codestral-latest Provider: Mistral Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.3 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.9 USD Summary: Kod tamamlama ve FIM isleri icin saf kod modeli. Description: Kod uretimi, tamamlama ve editor entegrasyonlari icin odakli bir secenektir. Genel sohbetten cok yazilim gelistirme akislarinda deger uretir. ## PPLX Embed Context v1 4B (perplexity/pplx-embed-context-v1-4b) URL: /models/perplexity/pplx-embed-context-v1-4b Provider: Perplexity Context window: 32000 Operations: EMBEDDINGS Modalities: text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.05 USD Summary: Belge tabanli retrieval icin yuksek kaliteli baglamsal embedding. Description: Daha buyuk ve daha kaliteli contextualized embedding isteyen belge agirlikli sistemler icin gucludur. Buyuk RAG kurulumlarinda kalite odakli secimdir. ## Pixtral 12B (mistral/pixtral-12b) URL: /models/mistral/pixtral-12b Provider: Mistral Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.15 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.15 USD Summary: Gorsel anlama icin daha hafif Pixtral secenegi. Description: Resim yorumlama, temel OCR benzeri anlama ve daha hizli multimodal yardimci akislarda verimli calisir. Vision tarafina dusuk maliyetle girmek icin uygundur. ## Ministral 3 14B (mistral/ministral-14b-latest) URL: /models/mistral/ministral-14b-latest Provider: Mistral Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.2 USD Summary: Kenar veya ozel dagitimlar icin guclu Ministral modeli. Description: Boyutunu makul tutarken metin ve gorsel yetenekte iyi kalite sunar. Daha kisitli kaynaklarla saglam genel performans isteyen dagitimlar icin mantiklidir. ## Ministral 3 8B (mistral/ministral-8b-latest) URL: /models/mistral/ministral-8b-latest Provider: Mistral Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.15 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.15 USD Summary: Edge yardımcıları ve düşük kaynaklı otomasyonlar için orta boy Ministral modeli. Description: Gecikme ve kaynak kullanimini daha iyi kontrol etmek isteyen ekipler icin uygun orta nokta sunar. Edge, ozel hosting ve maliyet kontrollu urunlerde iyi calisir. ## Ministral 3 3B (mistral/ministral-3b-latest) URL: /models/mistral/ministral-3b-latest Provider: Mistral Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.1 USD Summary: Hafif dagitimlar icin en kucuk Ministral secenegi. Description: En dusuk kaynakla calisan yardimci, otomasyon ve yerel deneyler icin uygundur. Kalite tavani buyuk modellere gore daha dusuktur ama dagitim esnekligi yuksektir. ## Voxtral Small (mistral/voxtral-small-latest) URL: /models/mistral/voxtral-small-latest Provider: Mistral Context window: 32768 Operations: CHAT_COMPLETIONS Modalities: text, audio Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.3 USD Summary: Transkripsiyon ve sesli yardımcılar için Mistral'in güçlü ses modeli. Description: Ses girdisini anlamlandirma, transkripsiyon ve ses tabanli yardimci akislarda daha guclu secenektir. Ses odakli urunlerde genel text model kullanmaktan daha mantiklidir. ## Recraft V4 Vector (recraft/recraft-v4-vector) URL: /models/recraft/recraft-v4-vector Provider: Recraft Context window: 10000 Operations: IMAGES_GENERATIONS Modalities: image, text Pricing: IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.08 USD Summary: Vector logo, ikon ve illüstrasyon için güncel Recraft modeli. Description: Ölçeklenebilir grafik çıktısı isteyen tasarım ekipleri için uygundur. Logo, ikon seti ve düz illüstrasyon işlerinde raster modellerden daha doğrudan değer üretir. ## Recraft V4 Pro Vector (recraft/recraft-v4-pro-vector) URL: /models/recraft/recraft-v4-pro-vector Provider: Recraft Context window: 10000 Operations: IMAGES_GENERATIONS Modalities: image, text Pricing: IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.3 USD Summary: En yüksek kontrollü vector üretim için Recraft V4 Pro Vector. Description: Daha temiz çizgiler, daha güçlü komut takibi ve premium tasarım çıktısı isteyen ekipler için uygundur. Marka sistemi ve teslim kalitesi yüksek vector işlerinde öne çıkar. ## Recraft V3 (recraft/recraft-v3) URL: /models/recraft/recraft-v3 Provider: Recraft Context window: 1000 Operations: IMAGES_GENERATIONS Modalities: image, text Pricing: IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.04 USD Summary: Erişilebilir görsel üretim ve olgun davranış için önceki Recraft raster modeli. Description: Güncel V4 çizgisine çıkmadan önce daha olgun ve sade bir Recraft davranışı isteyen ekipler için hâlâ anlamlı olabilir. Genel görsel üretim işlerinde erişilebilir bir seçenektir. ## Recraft V3 Vector (recraft/recraft-v3-vector) URL: /models/recraft/recraft-v3-vector Provider: Recraft Context window: 1000 Operations: IMAGES_GENERATIONS Modalities: image, text Pricing: IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.08 USD Summary: Önceki nesil vector üretim için Recraft modeli. Description: Vector illüstrasyon ve grafik çıktıda daha eski nesil ama erişilebilir bir seçenek sunar. Güncel V4 Vector'a çıkmadan önce maliyet ve alışılmış davranış isteyen ekipler için uygundur. ## Apertus v1.5 8B Thinking (publicai/apertus-v1.5-8b-thinking) URL: /models/publicai/apertus-v1.5-8b-thinking Provider: PublicAI Context window: 262144 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.2 USD Summary: Kapatılabilir adım adım düşünme, görsel okuma ve 262K bağlam sunan Apertus modeli. Description: Apertus v1.5 8B Thinking, yanıtı vermeden önce adım adım düşünen bir muhakeme modelidir. Düşünme adımları yanıtın içine karışmaz; ayrı bir alanda döner. Matematik, mantık soruları, çok adımlı analiz ve dikkatli okuma gerektiren görevlerde standart 8B sürümünden daha isabetli sonuç verir. Düşünme varsayılan olarak açıktır; gerekmediğinde model kimliğine `:fast` ekleyerek (`publicai/apertus-v1.5-8b-thinking:fast`) veya istek gövdesinde `reasoning: false` göndererek kapatılabilir. Kapalıyken yanıtlar belirgin biçimde kısalır ve daha az çıktı tokenı harcar. Metin ve görsel girdiyi işler, 262.144 token bağlam penceresi sunar ve JSON formatında çıktı üretebilir. Bu sürüm araç çağırmayı (function calling) desteklemez; araç kullanan akışlar için Apertus v1.5 8B tercih edilmelidir. Görseller yalnızca base64 data URL olarak gönderilir. ## Apertus 8B Instruct (publicai/apertus-8b-instruct) URL: /models/publicai/apertus-8b-instruct Provider: PublicAI Context window: 65536 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.2 USD Summary: Genel sohbet, ozetleme ve hafif otomasyon icin Apertus 8B modeli. Description: Apertus 8B Instruct, genel amacli metin isleri icin kullanilabilen acik agirlikli bir instruction modelidir. Kisa sohbetler, ozetleme, siniflandirma, veri donusumu ve hafif otomasyon akislarinda pratik bir secenek sunar. Chat Completions ve function calling kullanan uygulamalarla uyumludur. ## Apertus 70B Instruct (publicai/apertus-70b-instruct) URL: /models/publicai/apertus-70b-instruct Provider: PublicAI Context window: 65536 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.82 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.92 USD Summary: Genel metin uretimi, analiz ve yapilandirilmis cikti icin Apertus 70B. Description: Apertus 70B Instruct, genel amacli metin uretimi, analiz, cok dilli yardimci akislar ve yapilandirilmis cikti gerektiren uygulamalar icin kullanilabilen acik agirlikli bir instruction modelidir. Sohbet, bilgi sentezi, icerik taslagi, kod yardimi ve JSON formatinda cevap bekleyen urun akislarinda tercih edilebilir. Chat Completions, function calling ve JSON mode kullanan entegrasyonlarla uyumludur. ## MiniMax M2.7 Highspeed (minimax/minimax-m2.7-highspeed) URL: /models/minimax/minimax-m2.7-highspeed Provider: MiniMax Context window: 204800 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.6 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.06 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.4 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.375 USD Summary: Daha dusuk gecikmeli kod ve ajan isleri icin MiniMax M2.7 varyanti. Description: MiniMax M2.7 Highspeed, M2.7 davranisini daha hizli cevap suresiyle isteyen ekipler icindir. Kod yardimi, refactor, canli debug ve interaktif ajan deneyimlerinde gecikme daha kritik oldugunda tercih edilir; ayni 204.800 token baglam penceresini korur. ## MiniMax M2.7 (Ucretsiz) (minimax/minimax-m2.7-free) URL: /models/minimax/minimax-m2.7-free Provider: MiniMax Context window: 196608 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0 USD Summary: Kod uretimi, hata ayiklama ve cok adimli is akislari icin MiniMax M2.7'nin ucretsiz surumu. 196K baglam, gunluk kotali. Description: MiniMax M2.7'nin ucretsiz sunulan surumudur. Kodlama, dokuman uretimi, hata ayiklama, cok adimli is akislari ve uzun baglamli asistan senaryolari icin kullanilir. Bu satirda baglam penceresi 196.608 token ve tek yanit en fazla 196.608 tokendir; ucretli MiniMax M2.7 satiri ayni modeli 204.800 token baglamla sunar, cunku farkli bir sunucu uzerinden calisir. Satir gunluk paylasimli bir kullanim kotasina tabidir; kota dolunca istekler 429 ile reddedilir ve faturaniza hicbir sey yansimaz. Istekler yurt disindaki ucuncu taraf bir altyapi uzerinden islenir. Daha genis baglam veya kotasiz kullanim gerekiyorsa ucretli MiniMax M2.7 satirini tercih edin. ## MiniMax M2.5 (minimax/minimax-m2.5) URL: /models/minimax/minimax-m2.5 Provider: MiniMax Context window: 204800 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.3 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.03 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.2 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.375 USD Summary: Kod uretimi ve refactor isleri icin dengeli MiniMax M2 modeli. Description: MiniMax M2.5, kod uretimi, refactor, teknik yardim ve genel metin tabanli urun akislarinda fiyat-performans dengesi arayan ekipler icin uygundur. 204.800 token baglam penceresiyle uzun talimatlari ve buyuk proje baglamlarini tasiyabilir. ## MiniMax M2.5 Highspeed (minimax/minimax-m2.5-highspeed) URL: /models/minimax/minimax-m2.5-highspeed Provider: MiniMax Context window: 204800 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.6 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.03 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.4 USD; CHAT_COMPLETIONS/CACHE_WRITE/PER_1M_TOKENS: 0.375 USD Summary: Hiz oncelikli kod yardimi ve refactor icin MiniMax M2.5 varyanti. Description: MiniMax M2.5 Highspeed, M2.5 ailesinin daha hizli inference varyantidir. Editor yardimi, kisa refactor donguleri, hizli teknik cevaplar ve gecikme hassas chat deneyimleri icin anlamlidir; 204.800 token baglam penceresini korur. ## MiniMax H3 (minimax/minimax-h3) URL: /models/minimax/minimax-h3 Provider: MiniMax Context window: 0 Operations: VIDEO_GENERATIONS Modalities: text, image, video Pricing: VIDEO_GENERATIONS/INPUT_IMAGE/PER_IMAGE: 0.04 USD; VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.13 USD Summary: Metin, ilk/son kare ve referans gorsel girdilerinden 2K video uretimi icin MiniMax modeli. Description: MiniMax H3, metin aciklamasindan video uretir ve ayni istekte referans materyal kabul eder: ilk kare, son kare veya referans gorsel. Cikti 5-15 saniye arasindadir ve 2K cozunurlukte saniye bazli fiyatlanir. Ilk bes referans gorsel ucretsizdir, sonraki her gorsel ayrica ucretlenir. Urun tanitimi, karakter tutarli sahneler ve mevcut bir kareden devam eden animasyonlar icin uygundur. ## MiniMax H3 Max (minimax/minimax-h3-max) URL: /models/minimax/minimax-h3-max Provider: MiniMax Context window: 0 Operations: VIDEO_GENERATIONS Modalities: text, image, video Pricing: VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.05 USD; VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.08 USD Summary: Hizli metinden video ve gorselden video uretimi icin MiniMax H3 varyanti. Description: MiniMax H3 Max, MiniMax ve fal.ai tarafindan birlikte yayinlanan, H3 uzerinde son egitimden gecirilmis hizli video varyantidir. Metinden video ve gorselden video modlarini destekler; baslangic karesi, bitis karesi veya ikisi birden verilebilir. Cikti 5-15 saniye arasindadir; 480P ve 768P cozunurlukler saniye bazli fiyatlanir. Baslangic veya bitis karesi disindaki referans gorseller bu satirda desteklenmez, onlar icin MiniMax H3 satirini kullanin. ## Muse Spark 1.2 (meta/muse-spark-1.2) URL: /models/meta/muse-spark-1.2 Provider: Meta Context window: 1048576 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.25 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.15 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 4.25 USD Summary: 1M token baglamli, kodlama ve ajan akislari icin ayarlanmis reasoning modeli; gorsel, video ve PDF okur. Description: Muse Spark 1.2, Meta'nin kodlama ve ajan akislari icin ayarlanmis reasoning modelidir. 1.048.576 tokenlik baglam penceresiyle buyuk bir kod tabanini, uzun bir dokuman yiginini veya cok adimli bir arac dongusunun tamamini tek oturumda tutabilirsiniz. Yanit vermeden once adim adim dusunur; bu dusunme eforunu `reasoning_effort` ile minimal, low, medium, high ve xhigh arasinda ayarlarsiniz. Metnin yani sira gorsel, video ve PDF girdisi kabul eder; arac/fonksiyon cagrisi yapar, JSON nesne ciktisi ve semaya uyan yapilandirilmis cikti uretir. Ayni istemi tekrar gonderdiginizde prompt cache indirimi devreye girebilir. Reasoning tokenlari `completion_tokens` icinde doner ve cikti olarak ucretlendirilir. ## Muse Spark 1.1 (meta/muse-spark-1.1) URL: /models/meta/muse-spark-1.1 Provider: Meta Context window: 1048576 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1.25 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.15 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 4.25 USD Summary: Muse Spark ailesinin onceki checkpoint'i; 1.2 ile ayni 1M baglam, multimodal girdi ve arac cagrisi, ayni fiyat. Description: Muse Spark 1.1, Muse Spark ailesinin onceki checkpoint'idir. 1.048.576 tokenlik baglam penceresi, gorsel/video/PDF girdisi, arac cagrisi, JSON ve yapilandirilmis cikti destegi 1.2 ile aynidir ve ayni fiyattan ucretlendirilir; 1.2 yalnizca guncellenmis bir checkpoint olarak biraz daha yuksek performans sunar. Yanit vermeden once adim adim dusunur ve bu eforu `reasoning_effort` ile minimal ile xhigh arasinda ayarlarsiniz. Davranisini bu checkpoint'e sabitlemek isteyen, ciktisi dogrulanmis akislar icin uygundur; yeni islerde ailenin guncel checkpoint'i Muse Spark 1.3 tercih edilebilir. Reasoning tokenlari `completion_tokens` icinde doner ve cikti olarak ucretlendirilir. ## Muse Spark 1.2 Contributor (meta/muse-spark-1.2-contributor) URL: /models/meta/muse-spark-1.2-contributor Provider: Meta Context window: 1048576 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.002 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.2 USD Summary: Muse Spark 1.2'nin cok daha ucuz katmani; karsiliginda istem ve yanitlariniz Meta model egitiminde kullanilir. Description: Muse Spark 1.2 Contributor, Muse Spark 1.2 ile ayni checkpoint'tir; farki fiyat ve veri politikasidir. Gonderdiginiz istemler ve aldiginiz yanitlar Meta tarafindan gelecek modellerin egitiminde kullanilir ve bunun karsiliginda tokenlar cok daha ucuza gelir: girdide 1M token basina 1,25 dolar yerine 0,10 dolar, ciktida 4,25 dolar yerine 0,20 dolar. Yetenekleri 1.2 ile birebir aynidir: 1.048.576 token baglam, gorsel/video/PDF girdisi, arac cagrisi, JSON ve semaya uyan yapilandirilmis cikti, minimal ile xhigh arasinda ayarlanabilir reasoning eforu. Prototip, yuk testi ve entegrasyon denemeleri gibi verisi hassas olmayan isler icin uygundur; gizli, kisisel veya musteri verisi iceren isleri standart katmandaki Muse Spark 1.2'ye birakin. Bu katmanin hiz limiti dusuktur ve platform genelinde paylasilir, bu yuzden yuksek hacimli uretim trafigi icin uygun degildir. ## Muse Spark 1.3 Contributor (meta/muse-spark-1.3-contributor) URL: /models/meta/muse-spark-1.3-contributor Provider: Meta Context window: 1048576 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.002 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.2 USD Summary: Prototip ve yuk testi icin cok daha ucuz Muse Spark 1.3 katmani; karsiliginda istem ve yanitlariniz Meta model egitiminde kullanilir. Description: Muse Spark 1.3 Contributor, Muse Spark 1.3 ile ayni checkpoint'tir; farki fiyat ve veri politikasidir. Gonderdiginiz istemler ve aldiginiz yanitlar Meta tarafindan gelecek modellerin egitiminde kullanilir ve bunun karsiliginda tokenlar cok daha ucuza gelir: girdide 1M token basina 1,25 dolar yerine 0,10 dolar, ciktida 4,25 dolar yerine 0,20 dolar. Yetenekleri 1.3 ile birebir aynidir: 1.048.576 token baglam, gorsel/video/PDF girdisi, arac cagrisi, JSON ve semaya uyan yapilandirilmis cikti, minimal ile xhigh arasinda ayarlanabilir reasoning eforu. Saglayici bu katmani secili ulkelerde sunar ve token bazli hiz limiti uygular. Prototip, yuk testi ve entegrasyon denemeleri gibi verisi hassas olmayan isler icin uygundur; gizli, kisisel veya musteri verisi iceren isleri standart katmandaki Muse Spark 1.3'e birakin. Bu katmanin hiz limiti dusuktur ve platform genelinde paylasilir, bu yuzden yuksek hacimli uretim trafigi icin uygun degildir. ## Llama 3.3 70B Instruct (12K) (meta/llama-3.3-70b-instruct-12k) URL: /models/meta/llama-3.3-70b-instruct-12k Provider: Meta Context window: 12288 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.135 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.4 USD Summary: Genel sohbet, çok dilli işler ve araç kullanımı için 12K bağlamlı Llama modeli. Description: Llama 3.3 70B Instruct, Meta'nın çok dilli, açık ağırlıklı instruction modelidir. Genel sohbet, özetleme, içerik taslağı, kod yardımı ve function calling gerektiren yardımcı akışlarda güçlü bir genel amaçlı seçenektir. Bağlam penceresi ve tek yanıttaki azami çıktı 12.288 token ile sınırlıdır. Desteklenen diller: İngilizce, Almanca, Fransızca, İtalyanca, Portekizce, Hintçe, İspanyolca ve Tayca. ## Llama 3.1 8B Instruct (meta/llama-3.1-8b-instruct-16k) URL: /models/meta/llama-3.1-8b-instruct-16k Provider: Meta Context window: 16384 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.02 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.05 USD Summary: Hızlı, hafif ve 16K bağlamlı; genel sohbet ve JSON çıktı için Llama modeli. Description: Llama 3.1 8B Instruct, Meta'nın hızlı ve verimli çalışan küçük, açık ağırlıklı instruction modelidir. Kısa sohbet, sınıflandırma, veri dönüşümü ve düşük gecikme isteyen hafif otomasyon işleri için uygundur, JSON formatında çıktı destekler. Bağlam penceresi ve tek yanıttaki azami çıktı 16.384 token ile sınırlıdır. Bu model function calling (araç çağrısı) desteklemez. ## Nemotron 3 Ultra 550B A55B 262K (nvidia/nemotron-3-ultra-550b-a55b-262k) URL: /models/nvidia/nemotron-3-ultra-550b-a55b-262k Provider: NVIDIA Context window: 262144 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.5 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.2 USD Summary: Uzun baglamli reasoning, arac cagrisi ve ajan akislari icin 262K baglamli, prompt cache indirimli Nemotron Ultra. Description: Nemotron 3 Ultra 550B A55B, NVIDIA'nin en buyuk acik agirlikli Nemotron modelidir: 550 milyar parametresinin token basina 55 milyarini calistiran seyrek bir Mixture-of-Experts mimarisidir. Zor reasoning, orkestrasyon, kodlama ajanlari ve uzun soluklu kurumsal akislar icin tasarlanmistir. Bu dagitim 262.144 tokenlik baglam penceresi, yerel arac cagrisi, JSON nesne modu ve JSON Schema ile sema zorlamali cikti sunar. `tool_choice` alanini `auto` veya `required` ile kullanin; belirli bir fonksiyonu ada gore zorlamak bu dagitimda uygulanmaz — model istediginiz araci degil prompt'a uyan araci cagirir, bu yuzden adlandirilmis secimi bir kisit olarak kullanmayin. Prompt cache kendiliginden devrededir: tekrarlanan onek 8.192 tokenlik tam bloklar halinde saklanir ve indirimli cached input fiyatindan faturalanir, artan kisim standart girdi fiyatindan islenir. Adim adim dusunme varsayilan olarak aciktir ve yanittan ayri doner; bu yuzden kisa bir soru bile dusunme tokeni harcar, `max_tokens` degerini buna gore verin. Istek bazinda kapatilabilir ve dusunme tokenlari cikti olarak faturalanir. Model yalnizca metin kabul eder ve yalnizca metin uretir; gorsel, ses ve video girdisi desteklenmez. Baglam penceresinin altinda ayri bir cikti tavani yoktur. ## Nemotron 3 Super 120B A12B (nvidia/nemotron-3-super-120b-a12b) URL: /models/nvidia/nemotron-3-super-120b-a12b Provider: NVIDIA Context window: 262144 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0 USD Summary: Uzun bağlam ve araç kullanımı için dengeli, günlük kotayla ücretsiz Nemotron modeli. Description: Nemotron 3 Super (120B toplam, 12B aktif parametre), 262K token bağlam penceresi sunan dengeli bir açık ağırlıklı modeldir. Genel sohbet, özetleme, kod yardımı, function calling ve JSON formatında çıktı bekleyen ürün akışları için uygundur. Günlük kullanım kotasıyla ücretsiz sunulur. ## Step 3.5 Flash (stepfun/step-3.5-flash) URL: /models/stepfun/step-3.5-flash Provider: StepFun Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.02 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.3 USD Summary: Uzun baglamli, metin odakli StepFun chat ve reasoning modeli. Description: Step 3.5 Flash, metin tabanli chat, kod yardimi, bilgi sentezi ve uzun baglamli asistan akislari icin konumlanan StepFun modelidir. Chat Completions, tool calling ve JSON mode destekler; controllable reasoning_effort capability'si bu varyantta acik edilmez. ## Step 3.5 Flash 2603 (stepfun/step-3.5-flash-2603) URL: /models/stepfun/step-3.5-flash-2603 Provider: StepFun Context window: 256000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.1 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.02 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.3 USD Summary: Metin analizi, kod ve kontrollu reasoning icin Step 3.5 Flash varyanti. Description: Step 3.5 Flash 2603, Step 3.5 Flash ailesinin controllable reasoning varyantidir. Metin tabanli Chat Completions, tool calling ve JSON mode destekler; reasoning_effort low ve high seviyeleriyle hiz/derinlik tercihi istek parametreleriyle secilebilir. ## AionLabs: Aion 2.5 (aion-labs/aion-2.5) URL: /models/aion-labs/aion-2.5 Provider: AionLabs Context window: 131072 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 1 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.35 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 3 USD Summary: Dogal diyalog ve karakter sesi isteyen roleplay uygulamalari icin Aion modeli. Description: Aion 2.5, Aion 2.0'a gore daha dogal cevap akisi ve daha hizli donus hedefleyen roleplay odakli modeldir. Karakter sesini koruma, sahne ici gerilim kurma, uzun sohbetlerde ton devam ettirme ve yaratici metin uretme islerinde kullanilir. 128K context, 32K maksimum cikti ve cache-read fiyatlandirmasi destekler. ## AionLabs: Aion 2.0 (aion-labs/aion-2.0) URL: /models/aion-labs/aion-2.0 Provider: AionLabs Context window: 131072 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.8 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.2 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.6 USD Summary: Kontrollu reasoning ile roleplay ve hikaye uretimi icin Aion modeli. Description: Aion 2.0, DeepSeek V3.2 tabanli roleplay ve hikaye uretimi modeli olarak uzun karakter diyaloglari, gerilimli sahne ilerleyisi ve daha koyu temalari isleyen yaratici akislarda kullanilir. Aion API bu modelde none, low, medium ve high reasoning_effort seviyelerini destekler; LLMTR'de suffix veya body alaniyla kontrol edilebilir. 128K context, 32K maksimum cikti ve cache-read fiyatlandirmasi destekler. ## AionLabs: Aion-RP 1.0 (8B) (aion-labs/aion-rp-llama-3.1-8b) URL: /models/aion-labs/aion-rp-llama-3.1-8b Provider: AionLabs Context window: 32768 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.8 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.6 USD Summary: Kisa ve orta uzunlukta roleplay sohbetleri icin Llama 3.1 8B tabanli model. Description: Aion-RP 1.0 (8B), Llama 3.1 8B tabanli roleplay modelidir. Daha kucuk context penceresiyle kisa ve orta uzunlukta karakter sohbetleri, NPC yanitlari, yaratici denemeler ve maliyeti ongorulebilir roleplay akislari icin uygundur. 32K context ve 32K maksimum cikti destekler; cache-read veya controllable reasoning capability'si kataloglanmaz. ## Tencent: Hy4 Preview (tencent/hy4-preview) URL: /models/tencent/hy4-preview Provider: Tencent Context window: 262144 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.834 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.042 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 2.501 USD Summary: Kod ajanlari, uzun dokuman analizi ve cok adimli arac akislari icin 262K baglamli onizleme modeli. Varsayilan olarak dusunur. Description: Tencent Hy4 Preview, kod ajanlari, uzun dokuman analizi ve cok adimli arac akislari icin 262.144 tokenlik baglam penceresi sunan onizleme modelidir. Varsayilan olarak dusunur; dusunce zinciri `reasoning_content` alaninda ayri doner ve tokenlari `completion_tokens` icinde sayilir. Kapatmak icin `reasoning_effort` alanini `none` gonderin ya da kimlige `:none` ekleyin - olculmus etkisi olan tek seviye budur. Arac cagrisi, `json_schema` ile sema zorlamali JSON ve prompt cache destekler; onbellekten okunan tokenlar dusuk cache fiyatindan faturalanir. Iki sinir var: `tool_choice` alanindaki `required` yukari akista yok sayildigi icin LLMTR onu 400 ile reddeder, yoksa ajan dongunuz bekledigi arac cagrisini hic almadan devam ederdi; isimli fonksiyon secimi calisir ama `finish_reason` alani `"stop"` doner, o yuzden etikete degil `tool_calls` alaninin varligina bakin. Yalnizca metin kabul eder; gonderilen gorsel hata verilmeden dusurulur. Ayrinti: LLMTR dokumantasyonundaki Chat Completions ve Tool Calling sayfalari. ## Tencent: Hy3 (tencent/hy3) URL: /models/tencent/hy3 Provider: Tencent Context window: 196608 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.14 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.035 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.58 USD Summary: 295B MoE (token başına ~21B aktif); kod ajanları, uzun doküman analizi ve araç akışları için. Düşünme varsayılan kapalı. Description: Tencent Hy3, token başına yaklaşık 21 milyar parametresi çalışan 295 milyar parametreli bir Mixture-of-Experts modelidir; kod ajanları, uzun doküman analizi, çok turlu diyalog ve çok adımlı araç akışları için geliştirilmiştir. Düşünme varsayılan olarak kapalıdır: model kimliğini olduğu gibi çağırırsanız doğrudan yanıt verir. `:low` soneki sığ, `:high` soneki derin düşünmeyi açar; düşünce zinciri yanıtta `reasoning_content` alanında ayrı döner ve tokenları `completion_tokens` içinde sayılır. Ara seviyeler (`minimal`, `medium`, `xhigh`) sunulmaz, çünkü ölçümde bunlar `low` ve `high` arasında ayrı bir kademe oluşturmuyor — gerçek olan üç durum vardır: kapalı, sığ, derin. Araç/fonksiyon çağrısını yerel olarak destekler; `tool_choice` alanını `auto` veya `required` ile kullanın, belirli bir fonksiyonu ada göre zorlamak bu sağlayıcıda güvenilir çalışmıyor. Şema zorlamalı JSON çıktısı `json_schema` ile desteklenir, `json_object` biçimi desteklenmez. Tekrarlanan önekleri prompt cache'ten okur. Model 256K pencere ile duyurulur, ancak tek bir istek en fazla 192K token (196.608) girdi kabul eder: fazlasında sağlayıcı istemin baş tarafını sessizce düşürür ve kalanla yanıt verir, kaybı bildirmez. LLMTR bu yüzden modelin bağlam uzunluğunu 192K olarak yayınlar; uzun dokümanları bu sınırın altında tutun ya da parçalara bölün. Yalnızca metin kabul eder; görsel ve ses girdisi desteklenmez. ## Tencent: Hy-MT2 Lite (tencent/hy-mt2-lite) URL: /models/tencent/hy-mt2-lite Provider: Tencent Context window: 8192 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.044 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.177 USD Summary: Hafif belge ve mesaj çevirisi için 1.8B parametreli model; 33 dil ve 5 lehçe çifti destekler. Yalnızca metin. Description: Tencent Hunyuan MT2 Lite, 1.8 milyar parametreli ve 8K bağlam pencereli hafif bir çeviri modelidir. 33 dil ve 5 Çince lehçe/diyalekt çifti için güçlü çeviri desteği sunar; Flores200 ve WMT25 açık değerlendirmelerinde güçlü sonuçlar verir. Yapılandırılmış çeviri, sınırlayıcı tabanlı çeviri, bağlama duyarlı çeviri, terim sözlüğü kullanan çeviri ve üsluba özgü çeviri görevlerini destekler. Yalnızca metin girişi ve çıktısı; görsel, ses veya araç çağrısı desteklenmez. ## Tencent: Hy-MT2 Plus (tencent/hy-mt2-plus) URL: /models/tencent/hy-mt2-plus Provider: Tencent Context window: 8192 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.074 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.295 USD Summary: Profesyonel doküman çevirisi için 7B parametreli model; 33 dil ve 5 lehçe çifti destekler. Yalnızca metin. Description: Tencent Hunyuan MT2 Plus, 7 milyar parametreli ve 8K bağlam pencereli bir çeviri modelidir. 33 dil ve 5 Çince lehçe/diyalekt çifti için güçlü çeviri desteği sunar; Flores200 ve WMT25 açık değerlendirmelerinde sektör lideri sonuçlar verir. Yapılandırılmış çeviri, sınırlayıcı tabanlı çeviri, bağlama duyarlı çeviri, terim sözlüğü kullanan çeviri ve üsluba özgü çeviri görevlerini destekler. Yalnızca metin girişi ve çıktısı; görsel, ses veya araç çağrısı desteklenmez. ## Tencent: Hy-MT2 Pro (tencent/hy-mt2-pro) URL: /models/tencent/hy-mt2-pro Provider: Tencent Context window: 8192 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.074 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.295 USD Summary: Kurumsal ölçekli, karmaşık metin çevirisi için 30B-A3B MoE mimarili amiral model; 33 dil ve 5 lehçe çifti destekler. Yalnızca metin. Description: Tencent Hunyuan MT2 Pro, 30B-A3B parametreli (Mixture-of-Experts mimarisi) ve 8K bağlam pencereli amiral çeviri modelidir. 33 dil ve 5 Çince lehçe/diyalekt çifti için güçlü çeviri desteği sunar; Flores200 ve WMT25 açık değerlendirmelerinde sektör lideri sonuçlar verir. Yapılandırılmış çeviri, sınırlayıcı tabanlı çeviri, bağlama duyarlı çeviri, terim sözlüğü kullanan çeviri ve üsluba özgü çeviri görevlerini destekler. Yalnızca metin girişi ve çıktısı; görsel, ses veya araç çağrısı desteklenmez. ## Grok 4.20 Multi-Agent (xai/grok-4.20-multi-agent) URL: /models/xai/grok-4.20-multi-agent Provider: xAI Context window: 2000000 Operations: RESPONSES Modalities: text Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 1.25 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 2.5 USD Summary: Araştırma akışları için çok ajanlı Grok modeli. Description: Birden fazla alt görevi paralel yürütüp daha kapsamlı araştırma çıktısı üretmek isteyen ekipler için konumlanır. Kısa yanıtlardan çok derin tarama, sentez ve briefing hazırlığında öne çıkar. ## Grok 4.20 Reasoning 0309 (xai/grok-4.20-0309-reasoning) URL: /models/xai/grok-4.20-0309-reasoning Provider: xAI Context window: 2000000 Operations: RESPONSES Modalities: text Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 1.25 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 2.5 USD Summary: Derin düşünme gerektiren işler için Grok reasoning modeli. Description: Daha zor analiz, karşılaştırma ve çok adımlı problem çözme senaryolarında daha dikkatli çıktı üretmek isteyen ekipler için uygundur. Hızdan çok muhakeme kalitesine öncelik verir. ## Grok 4.20 Non-Reasoning 0309 (xai/grok-4.20-0309-non-reasoning) URL: /models/xai/grok-4.20-0309-non-reasoning Provider: xAI Context window: 2000000 Operations: RESPONSES Modalities: text Pricing: RESPONSES/INPUT_TEXT/PER_1M_TOKENS: 1.25 USD; RESPONSES/OUTPUT_TEXT/PER_1M_TOKENS: 2.5 USD Summary: Hızlı genel metin işleri için Grok varyantı. Description: Sohbet, özetleme ve günlük ürün akışlarında reasoning sürümüne göre daha hızlı dönüş verir. Daha hafif görevlerde maliyet ve gecikmeyi kontrol etmek isteyen ekipler için uygundur. ## Grok Imagine Image (xai/grok-imagine-image) URL: /models/xai/grok-imagine-image Provider: xAI Context window: 0 Operations: IMAGES_GENERATIONS Modalities: image, text Pricing: IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.02 USD Summary: Günlük görsel üretim ve düzenleme için Grok Imagine modeli. Description: Metinden görsel üretimi ve konuşmalı düzenleme işlerinde erişilebilir bir xAI görsel katmanı sunar. Hızlı yaratıcı iterasyon ve genel ürün görseli akışlarında uygundur. ## Grok Imagine Image Quality (xai/grok-imagine-image-quality) URL: /models/xai/grok-imagine-image-quality Provider: xAI Context window: 0 Operations: IMAGES_GENERATIONS Modalities: image, text Pricing: IMAGES_GENERATIONS/OUTPUT_IMAGE/PER_IMAGE: 0.04 USD Summary: Premium görsel üretim ve daha sıkı komut takibi için Grok Imagine modeli. Description: Daha ayrıntılı ve kontrollü görsel sonuçlar isteyen ekipler için standart Imagine sürümünün üstünde konumlanır. Premium yaratıcı çıktı beklentisi olan akışlarda daha anlamlıdır. ## Grok Imagine Video (xai/grok-imagine-video) URL: /models/xai/grok-imagine-video Provider: xAI Context window: 0 Operations: VIDEO_GENERATIONS Modalities: video, text Pricing: VIDEO_GENERATIONS/OUTPUT_VIDEO/PER_SECOND: 0.05 USD Summary: Prompt tabanlı video üretimi için Grok Imagine modeli. Description: Yaratıcı video denemeleri, tanıtım sahneleri ve kısa konsept anlatımları üretmek isteyen ekipler için uygundur. Metinden videoya üretim gerektiren akışlarda xAI tarafındaki doğrudan seçenektir. ## Grok Voice TTS (xai/grok-voice-tts) URL: /models/xai/grok-voice-tts Provider: xAI Context window: 100000 Operations: AUDIO_SPEECH Modalities: text, audio Pricing: AUDIO_SPEECH/INPUT_TEXT/PER_1M_CHARACTERS: 4.2 USD Summary: Metinden sese dönüşüm için Grok Voice modeli. Description: Uygulama içi seslendirme, okuma ve yardımcı ses akışlarında yazıyı doğal sese çevirmek için uygundur. Voice UX eklemek isteyen ürün ekipleri için pratik bir temel sunar. ## Grok Voice STT (xai/grok-voice-stt) URL: /models/xai/grok-voice-stt Provider: xAI Context window: 0 Operations: AUDIO_TRANSCRIPTIONS Modalities: audio, text Pricing: AUDIO_TRANSCRIPTIONS/INPUT_AUDIO/PER_HOUR: 0.1 USD Summary: Ses dosyalarını metne çevirmek için Grok Voice modeli. Description: Konuşma çözümleme, not çıkarma ve ses girişini yazıya dönüştüren ürün akışlarında kullanılır. Genel sesli arayüzlerde temel speech-to-text ihtiyacını karşılar. ## Perceptron Mk1 (perceptron/perceptron-mk1) URL: /models/perceptron/perceptron-mk1 Provider: Perceptron Context window: 32000 Operations: CHAT_COMPLETIONS Modalities: text, image, video Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.15 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 1.5 USD Summary: Gorsel ve video anlama icin Perceptron vision-language modeli. Description: Perceptron Mk1, gorsel ve video girdilerini anlamak icin kullanilan bir vision-language modelidir. Gorsel soru-cevap, OCR benzeri metin okuma, nesne konumlama, aciklama uretimi ve zamana yayilan video analizi gibi islerde gorsel kanit uzerinden reasoning gerektiren ekipler icin uygundur. ## Ling 3.0 Flash (inclusionai/ling-3.0-flash) URL: /models/inclusionai/ling-3.0-flash Provider: InclusionAI Context window: 262144 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.06 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.012 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.18 USD Summary: 124B MoE (token basina ~5.1B aktif); varsayilan olarak dusunur, arac cagrisi ve prompt cache destekler, 256K baglam sunar. Description: Ling 3.0 Flash, InclusionAI'nin 124 milyar parametreli Mixture-of-Experts modelidir; token basina yaklasik 5,1 milyar parametre calisir. Ajan is akislarinda token verimliligi hedefiyle egitilmistir: arac cagrisini yerel olarak destekler, tekrarlanan onekleri prompt cache'ten okur ve 256K baglam penceresi sunar. Varsayilan olarak dusunur; dusunce zinciri yanitta `reasoning_content` alaninda ayri doner ve tokenlari `completion_tokens` icinde sayilir. Dusunmeyi kapatmak icin `reasoning_effort` alanini `none` gonderin ya da model kimligine `:none` sonekini ekleyin - bu modelde etkisi olculmus tek seviye budur, diger seviyeler kabul edilse de dusunme uzunlugunu duzenli sekilde degistirmez ve bu yuzden sunulmaz. Cikti tek seferde en fazla 32.768 token olabilir. Yalnizca metin kabul eder; gorsel, ses ve sema zorlamali JSON ciktisi desteklemez. Dusunme acikken model bazi istemlerde uzun uzun dusunup butceyi tuketebilir; kisa ve kesin cevap gerektiginde `none` seviyesi hem hizli hem ucuzdur. ## Ling 3.0 Flash Fin (inclusionai/ling-3.0-flash-fin) URL: /models/inclusionai/ling-3.0-flash-fin Provider: InclusionAI Context window: 262144 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0 USD Summary: Ling 3.0 Flash'in finans icin egitilmis surumu: 124B MoE (token basina ~5.1B aktif), arac cagrisi, prompt cache ve 256K baglam. Ucretsiz, gunluk kotali. Description: Ling 3.0 Flash Fin, InclusionAI'nin Ling 3.0 Flash modelinin finans alanina gore egitilmis surumudur; 124 milyar parametrenin token basina yaklasik 5,1 milyari calisir. Cok adimli yatirim arastirmasi, uzun soluklu planlama ve yurutme senaryolari icin ayarlanmistir ve bunu yaparken akil yurutme, kodlama ve matematik yeteneklerini korur. Varsayilan olarak dusunur; dusunce zinciri yanitta `reasoning_content` alaninda ayri doner ve tokenlari `completion_tokens` icinde sayilir. Dusunmeyi kapatmak icin `reasoning_effort` alanini `none` gonderin ya da model kimligine `:none` sonekini ekleyin - bu modelde etkisi olculmus tek seviye budur, diger seviyeler kabul edilse de dusunme uzunlugunu duzenli sekilde degistirmez ve bu yuzden sunulmaz. Arac cagrisini yerel olarak destekler ve tekrarlanan onekleri prompt cache'ten okur; ancak dusunme kapaliyken model `tool_choice` alanindaki `required` ve isimli fonksiyon secimlerini yerine getirmez, bu yuzden o birlesim 400 ile reddedilir - araci zorunlu kilmaniz gerekiyorsa dusunmeyi acik birakin, dusunme kapali calismaniz gerekiyorsa `auto` kullanin. Cikti tek seferde en fazla 32.768 token olabilir. Yalnizca metin kabul eder; gorsel, ses ve sema zorlamali JSON ciktisi desteklemez. ## Voyage 4 Lite (voyageai/voyage-4-lite) URL: /models/voyageai/voyage-4-lite Provider: Voyage AI Context window: 32000 Operations: EMBEDDINGS Modalities: text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.02 USD Summary: Yüksek hacimli indeksleme için en ekonomik Voyage embedding modeli. Description: Voyage 4 Lite, milyonlarca parçayı indekslemeniz gereken ve birim maliyetin toplamı belirlediği işler için tasarlanmıştır. 32.000 tokenlık bağlam penceresini ve 256'dan 2048'e kadar esnek çıktı boyutunu korur, Voyage 4 Large'ın altıda bir fiyatına çalışır. Log arama, ürün kataloğu eşleştirme ve büyük ölçekli doküman indeksleme gibi hacim ağırlıklı yüklerde uygundur. ## Voyage Finance 2 (voyageai/voyage-finance-2) URL: /models/voyageai/voyage-finance-2 Provider: Voyage AI Context window: 32000 Operations: EMBEDDINGS Modalities: text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.12 USD Summary: Finans metinleri için alan özelinde eğitilmiş embedding modeli. Description: Voyage Finance 2, finansal raporlar, bilanço dipnotları, yatırımcı sunumları ve analist notları üzerinde retrieval için eğitilmiştir. Sektöre özgü terminoloji ve sayısal bağlam içeren pasajları genel amaçlı modellerden daha isabetli eşleştirir. Çıktı boyutu 1024'te sabittir ve niceleme seçeneği sunmaz; 32.000 tokenlık pencere uzun raporları tek parça halinde işler. ## Voyage Law 2 (voyageai/voyage-law-2) URL: /models/voyageai/voyage-law-2 Provider: Voyage AI Context window: 16000 Operations: EMBEDDINGS Modalities: text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0.12 USD Summary: Hukuki metinler için alan özelinde eğitilmiş embedding modeli. Description: Voyage Law 2, mevzuat, sözleşme ve içtihat metinleri üzerinde retrieval için eğitilmiştir. Madde atıfları, tanımlı terimler ve şartlı hükümler içeren pasajları genel amaçlı modellerden daha isabetli eşleştirir. Bağlam penceresi 16.000 token, çıktı boyutu 1024'te sabittir; uzun sözleşmelerin parçalara bölünerek indekslenmesi gerekir. ## Voyage Rerank 2.5 Lite (voyageai/rerank-2.5-lite) URL: /models/voyageai/rerank-2.5-lite Provider: Voyage AI Context window: 32768 Operations: RERANK Modalities: text Pricing: RERANK/INPUT_TEXT/PER_1M_TOKENS: 0.02 USD Summary: Yüksek hacimli yeniden sıralama için ekonomik reranker. Description: Voyage Rerank 2.5 Lite, Rerank 2.5 ile aynı arayüzü ve aynı 32.768 tokenlık pencereyi sunar, milyon token başına iki buçuk kat daha ucuza çalışır. Her sorgunun rerank edildiği ve hacmin maliyeti belirlediği üretim yüklerinde uygundur. Tek istekte en fazla 1000 doküman değerlendirilir. ## Solar Pro 3 (upstage/solar-pro3) URL: /models/upstage/solar-pro3 Provider: Upstage Context window: 131072 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.15 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.015 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.6 USD Summary: 131K baglamli buyuk olcekli Solar modeli; bes kademeli ayarlanabilir dusunme, arac cagrisi ve yapilandirilmis cikti. Description: Solar Pro 3, Upstage'in guclu muhakeme ve talimat takibi icin optimize edilmis buyuk olcekli modelidir. 131.072 tokenlik baglam penceresiyle uzun belgeleri ve cok adimli arac dongulerini tek oturumda tasir; cikti icin ayri bir tavan yoktur, uretilen tokenlar da ayni baglam penceresinden harcanir. Dusunme varsayilan olarak kapalidir. `reasoning_effort` ile none, minimal, low, medium ve high kademelerini kullanirsiniz; model `medium` kademesinden itibaren dusunmeye baslar, none/minimal/low kademelerinde kabul edilir ama hic dusunme tokeni uretmez. Bu, Solar Pro 4'ten farklidir: orada esik `low`'dur. Dusunme aciklken dusunce izi yanitin `reasoning` alaninda ayrica doner ve streaming sirasinda parca parca gonderilir. Arac/fonksiyon cagrisinda `tool_choice` degerlerinin tamami calisir; JSON nesne ciktisi ve semaya uyan yapilandirilmis cikti uretir. Tekrarlanan istem oneklerinde prompt cache indirimi devreye girer. Yalnizca metin kabul eder; gorsel ve ses girdisi desteklenmez. Resmi dil destegi Ingilizce, Korece ve Japoncadir. `xhigh` ve `max` kademeleri bu modelde yoktur; gonderirseniz desteklenen kademeleri listeleyen bir hata alirsiniz. Dusunme tokenlari cikti sayilir ve `max_tokens` butcesinden harcanir; dusunme aciklken bu degeri bol tutun. ## Solar Pro 2 (upstage/solar-pro2) URL: /models/upstage/solar-pro2 Provider: Upstage Context window: 65536 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.15 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.015 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.6 USD Summary: 64K baglamli kurumsal Solar modeli; dort kademeli dusunme, arac cagrisi ve yapilandirilmis cikti. Dusunce izi dondurulmez. Description: Solar Pro 2, Upstage'in karmasik muhakeme ve uretim isleri icin konumlandirdigi kurumsal modelidir. 65.536 tokenlik baglam penceresi vardir ve uretilen tokenlar da ayni pencereden harcanir. Dusunme varsayilan olarak kapalidir. `reasoning_effort` ile minimal, low, medium ve high kademelerini kullanirsiniz; model `medium` kademesinden itibaren dusunmeye baslar. Bu modelde `none` kademesi yoktur, gonderirseniz desteklenen kademeleri listeleyen bir hata alirsiniz. Onemli bir fark: Solar Pro 4 ve Pro 3 dusunce izini yanitin `reasoning` alaninda dondururken, Solar Pro 2 izi dondurmez. Dusunme tokenlari yine de uretilir, `usage.completion_tokens_details.reasoning_tokens` alaninda sayilir ve cikti olarak ucretlendirilir; yani maliyeti gorursunuz ama icerigini goremezsiniz. Arac/fonksiyon cagrisinda `tool_choice` degerlerinin tamami calisir; JSON nesne ciktisi ve semaya uyan yapilandirilmis cikti uretir. Tekrarlanan istem oneklerinde prompt cache indirimi devreye girer. Yalnizca metin kabul eder; gorsel ve ses girdisi desteklenmez. Resmi dil destegi Ingilizce, Korece ve Japoncadir. Dusunme tokenlari cikti sayilir ve `max_tokens` butcesinden harcanir; dusunme aciklken bu degeri bol tutun. ## Dots3-Note Preview (dots-studio/dots-3-note-preview) URL: /models/dots-studio/dots-3-note-preview Provider: Dots Studio Context window: 512000 Operations: CHAT_COMPLETIONS Modalities: text, image Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0 USD Summary: 30 Eylül 2026'da kapanıyor; yeni işler için katalogdan aktif bir model seçin. Description: Bu model kullanımdan kaldırılıyor: Dots3-Note Preview 30 Eylül 2026'da kapanıyor. Model o tarihe kadar normal çalışır; sonrasında bu kimliğe gelen istekler 410 model_retired döner. Otomatik yönlendirme yapılmaz — isteğiniz sessizce başka bir modele gitmez. Halef adı da verilmiyor: katalogda ücretsiz olup aynı anda 512K bağlam ve görsel girdi sunan başka bir satır yok, bu yüzden akışınıza uygun aktif modeli katalogdan kendiniz seçin. Dots3-Note Preview; Dots Studio'nun açık ağırlıklı mixture-of-experts modelidir (280B toplam, 16B aktif parametre), yanıt vermeden önce her zaman adım adım düşünür (reasoning varsayılan olarak açıktır), metinle birlikte görsel girdi kabul eder, function calling ve JSON formatında çıktı destekler. Kapanana kadar günlük kullanım kotasıyla ücretsiz sunulur; kota dolduğunda istekler ertesi güne kadar sınırlandırılır. ## Mercury 2 (Ücretsiz) (inception/mercury-2-free) URL: /models/inception/mercury-2-free Provider: Inception Labs Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0 USD Summary: Düşük gecikmeli sohbet ve araç çağrısı için difüzyon tabanlı model; sponsorlu havuzdan ücretsiz, 128K bağlam. Description: Mercury 2, Inception Labs'in difüzyon tabanlı dil modelidir (dLLM). Token'ları tek tek sırayla üretmek yerine birden fazla token'ı paralel üretip adım adım netleştirir; pratikte bu, aynı sınıftaki modellere göre belirgin biçimde düşük gecikme demektir. Bu satır, Inception'ın verdiği sponsorlu token havuzundan ücretsiz sunulur ve kullanıcı başına bir token hakkıyla sınırlıdır. 128.000 token bağlam penceresi vardır, tek yanıt en fazla 50.000 token olabilir. Araç/fonksiyon çağrısını (sıralı; paralel çağrı henüz yok) ve şema zorlamalı JSON çıktısını destekler. Yalnızca metin kabul eder; görsel ve ses girdisi yoktur. Model varsayılan olarak akıl yürütür ve bu akıl yürütme token'ları çıktı sayılır — kısa sorularda bile hak tüketebilir, bu yüzden hız veya tasarruf gerektiğinde `:minimal` sonekiyle en hafif seviyeye alın. Seviyeler `:minimal`, `:low`, `:medium` ve `:high`'dır; varsayılan `medium`'dur. Ücretsiz hak dolduğunda veya sponsorlu dönem bittiğinde istekler açık bir hata ile karşılanır ve sizi ücretli `inception/mercury-2` satırına yönlendirir. ## Mercury 2 (inception/mercury-2) URL: /models/inception/mercury-2 Provider: Inception Labs Context window: 128000 Operations: CHAT_COMPLETIONS Modalities: text Pricing: CHAT_COMPLETIONS/INPUT_TEXT/PER_1M_TOKENS: 0.25 USD; CHAT_COMPLETIONS/CACHE_READ/PER_1M_TOKENS: 0.025 USD; CHAT_COMPLETIONS/OUTPUT_TEXT/PER_1M_TOKENS: 0.75 USD Summary: Düşük gecikmeli sohbet, araç çağrısı ve yapısal çıktı için difüzyon tabanlı model; 128K bağlam, prompt cache. Description: Mercury 2, Inception Labs'in difüzyon tabanlı dil modelidir (dLLM). Token'ları tek tek sırayla üretmek yerine birden fazla token'ı paralel üretip adım adım netleştirir; bu yaklaşım aynı sınıftaki modellere göre belirgin biçimde düşük gecikme sağlar ve modeli gerçek zamanlı sohbet, sesli akış ve yüksek hacimli otomasyon gibi hız duyarlı işler için uygun kılar. 128.000 token bağlam penceresi sunar ve tek yanıt en fazla 50.000 token olabilir. Araç/fonksiyon çağrısını destekler (sıralı; paralel çağrı henüz yoktur) ve `response_format` ile şema zorlamalı JSON çıktısı üretir. Tekrarlanan istem ön eklerinde prompt cache okuması yapılır ve cache'ten okunan giriş token'ları normal giriş fiyatının onda birine faturalanır. Yalnızca metin kabul eder; görsel ve ses girdisi yoktur. Model varsayılan olarak akıl yürütür ve akıl yürütme token'ları çıktı olarak faturalanır; dört seviye `:minimal`, `:low`, `:medium` ve `:high` sonekleriyle seçilir, varsayılan `medium`'dur. Gecikmenin en düşük olması gereken işlerde `:minimal` seviyesini kullanın. ## LFM2.5-Embedding-350M (free) (liquid/lfm-2.5-embedding-350m-free) URL: /models/liquid/lfm-2.5-embedding-350m-free Provider: Liquid AI Context window: 512 Operations: EMBEDDINGS Modalities: text, embedding Pricing: EMBEDDINGS/INPUT_TEXT/PER_1M_TOKENS: 0 USD Summary: Semantik arama ve retrieval için 1024 boyutlu vektörler üreten ücretsiz Liquid AI embedding modeli. Description: LFM2.5-Embedding-350M, Liquid AI'nin retrieval ve semantik arama için ücretsiz metin embedding modelidir. Metni sabit 1024 boyutlu vektörlere dönüştürür, metin başına en fazla 512 token kabul eder ve yalnızca embedding çıktısı verir. Sohbet üretimi, görsel girdi, araç çağrısı, reranking veya ayarlanabilir çıktı boyutu desteklemez.