Fiyat ve bütçe · 2026-10-06

API Model Fiyatları: 1M Token Giriş, Çıktı ve Maliyet

API model pricing input output per million tokens: /v1/models fiyatlarını okuma, token maliyetini hesaplama ve LLMTR kataloğundaki örnekleri karşılaştırma.

Basit bir model fiyat şeması: solda API isteğindeki girdi ve çıktı tokenları, ortada 1 milyon tokena bölme ve fiyatla çarpma, sağda toplam API maliyeti gösterilir.

Kısa yanıt: 1M token fiyatları

LLMTR (llmtr.com), Türkiye'de ve global sağlayıcılarda barındırılan dil modellerine tek, OpenAI uyumlu API'den erişim veren bir gateway'dir. Tüm katalog API adresi https://llmtr.com/v1 olup model listesi için /v1/models ve tek model için sağlayıcıyla model slug yolunu kullanabilirsiniz. Örneğin, google/gemini-3.1-pro-preview için 1M girdi tokenı 2,00 $, çıktı tokenı 12,00 $, cache okuma fiyatı yayımlanmaz.

Fiyatları karşılaştırırken aynı 1 milyon token birimini kullanın. google/gemini-3.7-flash için girdi 0,75 $, çıktı 3,75 $ ve cache okuma 0,075 $ tutar. google/gemini-3.1-pro-preview ise girdide 2,00 $, çıktıda 12,00 $ ister; cache okuma alanı yayımlanmadığı için ücretsiz sayılmaz ve katalogda ayrıca fiyat verilmez.

LLMTR katalog fiyatları, 1M token başına USD (2026-10-06 kontrol edildi)
Model kimliğiGirdiÇıktıÖnbellek okuma
google/gemini-3.1-pro-preview$2.00$12.00—
google/gemini-3.7-flash$0.75$3.75$0.075
google/gemini-3.5-flash-lite$0.30$2.50—
meta/muse-spark-1.2$1.25$4.25$0.15
meta/muse-spark-1.2-contributor$0.10$0.20$0.002
voyageai/voyage-4 (gömme)$0.06——

API model fiyatlandırması: girdi ve çıktı 1 milyon token başına nasıl okunur?

Fiyat etiketleri 1 milyon token içindir: input veya prompt fiyatı, üretilen completion veya output token'ları içindir. google/gemini-3.1-pro-preview için 2,00 $ girdi ve 12,00 $ çıktı fiyatı, 1M tokenlık toplamları değil ayrı ayrı birim fiyatları gösterir. Cache read ise ayrı bir fiyat alanıdır.

Tablodaki satırları aynı para biriminde karşılaştırın. voyageai/voyage-4 yalnızca 1M girdi tokenı için 0,06 $ belirtir; çıktı veya cache okuma fiyatı yayımlanmaz. meta/muse-spark-1.2-contributor için ise girdi, çıktı ve cache okuma sırasıyla 0,10 $, 0,20 $ ve 0,002 $ düzeyindedir. Bu satırlar, aynı 1M token ölçeğinde karşılaştırılır.

GET /v1/models ile fiyatları programatik okuma

GET https://llmtr.com/v1/models isteği API anahtarı olmadan çalışır ve tüm genel kataloğu döndürür. Tek model için GET https://llmtr.com/v1/models/<provider>/<slug> kullanılır. Yanıttaki pricing değerleri USD ve tek token için string olarak gelir; bu nedenle doğrudan 1 milyon token fiyatı değildir. Önce birim doğrulayın.

Her pricing değerini float'a çevirip 1.000.000 ile çarpın. Örneğin google/gemini-3.1-pro-preview için prompt değeri "0.000002", completion değeri "0.000012" gelir. Çarpım sırasıyla 1M girdi için 2,00 $, 1M çıktı için 12,00 $ verir; alan adları API yanıtındaki biçimde korunmalıdır. Aşağıdaki Python örneği bu çevrimi uygular ve alanları model["pricing"] içinden okur.

Python örneği, tek bir modelin token başına string fiyatlarını 1 milyon token fiyatına dönüştürür.

import requests

# /v1/models needs no API key. Prices come back in USD per single token.
model = requests.get(
    "https://llmtr.com/v1/models/google/gemini-3.7-flash", timeout=30
).json()

per_million = {
    field: round(float(value) * 1_000_000, 6)
    for field, value in model["pricing"].items()
}
print(model["id"], per_million)
# google/gemini-3.7-flash {'prompt': 0.75, 'completion': 3.75, 'input_cache_read': 0.075}

İş yükü maliyeti: token sayısı ve fiyatı

Maliyet hesabı iki ayrı bölümü toplar: cost = input_tokens / 1.000.000 x input_price + output_tokens / 1.000.000 x output_price. 1.000 istek, istek başına 2.000 girdi ve 500 çıktı tokenıyla toplam 2M girdi ve 0,5M çıktı demektir. Aşağıdaki tablo bu iş yükünün toplam maliyetini karşılaştırır.

google/gemini-3.7-flash örneğinde 2M girdi tokenı 1,50 $, 0,5M çıktı tokenı ise 1,875 $ tutar; toplam 3,375 $ olur. Aynı iş yükü meta/muse-spark-1.2'de 4,625 $, google/gemini-3.1-pro-preview modelinde 10,00 $ tutar. Model değişince iki maliyet bileşeni de yeniden hesaplanır ve toplam tutar değişir.

2.000 girdi ve 500 çıktı tokenına sahip 1.000 isteğin maliyeti
Model kimliğiGirdi maliyetiÇıktı maliyetiToplam
google/gemini-3.7-flash2M x $0.75 = $1.500.5M x $3.75 = $1.875$3.375
meta/muse-spark-1.22M x $1.25 = $2.500.5M x $4.25 = $2.125$4.625
google/gemini-3.1-pro-preview2M x $2.00 = $4.000.5M x $12.00 = $6.00$10.00

Fiyat alanlarında dikkat edilmesi gerekenler

Google, Gemini 3.1 Pro Preview için 200K prompt tokenına kadar olan temel kademede 1M başına 2,00 $ girdi ve 12,00 $ çıktı uygular. 200K üzerindeki promptlarda fiyatlar 4,00 $ girdi ve 18,00 $ çıktı olur. /v1/models yalnızca bu temel kademeyi yayımlar.

Akıl yürütme modellerinde thinking tokenları completion_tokens içindedir ve çıktı fiyatıyla faturalanır. Google'ın ifadesi, thinking tokenlarının çıktı fiyatına dahil olduğunu belirtir; Muse Spark'ta reasoning tokenları da completion_tokens içindedir. Ayrı çıktı fiyatı eklemeyin, çünkü bu tokenlar zaten output maliyetine dahildir. Böylece toplam maliyet doğru hesaplanır.

Bir pricing alanının yanıtta olmaması, fiyatın 0 olduğu anlamına gelmez; o model için o birimde fiyat yayımlanmamıştır. google/gemini-3.1-pro-preview'de input_cache_read yoktur. xai/grok-imagine-image-quality gibi görsel modeller token yerine görsel başına faturalanır; görsel başına fiyat token alanlarında değil, model sayfasında bulunur.

Model fiyatlarına platform marjı eklenmez. Kredi yüklemesinde istenen tutarın üzerine bir kez yüzde 8 platform marjı uygulanır. EUR gibi USD dışı bir para biriminde yayımlanan sağlayıcı fiyatları, Avrupa Merkez Bankası kuru ve yüzde 8 döviz kuru ek payı kullanılarak USD'ye dönüştürülür.

LLMTR ile başlamak: hesap, kredi, anahtar ve ilk istek

İlk adım llmtr.com üzerinde hesap açmak ve e-posta adresini doğrulamaktır. Ardından Dashboard üzerinden güvenli ödeme ekranından kredi yüklemesi yapılır. İstenen 10,00 $ kredi için toplam 10,80 $ tahsil edilir; yüzde 8 platform marjı yalnızca bu yüklemede bir kez eklenir. Model fiyatlarına marj eklenmez.

API anahtarını Dashboard > API Keys bölümünde oluşturun. Ham anahtar yalnızca bir kez gösterilir; LLMTR_API_KEY ortam değişkeninde saklayın. İlk isteği https://llmtr.com/v1 adresine, OpenAI uyumlu bir SDK ile yalnızca base_url ve api_key değerlerini değiştirerek gönderin. Dashboard kullanım sayfası her istek ve anahtar bazında gerçek token ile harcama gösterir. Aynı anahtar ve kredi bakiyesi katalogdaki her modelde çalışır; model değiştirmek yalnızca model string'ini değiştirmektir.

LLMTR API kurulumu

llmtr.com hesabı oluşturmak, kredi yüklemek, API anahtarı üretmek ve ilk OpenAI uyumlu isteği https://llmtr.com/v1 adresine göndermek için dört adım.

  1. Hesap oluştur. llmtr.com üzerinde hesap oluşturun ve e-posta adresinizi doğrulayın.
  2. Kredi yükle. Dashboard üzerinden güvenli ödeme ekranına giderek kredi yükleyin. İstenen 10,00 $ kredi için 10,80 $ tahsil edilir; yüzde 8 platform marjı bir kez uygulanır.
  3. API anahtarı oluştur. Dashboard > API Keys bölümünde bir anahtar oluşturun. Anahtar yalnızca bir kez gösterildiği için LLMTR_API_KEY ortam değişkeninde saklayın.
  4. İlk isteği gönder. OpenAI uyumlu bir SDK kullanarak base_url değerini https://llmtr.com/v1, api_key değerini oluşturduğunuz anahtar yapın ve seçtiğiniz modelle isteği gönderin.

Sık sorulan sorular

API model fiyatını 1 milyon token için nasıl hesaplarım?

pricing içindeki her değeri 1.000.000 ile çarpın. "0.000002" değeri 1M girdi tokenı için 2,00 $ eder; "0.000012" değeri 1M çıktı tokenı için 12,00 $ eder.

Thinking ve reasoning tokenları çıktı olarak mı faturalanır?

Evet. Thinking ve reasoning tokenları completion_tokens içindedir ve çıktı fiyatıyla faturalanır.

Model fiyatlarının üzerinde marj var mı?

Model fiyatlarına marj eklenmez; kredi yüklemesinde bir kez yüzde 8 platform marjı uygulanır. USD dışı fiyatlar, Avrupa Merkez Bankası kuru ve yüzde 8 döviz kuru ek payıyla USD'ye çevrilir.

İlgili yazılar