İçeriğe geç

Google Gemini

Gemini modelleri /v1/chat/completions uzerinden cagrilir; ayni modeller ikincil olarak /v1/responses uzerinden de kullanilabilir. Hepsi metin, gorsel, video, ses ve PDF girdisi kabul eder, metin uretir.

ModelBaglamMaksimum ciktiThinking seviyeleri
google/gemini-3.7-flash1.048.57665.536low, medium, high
google/gemini-3.6-flash1.048.57665.536minimal, low, medium, high
google/gemini-3.5-flash1.048.57665.536minimal, low, medium, high
google/gemini-3.5-flash-lite1.048.57665.536minimal, low, medium, high
Terminal window
curl "$LLMTR_BASE_URL/v1/chat/completions" \
-H "Authorization: Bearer llmtr-your_key" \
-H "Content-Type: application/json" \
-d '{
"model": "google/gemini-3.7-flash",
"messages": [
{ "role": "user", "content": "Bu fonksiyondaki hatayi bul." }
],
"max_tokens": 2048
}'

Seviye iki yoldan verilir; ikisi birlikte gonderilirse body alani onceliklidir.

  1. Model slug suffix: google/gemini-3.7-flash:low
  2. Body alani: { "reasoning": { "effort": "low" } }
Terminal window
curl "$LLMTR_BASE_URL/v1/chat/completions" \
-H "Authorization: Bearer llmtr-your_key" \
-H "Content-Type: application/json" \
-d '{
"model": "google/gemini-3.7-flash",
"reasoning": { "effort": "high" },
"messages": [
{ "role": "user", "content": "Bu algoritmanin karmasikligini analiz et." }
]
}'

Gemini 3.7 Flash minimal seviyesini desteklemez

Section titled “Gemini 3.7 Flash minimal seviyesini desteklemez”

Ailenin geri kalanindan tek yapisal farki budur. Gemini 3.7 Flash yalnizca low, medium ve high kabul eder; varsayilan seviye medium'dur. minimal gonderilirse gateway istegi yukari akisa hic tasimadan reddeder:

{
"error": {
"type": "invalid_request",
"message": "Model gemini-3.7-flash does not support reasoning effort \"minimal\". Supported: low, medium, high"
}
}

xhigh ve max hicbir Gemini modelinde yoktur; Gemini thinkingLevel alanini kullanir ve bu iki degeri tanimaz.

Genel suffix kurallari icin Reasoning Effort sayfasina bakin.

Asagidaki rakamlar Google'in kendi liste fiyatlaridir, 1M token basina USD. Model fiyatlarina LLMTR marji eklenmez; platform marji yalnizca kredi yuklemesinde uygulanir.

Google bu model icin sureli bir tanitim tarifesi yayinladi. Tarife 31 Aralik 2026 sonunda biter ve 1 Ocak 2027'de standart fiyata gecer:

Kalem31.12.2026'ya kadar01.01.2027'den itibaren
Girdi (metin, gorsel, video, ses)$0.75$1.50
Cikti (thinking tokenlari dahil)$3.75$7.50
Context cache okuma$0.075$0.15
Cache depolama (1M token-saat)$0.50$1.00

Gecis otomatiktir. Katalog her iki tarifeyi de kayitli tutar ve o an gecerli olani uygular; fiyat sayfasinda ve faturalamada 1 Ocak 2027'de kendiliginden degisir.

ModelGirdiCiktiCache okuma
google/gemini-3.6-flash$1.50$7.50$0.15
google/gemini-3.5-flash$1.50$9.00$0.15
google/gemini-3.5-flash-lite$0.30$2.50yayinlanmadi

Google Search ve Google Maps grounding, her modelde 1.000 sorgu basina $14 olarak faturalanir.

Flash-Lite icin Google dogrulanmis bir context cache fiyati yayinlamadi. Tahmini bir indirim yanlis faturalama uretecegi icin bu satirda cache kurali yoktur: cache'ten okunan tokenlar standart girdi fiyatindan faturalanir.

Yukari akis bir istegin bir bolumunu cache'ten karsiladiginda bunu cachedContentTokenCount alaniyla bildirir. Bu tokenlar toplam girdi sayisinin icindedir, ustune eklenmez. Gateway bu miktari girdi kaleminden duser ve cache okuma tarifesinden ayri bir satir olarak faturalar; kullanim yanitinda da ayni bolunme gorunur:

{
"usage": {
"prompt_tokens": 12809,
"prompt_tokens_details": { "cached_tokens": 12801 },
"completion_tokens": 16,
"total_tokens": 12825
}
}

cached_tokens alani yalnizca Google gercekten cache isabeti bildirdiginde dolar. Bildirmediginde tum girdi standart girdi fiyatindan faturalanir.

Dort model de paralel fonksiyon cagrisini ve JSON schema ile yapilandirilmis ciktiyi destekler. Kullanim OpenAI formatiyla aynidir; ayrintilar Tool Calling sayfasindadir.

Gorsel, video, ses ve PDF girdisi standart OpenAI icerik parcalariyla gonderilir. Ornekler icin Gorseller, Ses ve Dosyalar sayfalarina bakin.