İçeriğe geç

GLM-5.3-Flash

zai/glm-5.3-flash, görselleri kod ve metinle birlikte işleyebilen, araç çağrısı destekli Z.AI modelidir. Modelin 1.000.000 token bağlam penceresi ve tek yanıtta 131.072 token çıktı tavanı vardır.

ModelBağlamÇıktı tavanıGirdiler
zai/glm-5.3-flash1.000.000131.072Metin, görsel

Ses, video ve belge girdisi ilan edilmez. PDF veya ofis belgesini doğrudan göndermek yerine gereken sayfaları görsele dönüştürün.

Fiyatlar 1 milyon token başınadır. İki indirim üst üste uygulanmaz.

DönemGirişCache readÇıkış
9 Eylül 2026 19:00 Türkiye saatine kadar Z.AI kampanyası$0,075$0,015$0,250
9 Eylül 2026 19:00 Türkiye saatinden sonra LLMTR anlaşması$0,135$0,027$0,450
Z.AI indirimsiz API liste fiyatı$0,150$0,030$0,500

Kampanya kesimi tam olarak 2026-09-09T16:00:00.000Z anıdır. Kesimden sonra LLMTR'nin Z.AI liste fiyatına göre yüzde 10 indirimli anlaşma fiyatı otomatik devreye girer.

Terminal window
curl "$LLMTR_BASE_URL/v1/chat/completions" \
-H "Authorization: Bearer llmtr-your_key" \
-H "Content-Type: application/json" \
-d '{
"model": "zai/glm-5.3-flash",
"messages": [
{ "role": "user", "content": "Bu TypeScript fonksiyonunu üç maddede iyileştir." }
],
"max_tokens": 256
}'

Akıl yürütme bu modelde her zaman açıktır ve kapatılamaz. Düz zai/glm-5.3-flash çağrıları low seviyesinde çalışır. Daha zor görevlerde model suffix'i veya reasoning_effort alanı ile yalnızca low, high ve max seviyeleri seçilebilir:

{
"model": "zai/glm-5.3-flash",
"reasoning_effort": "high",
"messages": [{ "role": "user", "content": "Bu hata izini kök nedene kadar çözümle." }],
"max_tokens": 512
}

:fast, reasoning: false ve thinking: { "type": "disabled" } kabul edilmez. Ortak davranışın ayrıntıları için Z.AI Thinking Kontrolü sayfasına bakın.

OpenAI uyumlu içerik dizisinde image_url gönderin:

{
"model": "zai/glm-5.3-flash",
"messages": [{
"role": "user",
"content": [
{ "type": "text", "text": "Bu arayüzdeki erişilebilirlik sorunlarını sıralayın." },
{ "type": "image_url", "image_url": { "url": "https://example.com/screenshot.png" } }
]
}],
"max_tokens": 256
}

Model tools ve tool_choice alanlarıyla function calling destekler. Tek bir aracın seçilmesi gerekiyorsa yalnızca o aracı gönderip tool_choice: "required" kullanabilirsiniz. Araç şemaları ve sonuç mesajları için Araç Çağrısı sayfasına bakın.

Z.AI'nin cache'e isabet eden giriş tokenleri ayrı CACHE_READ tarifesiyle fiyatlanır. Kullanım yanıtındaki cache metriği geldiğinde LLMTR bu tokenleri yukarıdaki düşük cache read fiyatıyla faturalar; kalan giriş tokenleri normal giriş tarifesinde kalır.

Model ve fiyat sınırlarının kaynakları: Z.AI model kılavuzu, çekirdek parametreler ve fiyatlandırma.