GLM-5.3-Flash
zai/glm-5.3-flash, görselleri kod ve metinle birlikte işleyebilen, araç çağrısı destekli Z.AI modelidir. Modelin 1.000.000 token bağlam penceresi ve tek yanıtta 131.072 token çıktı tavanı vardır.
| Model | Bağlam | Çıktı tavanı | Girdiler |
|---|---|---|---|
zai/glm-5.3-flash | 1.000.000 | 131.072 | Metin, görsel |
Ses, video ve belge girdisi ilan edilmez. PDF veya ofis belgesini doğrudan göndermek yerine gereken sayfaları görsele dönüştürün.
Fiyatlar
Section titled “Fiyatlar”Fiyatlar 1 milyon token başınadır. İki indirim üst üste uygulanmaz.
| Dönem | Giriş | Cache read | Çıkış |
|---|---|---|---|
| 9 Eylül 2026 19:00 Türkiye saatine kadar Z.AI kampanyası | $0,075 | $0,015 | $0,250 |
| 9 Eylül 2026 19:00 Türkiye saatinden sonra LLMTR anlaşması | $0,135 | $0,027 | $0,450 |
| Z.AI indirimsiz API liste fiyatı | $0,150 | $0,030 | $0,500 |
Kampanya kesimi tam olarak 2026-09-09T16:00:00.000Z anıdır. Kesimden sonra LLMTR'nin Z.AI liste fiyatına göre yüzde 10 indirimli anlaşma fiyatı otomatik devreye girer.
Metin çağrısı
Section titled “Metin çağrısı”curl "$LLMTR_BASE_URL/v1/chat/completions" \ -H "Authorization: Bearer llmtr-your_key" \ -H "Content-Type: application/json" \ -d '{ "model": "zai/glm-5.3-flash", "messages": [ { "role": "user", "content": "Bu TypeScript fonksiyonunu üç maddede iyileştir." } ], "max_tokens": 256 }'Akıl yürütme
Section titled “Akıl yürütme”Akıl yürütme bu modelde her zaman açıktır ve kapatılamaz. Düz zai/glm-5.3-flash çağrıları low seviyesinde çalışır. Daha zor görevlerde model suffix'i veya reasoning_effort alanı ile yalnızca low, high ve max seviyeleri seçilebilir:
{ "model": "zai/glm-5.3-flash", "reasoning_effort": "high", "messages": [{ "role": "user", "content": "Bu hata izini kök nedene kadar çözümle." }], "max_tokens": 512}:fast, reasoning: false ve thinking: { "type": "disabled" } kabul edilmez. Ortak davranışın ayrıntıları için Z.AI Thinking Kontrolü sayfasına bakın.
Görsel girdi
Section titled “Görsel girdi”OpenAI uyumlu içerik dizisinde image_url gönderin:
{ "model": "zai/glm-5.3-flash", "messages": [{ "role": "user", "content": [ { "type": "text", "text": "Bu arayüzdeki erişilebilirlik sorunlarını sıralayın." }, { "type": "image_url", "image_url": { "url": "https://example.com/screenshot.png" } } ] }], "max_tokens": 256}Araç çağrısı ve cache
Section titled “Araç çağrısı ve cache”Model tools ve tool_choice alanlarıyla function calling destekler. Tek bir aracın seçilmesi gerekiyorsa yalnızca o aracı gönderip tool_choice: "required" kullanabilirsiniz. Araç şemaları ve sonuç mesajları için Araç Çağrısı sayfasına bakın.
Z.AI'nin cache'e isabet eden giriş tokenleri ayrı CACHE_READ tarifesiyle fiyatlanır. Kullanım yanıtındaki cache metriği geldiğinde LLMTR bu tokenleri yukarıdaki düşük cache read fiyatıyla faturalar; kalan giriş tokenleri normal giriş tarifesinde kalır.
Model ve fiyat sınırlarının kaynakları: Z.AI model kılavuzu, çekirdek parametreler ve fiyatlandırma.