Fiyat ve benchmark · 2026-09-19
EVREN kota ve kredi sistemi: ücretsiz ama sayaçlı
EVREN LLM API 1 Kasım'a kadar ücretsiz; ama hesabınızda kayan pencereli bir token tavanı, bir kredi bakiyesi ve istek başına ücret durumu var. /v1/quota alanlarını, art arda isteklerdeki beklemeyi ve 1 Kasım sonrası için planlamayı anlatıyoruz.
Ücretsiz ne kadar ücretsiz?
SAYZEK'in duyurusuna göre EVREN LLM Çıkarım Servisi 1 Kasım'a kadar ücretsiz. Fatura yok, sayaç var: ücretsiz dönemde bile API şeması her hesap için bir token tavanı, bir kredi bakiyesi ve istek başına bir ücret durumu tutuyor.
1 Kasım'dan sonra ne olacağına dair herkese açık bir fiyat tablosu bulamadık. Bir iş akışını bu servise bağlamadan önce o tarihten sonrası için bir plan yapmak gerekiyor.
/v1/quota ne söylüyor?
Hesabınızın durumunu /v1/quota ucu döndürüyor. Tavan kayan bir pencerede işliyor: sabit bir saatte sıfırlanmıyor, en eski tüketim pencereden düştükçe yer açılıyor. level alanı yüzde 75'te uyarıya, yüzde 90'da kritik seviyeye geçiyor.
| Alan | Anlamı |
|---|---|
| used_tokens | Kayan pencerede tüketilen token |
| cap | Pencere için token tavanı |
| window_minutes | Pencerenin süresi (dakika) |
| reset_at | En eski tüketim diliminin pencereden düşeceği zaman |
| usage_ratio | used_tokens / cap, 0 ile 1 arası |
| level | ok; warn (yüzde 75 ve üstü); critical (yüzde 90 ve üstü); unknown |
| held_cr | Süren istekler için ayrılmış, henüz kesinleşmemiş kredi |
| remaining_cr | Kullanılabilir kredi bakiyesi |
Kredi nereden geliyor?
EVREN platformu kredi tabanlı bir model üzerine kurulu. Üniversite duyurularına göre kullanıcılar veri seti yükleyerek ya da veri etiketleyerek kredi kazanıyor ve bu krediyi yüksek kapasiteli GPU kaynaklarına erişmek için kullanıyor.
LLM servisinin kredisinin bu modelle nasıl ilişkilendiğini anlatan herkese açık bir metin bulamadık. Ama şema krediyi açıkça tutuyor: remaining_cr kullanılabilir bakiyeyi, held_cr süren isteklerin ayırdığı tutarı gösteriyor.
İstek başına ücret durumu
/v1/requests/{request_id} her istek için ücretin kesinleşip kesinleşmediğini (charge_terminal), faturalamanın beklemede olup olmadığını (is_billing_pending), tahsil edilen krediyi (collected_cr) ve bekleyen krediyi (outstanding_cr) döndürüyor.
Ücretsiz bir serviste istek başına 'bekleyen kredi' alanı görmek ilk bakışta tuhaf geliyor. Aslında söylediği şey basit: faturalama altyapısı hazır, fiyat şimdilik sıfır.
Art arda istekler ve bekleme
Topluluk tarafından yazılmış bir OpenCode entegrasyonu, EVREN'in art arda gelen isteklerde yaklaşık 5 saniyelik bir bekleme uyguladığını ve bu durumda 429 döndüğünü not ediyor. Aynı kaynak paralel alt görevler yerine sıralı çalışmayı ve ana model yükünü azaltmak için küçük bir yardımcı model kullanmayı öneriyor.
Bu sayı EVREN'in yayımladığı bir limit değil, bir topluluk entegrasyonunun gözlemi. Kodlama ajanları gibi aynı anda birden çok istek başlatan araçlarda 429 yanıtlarını beklemek ve ele almak gerekiyor. Aşağıdaki örnek, istekten önce kotayı kontrol ediyor ve 429'da giderek artan sürelerle bekliyor.
Kota kontrolü ve 429'da geri çekilme
import os, time, requests
BASE = "https://evren-llmapi.ssyz.org.tr/v1"
HEADERS = {"X-API-Key": os.environ["EVREN_API_KEY"]} # evren_llm_...
def kota_uygun_mu() -> bool:
q = requests.get(f"{BASE}/quota", headers=HEADERS, timeout=10).json()
# level: ok / warn (>= %75) / critical (>= %90) / unknown
return q.get("level") in ("ok", "unknown")
def sohbet(mesaj: str, deneme: int = 5) -> dict:
bekleme = 5.0
for _ in range(deneme):
r = requests.post(
f"{BASE}/chat/completions",
headers=HEADERS,
json={"model": "glm-5.3", "messages": [{"role": "user", "content": mesaj}]},
timeout=120,
)
if r.status_code != 429:
r.raise_for_status()
return r.json()
time.sleep(bekleme) # art arda isteklerde bekleme; her denemede ikiye katla
bekleme *= 2
raise RuntimeError("Kota veya bekleme suresi asilamadi")
if kota_uygun_mu():
print(sohbet("Merhaba")["choices"][0]["message"]["content"])
auto kipinde tüketim
Model alanına auto yazdığınızda isteği hangi modelin karşılayacağını EVREN seçiyor. Dokümandaki örnekte auto isteğinin yanıtı zai/glm-5.3-fp8 modelinden geliyor.
Kota token üzerinden sayıldığı için aynı istemin farklı modellere gitmesi farklı token tüketimi ve farklı yanıt davranışı demek. Tekrarlanabilir sonuç ve öngörülebilir kota tüketimi istiyorsanız modeli açıkça seçin.
Üretimde planlama
Ücretsiz bir API'yi üretime almanın en pahalı anı, ücretsiz dönemin bittiği gündür. Birkaç önlem o günü sakin geçirmeyi sağlar.
- 429 yanıtlarında giderek artan sürelerle yeniden deneyin; aynı anda çok sayıda istek başlatmayın.
- Toplu işlerden önce /v1/quota ile kalan kapasiteyi kontrol edin; level warn olduğunda yükü azaltın.
- Model adlarını koddan ayrı bir yapılandırmada tutun; servis değiştirmek tek satırlık iş olsun.
- Aynı OpenAI SDK'sıyla çalışan ikinci bir sağlayıcıyı şimdiden deneyin.
- Kritik bir iş akışını yalnızca ücretsiz döneme bağlamayın.
Sık sorulan sorular
EVREN ne zamana kadar ücretsiz?
SAYZEK'in duyurusuna göre EVREN LLM Çıkarım Servisi 1 Kasım'a kadar ücretsiz.
1 Kasım'dan sonra EVREN ücretli mi olacak?
Buna dair herkese açık bir fiyat tablosu bulamadık. API şemasında kredi bakiyesi ve istek başına ücret alanları bulunuyor; yani faturalama altyapısı hazır.
EVREN kotamı nasıl görürüm?
GET /v1/quota ucu kayan penceredeki tüketimi, tavanı, pencere süresini, sıfırlanma zamanını, doluluk oranını ve kredi bakiyenizi döndürür.
EVREN'den 429 alıyorum, ne yapmalıyım?
İstekleri sıraya koyun ve giderek artan sürelerle yeniden deneyin. Kotanızı /v1/quota ile kontrol edin. Bir topluluk entegrasyonu art arda isteklerde yaklaşık 5 saniyelik bir bekleme gözlemlemiş; bu EVREN'in yayımladığı bir sayı değil.
EVREN kredisi nasıl kazanılır?
Üniversite duyurularına göre platformda veri seti yükleyerek ya da veri etiketleyerek kredi kazanılıyor. LLM servisinin kredisinin bu modelle ilişkisini anlatan herkese açık bir metin bulamadık.