GPT-6 Astra
openai/gpt-6-astra, OpenAI'nin uçtan uca zor işler için konumlandırdığı en yetenekli modelidir. Karmaşık akıl yürütme, ajan tabanlı kodlama, bilgisayar kullanımı, araştırma ve doküman üretimi için kullanılır.
| Model | Bağlam | Çıktı | Girdiler |
|---|---|---|---|
openai/gpt-6-astra | 1.050.000 | 128.000 | Metin, görsel, PDF |
openai/gpt-6-astra-free | 200.000 | 128.000 | Metin, görsel |
Ses girdisi desteklenmez; ses içeren bir istek sistem tarafından reddedilir.
Fiyatlar
Section titled “Fiyatlar”Fiyatlar 1 milyon token başınadır ve OpenAI'nin liste fiyatıdır. Model fiyatlarına marj eklenmez.
| Model | Giriş / Cache okuma / Çıkış ($/1M) |
|---|---|
openai/gpt-6-astra | 10,00 / 1,00 / 50,00 |
Cache yazma ayrı faturalanır
Section titled “Cache yazma ayrı faturalanır”Bu model, LLMTR kataloğunda prompt cache yazmayı ücretlendiren ilk OpenAI satırıdır. Diğer OpenAI modellerinde cache'e yazma ücretsizdir; burada değildir.
| Metrik | Standart | 272K token üzeri istek |
|---|---|---|
| Giriş | 10,00 | 20,00 |
| Cache okuma | 1,00 | 2,00 |
| Cache yazma | 12,50 | 25,00 |
| Çıkış | 50,00 | 75,00 |
Cache yazma tarifesi giriş fiyatının 1,25 katıdır. Cache'e yazılan tokenlar giriş tokenlarının bir alt kümesidir, üstüne eklenmez: soğuk bir istekte prompt'un önek kısmı cache'e yazılır ve o kısım giriş yerine cache yazma tarifesinden faturalanır. Aynı önekle gelen ikinci istekte aynı tokenlar cache okuma tarifesinden, yani onda bir fiyatına geçer.
Pratikte bu, aynı sistem promptunu tekrar tekrar gönderen bir ajan akışında ilk çağrının yaklaşık %25 daha pahalı, sonraki çağrıların yaklaşık %90 daha ucuz olması demektir. Kullanım kayıtlarınızda cache yazma ve cache okuma ayrı kalemler olarak görünür.
Girdisi 272.000 tokenı aşan isteklerde isteğin tamamı yukarıdaki uzun bağlam sütunundan faturalanır: giriş ve cache tarifeleri iki katına, çıkış tarifesi 1,5 katına çıkar.
Ücretsiz kart
Section titled “Ücretsiz kart”openai/gpt-6-astra-free aynı modeli ücretsiz sunar. Token ücreti alınmaz;
kredi bakiyeniz etkilenmez.
Ücretli satırdan dört farkı vardır ve dördü de ölçülmüştür:
| Konu | openai/gpt-6-astra | openai/gpt-6-astra-free |
|---|---|---|
| Ücret | Token başına | Ücretsiz, günlük kota |
| Çıktı tavanı | Uygulanmaz | Tek yanıtta 128.000 token, zorunlu |
| Bağlam | 1.050.000 token | 200.000 token |
| Uç nokta | /v1/responses ve /v1/chat/completions | Yalnızca /v1/chat/completions |
| PDF girdisi | Var | Yok |
İki ayrı sınır vardır ve ikisi de farklı şekilde çalışır:
| Sınır | Kim uygular | Şekli | Dolduğunda |
|---|---|---|---|
| Adil kullanım | LLMTR | Kayan 24 saatte istek sayısı | 429, resetAt + retryAfterSeconds ile |
| Sağlayıcı kotası | Üçüncü taraf altyapı | Saatte girdi tokenı | Saat başında sıfırlanır |
LLMTR sınırına takılırsanız 429 alırsınız; yanıt gövdesindeki resetAt ve
retryAfterSeconds ne zaman döneceğinizi söyler ve hata mesajı aynı bilgiyi düz
metin olarak taşır. Kayan pencere olduğu için gün sonunu beklemeniz gerekmez.
Sağlayıcı kotası saatlik ve girdi tokenı üzerinden işler; yani tek bir çok uzun istem, yüzlerce kısa istemden daha fazla kota harcar. Bu sınır platform tarafından yönetilir ve normal kullanımda görünmez.
Ücretli satır bu sınırların hiçbirinden etkilenmez.
curl "$LLMTR_BASE_URL/v1/chat/completions" \ -H "Authorization: Bearer llmtr-your_key" \ -H "Content-Type: application/json" \ -d '{ "model": "openai/gpt-6-astra-free", "messages": [ { "role": "user", "content": "Bu fonksiyonu O(n) yap." } ], "max_tokens": 1024 }'Veri politikası
Section titled “Veri politikası”Ücretsiz kart yurt dışındaki üçüncü taraf bir altyapı üzerinden işlenir ve istemleriniz ile yanıtlar sağlayıcı tarafından günlüğe kaydedilebilir. Hassas veya kişisel veri içeren isteklerde ücretli satırı kullanın. Bu uyarı model sayfasında, model seçicide ve playground'da da gösterilir.
Akıl yürütme seviyeleri
Section titled “Akıl yürütme seviyeleri”Ücretsiz kartta da low, medium, high, xhigh ve max geçerlidir.
none ve minimal kabul edilmez: bu rota ikisine de 200 döndürür ama
ölçümde akıl yürütme token sayısı low ile aynı çıkar, yani seviye gerçekte
uygulanmaz. Sessizce etkisiz kalmak yerine gateway 400 döndürür.
Metin çağrısı
Section titled “Metin çağrısı”curl "$LLMTR_BASE_URL/v1/responses" \ -H "Authorization: Bearer llmtr-your_key" \ -H "Content-Type: application/json" \ -d '{ "model": "openai/gpt-6-astra", "input": "Bu migration planındaki geri alınamaz adımları sırala.", "max_output_tokens": 1024 }'Aynı model /v1/chat/completions üzerinden de çağrılabilir; gateway isteği Responses biçimine çevirir ve yanıtı OpenAI sohbet formatında döndürür.
curl "$LLMTR_BASE_URL/v1/chat/completions" \ -H "Authorization: Bearer llmtr-your_key" \ -H "Content-Type: application/json" \ -d '{ "model": "openai/gpt-6-astra", "messages": [ { "role": "user", "content": "Bu migration planındaki geri alınamaz adımları sırala." } ], "max_tokens": 1024 }'Akıl yürütme seviyeleri
Section titled “Akıl yürütme seviyeleri”Model beş seviye kabul eder: low, medium, high, xhigh ve max. none ve minimal kabul edilmez; gönderilirse gateway 400 döner.
{ "model": "openai/gpt-6-astra", "reasoning_effort": "max", "input": "Bu yarış koşulunun neden yalnızca yük altında göründüğünü açıkla.", "max_output_tokens": 4096}Seviye üç yoldan verilebilir; öncelik sırası reasoning_effort > reasoning.effort > slug suffix'idir. Ayrıntılar için Reasoning Effort sayfasına bakın.
Bu modelde :max suffix'i gerçek max seviyesine çözülür, xhigh'a düşmez:
openai/gpt-6-astra:max -> reasoning effort = maxopenai/gpt-6-astra:xhigh -> reasoning effort = xhighSeviye yükseldikçe model daha fazla akıl yürütme tokenı harcar ve bu tokenlar çıktı tarifesinden faturalanır. max seviyesinde max_output_tokens değerini düşük tutarsanız bütçe akıl yürütmede tükenip yanıt metni boş kalabilir.
Örnekleme parametreleri
Section titled “Örnekleme parametreleri”temperature ve top_p bu modelde desteklenmez. Gateway bu alanları isteğe eklenmişse sessizce reddetmek yerine çıkarır ve yanıtta hangi alanların düşürüldüğünü bildirir; böylece bu parametreleri varsayılan olarak gönderen istemciler kırılmaz.
Görsel ve belge girdisi
Section titled “Görsel ve belge girdisi”İçerik dizisinde görsel veya PDF gönderebilirsiniz:
{ "model": "openai/gpt-6-astra", "input": [ { "role": "user", "content": [ { "type": "input_text", "text": "Bu tablodaki tutarsızlıkları bul." }, { "type": "input_image", "image_url": "data:image/png;base64,..." } ] } ], "max_output_tokens": 2048}Görsel tokenları giriş tarifesinden faturalanır.
Araç çağrısı ve yapılandırılmış çıktı
Section titled “Araç çağrısı ve yapılandırılmış çıktı”Fonksiyon çağrısı, paralel çağrı, tool_choice: "required" ve strict: true ile json_schema desteklenir. Ortak istek biçimi için Tool Calling sayfasına bakın.
Model akışı destekler. Akışın son karesi tam usage bloğunu taşır, yani faturalama akışta da gerçek token sayımıyla yapılır. Ayrıntılar: Streaming.