GPT-OSS 20B
GPT-OSS 20B, OpenAI'nin küçük açık ağırlıklı Mixture-of-Experts modelidir. openai/gpt-oss-20b-unmetered canonical model kimliği, aynı modelin günlük kullanım kotası olmayan, kullanıldığı kadar ücretlendirilen sürümüdür ve /v1/chat/completions üzerinden çağrılır.
| Model | Bağlam | Giriş / Çıkış ($/1M) |
|---|---|---|
openai/gpt-oss-20b-unmetered | 131.072 | 0,03 / 0,14 |
curl "$LLMTR_BASE_URL/v1/chat/completions" \ -H "Authorization: Bearer llmtr-your_key" \ -H "Content-Type: application/json" \ -d '{ "model": "openai/gpt-oss-20b-unmetered", "messages": [ { "role": "user", "content": "Bir REST API için sayfalama parametrelerini kısaca özetle." } ], "max_tokens": 512 }'openai/gpt-oss-20b ile ilişkisi
Section titled “openai/gpt-oss-20b ile ilişkisi”Sağlayıcı, openai/gpt-oss-20b arkasındaki ücretsiz katmanı 24 Ağustos 2026'da kaldırdı ve o model kimliği emekli edildi. Bu sayfadaki ölçümlü kimlik ayrı ve bağımsız bir modeldir; o değişiklikten etkilenmez.
Düşünme ve reasoning_effort
Section titled “Düşünme ve reasoning_effort”Bu model varsayılan olarak düşünür: reasoning_effort parametresi tamamlama uzunluğunu ölçülebilir şekilde değiştirir (aşağıdaki tabloya bakın), GPT-OSS ailesinin diğer üyelerinde olduğu gibi bu düşünme izi ayrıca message.reasoning_content alanında taşınır. Bu tokenlar completion_tokens içinde sayılıp çıktı fiyatından faturalanır.
reasoning_effort parametresi iki kademeyi destekler:
{ "model": "openai/gpt-oss-20b-unmetered", "reasoning_effort": "none", "messages": [{ "role": "user", "content": "137 çarpı 42 kaçtır?" }], "max_tokens": 256 }| Kademe | Etki |
|---|---|
none | Düşünmeyi kapatır; ölçülen tamamlama uzunluğu varsayılana göre belirgin şekilde kısalır. |
high | Daha derin düşünür; ölçülen tamamlama uzunluğu varsayılana göre belirgin şekilde uzar. |
low ve medium gönderilebilir (istek 400 ile reddedilmez), ancak bu dağıtımda ölçülebilir bir etkileri yoktur: low, none ile birebir aynı çıktıyı üretir; medium, parametre gönderilmemiş varsayılan davranışla birebir aynıdır. Bu yüzden gateway bu iki kademeyi kabul etmez ve 400 ile reddeder — var olmayan bir kontrolü sunmaktan kaçınmak için.
Araç çağrısı
Section titled “Araç çağrısı”Araç çağrısı yereldir. tool_choice alanında auto ve required doğru çalışır; dönen tool_calls argümanları geçerli JSON'dur. Ayrıntı için Araç Çağrısı sayfasına bakın.
curl "$LLMTR_BASE_URL/v1/chat/completions" \ -H "Authorization: Bearer llmtr-your_key" \ -H "Content-Type: application/json" \ -d '{ "model": "openai/gpt-oss-20b-unmetered", "messages": [{ "role": "user", "content": "İstanbulda hava nasıl?" }], "tools": [{ "type": "function", "function": { "name": "get_weather", "description": "Bir şehrin güncel hava durumunu getirir", "parameters": { "type": "object", "properties": { "city": { "type": "string" } }, "required": ["city"] } } }], "tool_choice": "auto" }'Adlandırılmış tool_choice uygulanmaz
Section titled “Adlandırılmış tool_choice uygulanmaz”Belirli bir fonksiyonu ada göre zorlamak ("tool_choice": { "type": "function", "function": { "name": "..." } }) bu dağıtımda bir kısıt olarak işlemez ve sessizce başarısız olur: istek 200 döner, ancak model istediğiniz aracı değil prompt'a uyan aracı çağırır.
Ölçüm (2026-08-24), iki araçlı bir listede:
| İstenen ad | Soru | Çağrılan araç |
|---|---|---|
get_time | hava durumu | get_weather |
Ad yine de doğrulanır: tools listesinde bulunmayan bir ad gönderirseniz 422 alırsınız. Yani parametre okunur, sonra kısıt olarak göz ardı edilir.
Adlandırılmış seçim yalnızca istediğiniz araç modelin zaten seçeceği araçla çakıştığında doğru görünür. Bu yüzden bu modelde adlandırılmış seçime güvenmeyin; akışınızı auto veya required üzerine kurun, tek bir aracın çağrılması şartsa tools listesini o tek araca indirin.
Yapılandırılmış çıktı
Section titled “Yapılandırılmış çıktı”response_format alanı hem json_object hem json_schema biçimini kabul eder:
{ "response_format": { "type": "json_schema", "json_schema": { "name": "person", "strict": true, "schema": { "type": "object", "properties": { "name": { "type": "string" }, "age": { "type": "integer" } }, "required": ["name", "age"], "additionalProperties": false } } }}Sınırlar
Section titled “Sınırlar”- Görsel, ses ve video girdisi desteklenmez. Model yalnızca metin kabul eder ve yalnızca metin üretir. Görsel içeren bir istek gönderilirse upstream isteği açıkça reddeder ("does not accept image input"); metin olarak sayılıp yanlışlıkla faturalandırılmaz.
- Prompt cache yoktur. Tekrarlanan istem önekleri indirimli fiyatlandırılmaz; her istek tam giriş fiyatından faturalanır.
- Adlandırılmış
tool_choiceuygulanmaz. Yukarıdaki bölüme bakın. reasoning_effortyalnızcanonevehighkabul eder. Yukarıdaki bölüme bakın.- Ayrı bir çıktı tavanı yoktur.
max_tokensiçin bağlam penceresi (131.072) dışında bir sınır uygulanmaz.