PrismML / prismml/ternary-bonsai-2-27b
Ternary Bonsai 2 27B - LLMTR üzerinden erişim
Ternary Bonsai 2 27B, PrismML'in Qwen3.8 27B'den ürettiği sıkıştırılmış modeldir: ağırlıkları yalnızca -1, 0 ve +1 değerlerini alır (ağırlık başına yaklaşık 1,76 etkin bit), bu da onu tam hassasiyetli aslından dokuz kattan fazla küçültür. 262.144 tokenlık bağlam penceresi, metin ve görsel girdi ile metin çıktısı, zorunlu tool_choice ve paralel çağrılar dahil yerel araç çağrısı, JSON nesne modu ve JSON Schema ile şema zorlamalı çıktı sunar. Adım adım düşünme varsayılan olarak AÇIKTIR; düşünme izi yanıttan ayrı bir alanda döner, düşünme tokenları çıktı olarak faturalanır ve gerek duyulmadığında istek başına kapatılabilir. Kademeli reasoning_effort seviyeleri desteklenmez, yalnızca açık ya da kapalı seçilebilir. Bağlam penceresi prompt ve çıktı arasında PAYLAŞILIR: altında ayrı bir çıktı tavanı yoktur, en büyük çıktı isteğiniz prompt büyüdükçe küçülür. Prompt cache indirimi uygulanmaz, her istek tam giriş fiyatından faturalanır.
Teknik özellikler
| Canonical ID | prismml/ternary-bonsai-2-27b |
|---|---|
| Sağlayıcı | PrismML |
| Context penceresi | 262.144 tokens |
| Operasyonlar | CHAT_COMPLETIONS |
| Modaliteler | text, image |
Fiyatlandırma
Kredi yüklemede %8 platform marjı uygulanır; model kullanım fiyatları ayrıca yükseltilmez.
| Operation | Metric | Unit | Price |
|---|---|---|---|
| CHAT_COMPLETIONS | INPUT_TEXT | PER_1M_TOKENS | $0.075000 |
| CHAT_COMPLETIONS | OUTPUT_TEXT | PER_1M_TOKENS | $0.500000 |
Örnek kullanım
Mevcut OpenAI SDK akışında yalnızca base URL ve model kimliğini değiştirirsiniz.
curl https://llmtr.com/v1/chat/completions -H "Authorization: Bearer llmtr-your_key" -H "Content-Type: application/json" -d '{"model":"prismml/ternary-bonsai-2-27b","messages":[{"role":"user","content":"Hello"}]}'
İlgili modeller
- Gemma 4 llmtr/gemma-4
- Qwen 3.6 35B-A3B llmtr/qwen3-6-35b
- Trendyol Asure 12B llmtr/trendyol-asure-12b
- Magibu 11B v8 llmtr/magibu-11b-v8
- Muse Glimmer 30B (Türkiye) llmtr/muse-glimmer-30b-tr
- EmbeddingGemma 300M llmtr/embeddinggemma-300m
- Qwen 3.5 4B llmtr/qwen3-5-4b
- GPT-6 Astra openai/gpt-6-astra