Qwen / qwen/qwen3-reranker-8b
Qwen3 Reranker 8B - LLMTR üzerinden erişim
Qwen3 Reranker 8B, bir sorgu ile aday dokuman listesini birlikte degerlendirip her dokuman icin 0 ile 1 arasinda bir alaka puani uretir. Embedding aramasi hiz icin sorguyu ve dokumani ayri ayri vektorlestirir; reranker ikisini ayni anda okudugu icin daha isabetli bir siralama verir. Tipik kullanim, embedding ile ilk 50-100 adayi cekip bunlari yeniden siralamak ve dil modeline yalnizca en alakali birkacini gondermektir; bu hem yanit kalitesini artirir hem de uretim modelinin token maliyetini dusurur. Turkce dahil 100'den fazla dili okur ve her sorgu-dokuman cifti icin 32.768 tokene kadar metin alir. /v1/rerank ucundan cagrilir, metin uretmez. Faturalama islenen toplam token uzerindendir: her cift icin sorgu ve dokuman tokenlari birlikte sayilir.
Teknik özellikler
| Canonical ID | qwen/qwen3-reranker-8b |
|---|---|
| Sağlayıcı | Qwen |
| Context penceresi | 32.768 tokens |
| Operasyonlar | RERANK |
| Modaliteler | text |
Fiyatlandırma
Kredi yüklemede %8 platform marjı uygulanır; model kullanım fiyatları ayrıca yükseltilmez.
| Operation | Metric | Unit | Price |
|---|---|---|---|
| RERANK | INPUT_TEXT | PER_1M_TOKENS | $0.050000 |
Örnek kullanım
Mevcut OpenAI SDK akışında yalnızca base URL ve model kimliğini değiştirirsiniz.
curl https://llmtr.com/v1/chat/completions \
-H "Authorization: Bearer llmtr-your_key" \
-H "Content-Type: application/json" \
-d '{"model":"qwen/qwen3-reranker-8b","messages":[{"role":"user","content":"Hello"}]}'
İlgili modeller
- Qwen3.8-Max qwen/qwen3.8-max
- Qwen3.7-Max qwen/qwen3.7-max
- Qwen3.8 2.4T A95B qwen/qwen3.8-2.4t-a95b
- Qwen3.7-Plus qwen/qwen3.7-plus
- Qwen3.6-Flash qwen/qwen3.6-flash
- Qwen-Plus qwen/qwen-plus
- Qwen-Plus-2025-01-25 qwen/qwen-plus-2025-01-25
- Qwen-Plus-2025-04-28 qwen/qwen-plus-2025-04-28