Model karşılaştırma · 2026-08-28
Upstage Solar Pro 4 ve Pro 3: bağlam, düşünme ve fiyat
Solar Pro 4 ile Solar Pro 3'ü bağlam, ayrı çıktı sınırı, reasoning ayarları ve tarihli token fiyatları üzerinden adil bir görevle karşılaştırın.
Solar Pro 4 mü, Pro 3 mü?
Büyük belge seti veya açıkça tanımlanmış uzun çıktı sınırı gerektiğinde Solar Pro 4 daha geniş alan sağlar. Küçük bağlam yetiyorsa sürüm numarasından kalite sonucu çıkarmayın; Solar Pro 3'ü aynı görev ve puanlama anahtarıyla değerlendirin. Burada yeni canlı çağrı veya üstünlük sonucu yoktur.
LLMTR kimlikleri upstage/solar-pro4 ve upstage/solar-pro3'tür. İkisi de metin tabanlı Chat Completions akışındadır. PDF ve görselden önce metni çıkarıp kaynak konumlarını koruyun. Deneyde kişisel veya gizli veri değil, kurgusal içerik kullanın.
Bağlam ile çıktı tavanını ayrı okuyun
Upstage kartları 512K ve 128K gibi yuvarlak etiketler kullanır. LLMTR kataloğundaki 11 Ağustos 2026 sağlayıcı reddi ölçümleri kesindir: Pro 4 için 524.288 bağlam ve 131.072 ayrı maksimum çıktı; Pro 3 için 131.072 bağlam ve ayrı maksimum çıktı alanı yoktur.
Pro 3'ün bağlam değerini tek yanıt tavanı diye sunmayın. İstem, düşünme ve son yanıt toplam bütçeyi etkiler. İki modele aynı max_tokens değerini verin; finish_reason length dönen denemeyi tamamlanmış saymayın.
| Ölçüt | Solar Pro 4 | Solar Pro 3 |
|---|---|---|
| LLMTR kimliği | upstage/solar-pro4 | upstage/solar-pro3 |
| Bağlam | 524.288 token | 131.072 token |
| Ayrı maksimum çıktı | 131.072 token | Yayımlanmamış; bağlamdan türetmeyin |
| Girdi kapsamı | Metin | Metin |
Düşünme seviyelerini varsayıma bırakmayın
LLMTR kabul kümesi Pro 4 için none, minimal, low, medium, high, xhigh ve max; Pro 3 için none, minimal, low, medium ve high değerleridir. Pro 3'e xhigh veya max göndermeyin. Kayıtlı ölçümde düşünme Pro 4'te low, Pro 3'te medium ile başlar.
Güncel Upstage dokümanı parametre atlanınca Pro 4'te düşünmenin açık, Pro 3'te kapalı olduğunu söyler; Pro 4 iddiası 11 Ağustos LLMTR ölçümüyle çelişir. Varsayılana güvenmeyin: düşünmesiz turda ikisine minimal, düşünmeli turda medium gönderin.
| Koşul | Solar Pro 4 | Solar Pro 3 | Amaç |
|---|---|---|---|
| A | minimal | minimal | Düşünme tokenı olmadan karşılaştırma |
| B | medium | medium | Düşünme açıkken karşılaştırma |
| Kullanılmayan Pro 4 seviyeleri | none, low, high, xhigh, max | — | Bu deneyin dışında |
| Pro 3'te bulunmayan | — | xhigh, max | Göndermeyin |
Fiyatı geçerli zaman penceresiyle hesaplayın
Ham fiyatlar 1 milyon token başına USD'dir. Pro 4 promosyonu 10 Eylül 2026 23:59 UTC sonunda biter; standart tarife 11 Eylül 00:00 UTC'de başlar. Pro 3 fiyatı 28 Ağustos'ta doğrulanmıştır. Kredi yükleme marjı eklenmemiştir.
Cache dışı giriş, cache okuması ve toplam çıktıyı ayrı hesaplayın. Reasoning tokenları çıktıya dahildir; completion_tokens toplamına reasoning_tokens değerini yeniden eklemeyin. Fiyat sıralaması promosyon bitince değişir, uzun süreli kararı bugünkü indirimle vermeyin.
| Model ve dönem | Giriş | Cache | Çıktı |
|---|---|---|---|
| Pro 4, 2026-09-11T00:00Z öncesi | 0.03 | 0.006 | 0.12 |
| Pro 4, 2026-09-11T00:00Z ve sonrası | 0.30 | 0.06 | 1.20 |
| Pro 3, 28 Ağustos 2026'da doğrulanan | 0.15 | 0.015 | 0.60 |
Aynı belge uzlaştırma görevini kullanın
İki kurgusal sözleşme özeti arasında tutar, tarih ve teslim koşulu farklarını bulma görevi hazırlayın. Her modele aynı metni, aynı sistem talimatını, aynı sırayı ve 4.096 max_tokens bütçesini verin. Önce minimal, sonra medium koşulunu çalıştırın; koşullar arasında istemi düzeltmeyin. Aşağıdaki metin beklenen model yanıtı değil, ortak değerlendirme istemidir.
Her iki modele değişmeden gönderilecek kurgusal görev
Yalnızca aşağıdaki iki kaynağa dayan. Her fark için alanı, Kaynak A değerini, Kaynak B değerini ve kanıt cümlesini yaz. Kaynakta olmayan bilgiyi tahmin etme.
Kaynak A: Toplam bedel 240.000 TL'dir. Teslim 15 Ekim 2026'dır. Gecikme cezası günlük yüzde 0,2'dir.
Kaynak B: Toplam bedel 245.000 TL'dir. Teslim 22 Ekim 2026'dır. Gecikme cezası belirtilmemiştir.
Sonunda yalnız şu üç kontrolü cevapla: Tüm sayısal farklar bulundu mu? Eksik hüküm açıkça işaretlendi mi? Kaynak dışı iddia var mı?
Sonuç üretmeden önce puanlama anahtarını sabitleyin
Model adını gizleyip her yanıtı beş ölçütte 0, 1 veya 2 puanlayın. Koşulları karıştırmayın veya yalnız başarılı örneği seçmeyin. Tekrar sayısını eşit tutup model sırasını değiştirin. Burada puan, hız veya maliyet sonucu üretilmemiştir.
- Kapsam: bedel ve teslim tarihindeki iki farkın ikisi de bulunmuş mu?
- Eksik bilgi: ceza hükmünün Kaynak B'de bulunmadığı açıkça söylenmiş mi?
- Kanıt: her değer doğru kaynak cümlesine bağlanmış mı?
- Sadakat: kaynakta olmayan tutar, tarih veya hüküm eklenmiş mi?
- Tamamlanma: biçim istenen alanları içeriyor ve yanıt kesilmeden bitiyor mu?
Kararı görev, bütçe ve hata türüyle verin
Bağlama sığmayan görev Pro 3'e uygun değildir; sığan görevde Pro 4'ün yeni olması seçim kanıtı değildir. Puan, giriş, cache, çıktı, reasoning tokenları ve bitiş nedenini kaydedin; içerikleri üretim loglarına yazmayın.
Kabul eşiğini önceden belirleyin. İki model de geçerse gerçek token karışımı ve geçerli dönemle maliyeti karşılaştırın. Daha düşük fiyat, başarısız görevi kullanılabilir yapmaz.
Sık sorulan sorular
Solar Pro 4 her görevde Pro 3'ten daha iyi midir?
Hayır. Genel değerlendirmeler görevinizi garanti etmez; aynı istem ve önceden sabitlenmiş puanlama anahtarıyla ölçün.
Solar Pro 3 en fazla 131.072 token çıktı üretir mi?
Bunu ayrı çıktı tavanı saymayın. 131.072 bağlam değeridir; Pro 3 satırında ayrı maxOutputTokens yayımlanmamıştır.
İki modeli varsayılan reasoning ile karşılaştırabilir miyim?
Önerilmez. Kaynaklar Pro 4 varsayılanında ayrışıyor. İki modele minimal ve medium koşullarını açıkça gönderin.