Inception Labs / inception/mercury-2.5-preview

Mercury 2.5 Preview - LLMTR üzerinden erişim

Mercury 2.5 Preview, Inception Labs'in difüzyon tabanlı dil modelinin (dLLM) yeni sürümüdür. Mercury 2 ile aynı paralel üretme ve adım adım netleştirme yaklaşımını kullanır, ancak bağlam penceresi iki katına çıkarılmıştır: 260.000 token. Tek yanıt en fazla 65.536 token olabilir. Araç/fonksiyon çağrısını ve şema zorlamalı JSON çıktısını destekler; yalnızca metin kabul eder. Fiyatlandırmada dikkat edilmesi gereken bir nokta var: token başına fiyatı Mercury 2'den belirgin biçimde düşüktür, ancak model varsayılan olarak Mercury 2'ye kıyasla yaklaşık beş kat daha fazla gizli akıl yürütme token'ı üretir ve bu token'lar çıktı olarak faturalanır. Ölçümlerimizde kısa bir soruda iki modelin gerçek istek maliyeti neredeyse eşit çıktı. Akıl yürütmeyi tamamen kapatmak için `:none`, hafif tutmak için `:minimal` sonekini kullanın; varsayılan seviye `medium`'dur. Bu satırda yalnızca bu üç seviye ilan edilir, çünkü ölçümde `low` seviyesi `minimal` ile, `high` ise `medium` ile ayrışmamıştır. Önizleme sürümüdür; davranışı ve fiyatı sağlayıcı tarafından değiştirilebilir.

Teknik özellikler

Canonical IDinception/mercury-2.5-preview
SağlayıcıInception Labs
Context penceresi260.000 tokens
OperasyonlarCHAT_COMPLETIONS
Modalitelertext

Fiyatlandırma

Kredi yüklemede %8 platform marjı uygulanır; model kullanım fiyatları ayrıca yükseltilmez.

OperationMetricUnitPrice
CHAT_COMPLETIONSINPUT_TEXTPER_1M_TOKENS$0.040000
CHAT_COMPLETIONSCACHE_READPER_1M_TOKENS$0.004000
CHAT_COMPLETIONSOUTPUT_TEXTPER_1M_TOKENS$0.150000

Örnek kullanım

Mevcut OpenAI SDK akışında yalnızca base URL ve model kimliğini değiştirirsiniz.

curl https://llmtr.com/v1/chat/completions \
  -H "Authorization: Bearer llmtr-your_key" \
  -H "Content-Type: application/json" \
  -d '{"model":"inception/mercury-2.5-preview","messages":[{"role":"user","content":"Hello"}]}'

İlgili modeller