Entegrasyon rehberleri · 2026-09-22
Muse Spark 1.2 ile çok adımlı kodlama ajanında reasoning_effort seçimi
RAG kaynak sıralama yazısından farklı olarak, Muse Spark 1.2'nin minimal ile xhigh arasındaki reasoning_effort seviyelerini çok adımlı bir kodlama/ajan görevinde nasıl seçeceğinizi anlatır.
Beş seviye, farklı bir görev sınıfı
Muse Spark 1.2, katalog sayfasında kodlama ve ajan akışları için ayarlanmış bir reasoning modeli olarak konumlanır ve `reasoning_effort` alanını minimal, low, medium, high, xhigh seviyeleri arasında kabul eder. RAG kaynak sıralama yazısı bu modelin retrieval bağlamında nasıl kullanılacağını ele alırken, bu yazı aynı beş seviyenin çok adımlı bir kodlama görevinde (bir hata raporunu okuyup ilgili dosyaları bulup bir düzeltme önermek gibi) nasıl seçileceğine bakıyor.
1.048.576 token'lık bağlam penceresi, büyük bir kod tabanının veya uzun bir diff geçmişinin tek istekte taşınmasını mümkün kılar; bu geniş bağlamı etkili kullanmak için reasoning_effort'un görev karmaşıklığıyla eşleşmesi gerekir.
Seviyeyi görev tipine göre eşleyin
Tek bir dosyada küçük bir düzeltme öneren basit bir görevde minimal veya low seviyesi genellikle yeterlidir ve gecikmeyi düşük tutar. Birden fazla dosya arasında bağımlılık kuran, bir hatanın kök nedenini birkaç katmanda izlemeniz gereken bir görevde medium veya high seviyesine geçmek, modelin ara adımları daha kapsamlı değerlendirmesini sağlar.
xhigh seviyesi, en karmaşık, çok adımlı ajan döngülerinde (bir aracı çağırıp sonucuna göre planı yeniden gözden geçirme gibi) ayrılmalıdır; bu seviye en yüksek gecikme ve reasoning token maliyetini taşır, basit görevlerde kullanmak gecikmeyi ve maliyeti gereksiz yere yükseltir.
- Tek dosyalık basit düzeltme: minimal veya low.
- Çok dosyalı, katmanlı kök neden analizi: medium veya high.
- Çok adımlı ajan döngüsü: xhigh, ama yalnızca gerektiğinde.
Reasoning tokenları çıktı bütçenizden düşülür
Reasoning tokenları `completion_tokens` içinde döner ve çıktı olarak faturalanır; yüksek bir effort seviyesinde `max_tokens` değerinizi yeterince büyük tutmazsanız, akıl yürütme bütçeyi tüketip asıl içerik boş dönebilir. Effort seviyesini yükseltirken `max_tokens` bütçesini de buna göre ayarlayın.
Sık sorulan sorular
Her kodlama görevinde xhigh mı kullanmalıyım?
Hayır. xhigh en yüksek gecikme ve maliyeti taşır; basit görevlerde minimal veya low genellikle yeterlidir. Seviyeyi görev karmaşıklığına göre seçin ve kendi görevlerinizle test edin.
reasoning_effort'u değiştirmek tool calling davranışını etkiler mi?
Araç çağırma her effort seviyesinde çalışır; fark, modelin araç çağrısına karar vermeden önce ne kadar derin bir ara adım değerlendirmesi yaptığıdır.