Teknoloji ve İnovasyon

Muse Spark 1.3 daha az araç çağırıyor: En güçlü düşünme modu gecikecek

|Yazar: QUASA Editör Ekibi|4 dk okuma| 2
Muse Spark 1.3 daha az araç çağırıyor: En güçlü düşünme modu gecikecek

Meta, Muse Spark 1.3’ü 2 Eylül 2026’da Muse Code ve Meta Model API üzerinden kullanıma açtı. Axios’un lansman haberi, mevcut düşünme seviyelerinin dağıtıma çıktığını, en güçlü max reasoning seçeneğinin ise ek güvenlik testlerinden sonra sunulacağını doğruluyor.

Sürümün başlıca değişikliği, Meta’nın kendi kodlama karşılaştırmalarına göre uzun görevlerde Muse Spark 1.2’den yaklaşık yüzde 20 daha az araç çağrısı ve yüzde 25 daha az token kullanması. Bunlar bağımsız test sonuçları değil; belirli şirket içi iş akışlarında gözlenen sürümler arası farklar.

Uzun görevlerde daha az tur ve araç çağrısı

Muse Spark 1.3’ün uzun kodlama görevini Muse Spark 1.2’ye göre daha az araç çağrısı ve token ile yürütmesi

Muse Spark 1.3, tek seferlik kısa yanıtların ötesinde, aynı uzun konuşma içinde birden fazla iş akışını sürdürmek üzere eğitildi. Meta; modelin araçlarla dağınık veya çelişkili kaynaklardan bağlam oluşturabildiğini, planındaki eksikleri düzeltmeye çalıştığını ve önceki adımlarda öğrendiği ayrıntıları son çıktıya kadar koruduğunu belirtiyor.

Meta’nın resmî sürüm duyurusu, şirket mühendislerinin kodlama karşılaştırmalarında Muse Spark 1.3’ün önceki sürüme göre yaklaşık yüzde 20 daha az araç çağrısı ve yüzde 25 daha az token kullandığını bildiriyor. Duyuru ayrıca gereksiz olduğunda daha az tur atma, daha kısa yanıt verme ve daha temiz kod üretme hedeflerini sıralıyor.

Başlıktaki “daha az araç çağırıyor” ifadesinin sınırı burada: oran, her görev ve her ajan sistemi için doğrulanmış evrensel bir tasarruf değil. Araç seti, kullanılan ajan çatısı, istemler, yeniden deneme politikası ve görevin yapısı değiştiğinde çağrı ve token sayıları da değişebilir. Bu nedenle yüzde 20 ve yüzde 25, sağlayıcının kendi kodlama ortamındaki karşılaştırması olarak okunmalı.

Daha az araç çağrısı, terminal komutu veya dosya araması gibi harici işlemlerin sayısını azaltabilir; ancak bundan otomatik olarak aynı oranda daha düşük gecikme ya da görev maliyeti sonucu çıkmaz. Bir ajan çalışmasının toplam maliyetini giriş ve çıkış tokenları, düşünme seviyesi, tur sayısı, başarısız denemeler ve kullanılan harici hizmetler birlikte belirler.

Erişim kanalları ve Contributor katmanının bedeli

Muse Spark 1.3’e Muse Code ve Meta Model API üzerinden erişim ile Contributor katmanındaki veri-maliyet takası

Muse Spark 1.3 için Meta’nın doğruladığı iki doğrudan kanal Muse Code ve Meta Model API. Muse Code modeli bir kodlama ajanı içinde sunarken API, geliştiricilerin modeli kendi uygulamalarına ve ajan düzenlerine bağlaması için programatik erişim sağlıyor. Lansman açıklaması farklı ülkeler için ayrıntılı bir dağıtım takvimi vermediğinden, erişimin hesap ve bölge bazındaki kapsamı ayrıca doğrulanmak zorunda.

Standart API katmanında bir milyon giriş tokenı 1,25 dolar, bir milyon çıkış tokenı 4,25 dolar. VentureBeat’in 3 Eylül incelemesi, Contributor katmanında aynı kalemlerin 0,10 ve 0,20 dolara indiğini, indirim karşılığında istem ve tamamlamaların model eğitiminde kullanılmasına izin verildiğini aktarıyor; inceleme ayrıca Meta’nın kodlama ölçümüyle daha geniş görevler kullanan bağımsız değerlendirmelerin aynı metrik ve yöntemle yapılmadığını vurguluyor.

Contributor, daha zayıf bir model ya da ayrı bir düşünme seviyesi olarak tanımlanmıyor. Temel fark, gönderilen içerik için verilen kullanım izni ile token fiyatı arasındaki takas. Özel depo kodu, müşteri verisi veya yayımlanmamış ürün bilgisi işleyen ekipler açısından bu nedenle yalnızca iki fiyat sütununu karşılaştırmak yeterli değil.

Meta’nın yüzde 25 daha az token iddiası da doğrudan yüzde 25 daha düşük faturaya çevrilemez. Şirketin ölçümü kendi kodlama iş akışlarıyla sınırlıyken bağımsız bir değerlendirme; daha geniş ajan görevleri, başka düşünme seviyeleri ve farklı giriş uzunlukları kullanabilir. Sonuçlar ancak model yapılandırması, görev kümesi ve maliyet hesabı aynı olduğunda bire bir karşılaştırılabilir.

Max reasoning neden lansmana yetişmedi?

Muse Spark 1.3 mevcut düşünme seviyesinde çalışırken max reasoning modunun güvenlik testlerini beklemesi

Yayımlanan modelde daha önce sunulan düşünme seviyeleri kullanılabiliyor; max reasoning ise genel erişimin parçası değil. Meta, bu yapılandırmayı ek güvenlik testleri tamamlandıktan sonra sunacağını söylüyor ancak kesin bir tarih açıklamıyor. Dolayısıyla Muse Spark 1.3 yayımlanmış olsa da modelin bütün düşünme seçenekleri henüz yayımlanmış değil.

Bu ayrım benchmark sonuçlarında da önem taşıyor. Lansmandaki en güçlü sonuçların bir bölümü max yapılandırmasından gelirken geliştiricilerin bugün geniş ölçekte çağırabildiği sürüm, önceki düşünme seviyelerini kullanıyor. Max ile alınan puanları mevcut API yapılandırmasının doğrudan performansı gibi sunmak, erişim durumunu ve kullanılan hesaplama seviyesini birbirine karıştırır.

Gecikmenin açıklanan nedeni ek güvenlik değerlendirmesi. Meta, max seçeneğinin hangi testleri tamamlaması gerektiğini, değerlendirmelerin ne zaman biteceğini veya sürümün önce sınırlı bir gruba mı açılacağını ayrıntılandırmadı. “Yakında” ifadesi bu nedenle bir yayın tarihi ya da genel erişim taahhüdü sayılmıyor.

Yayımlanan sürüm ile beklenen özellik arasındaki sınır

Kesinleşen tablo üç parçalı: Muse Spark 1.3, 2 Eylül’den beri Muse Code ve Meta Model API’de mevcut; daha az araç çağrısı ve token kullanımı oranları Meta’nın şirket içi kodlama karşılaştırmalarına dayanıyor; max reasoning ise güvenlik testleri bitene kadar kullanıma açılmıyor. Contributor seçeneği daha düşük fiyat sunuyor fakat gönderilen içerik için farklı bir veri kullanım izni gerektiriyor.

Bundan sonraki iki açık konu, max reasoning seçeneğinin yayın tarihi ile mevcut yapılandırmanın farklı ajan sistemlerindeki gerçek verimliliği. Meta ayrıca gelecekte daha büyük modellerden ve bir Muse Spark açık ağırlık sürümünden söz ediyor; ancak sürüm numarası, lisans ve takvim açıklamış değil. Bağımsız, tekrarlanabilir testler arttıkça şirket içi araç ve token ölçümlerinin başka iş akışlarına ne ölçüde taşındığı daha net görülebilecek.

Ayrıca okuyun:

Paylaş:

Bültenimize abone olun

En son Web3, yapay zekâ ve kripto haberleri doğrudan gelen kutunuza gelsin.

0