Girişimler ve İş Dünyası

Muse Spark 1.3 çıktı: En güçlü sürüm henüz genel erişimde değil

|Yazar: QUASA Editör Ekibi|4 dk okuma| 4
Muse Spark 1.3 çıktı: En güçlü sürüm henüz genel erişimde değil

Meta, Muse Spark 1.3’ü 2 Eylül 2026’da yayımlayarak Muse Code ve Meta Model API üzerinden dağıtıma açtı. Meta’nın resmî duyurusuna göre daha önce sunulan akıl yürütme düzeyleri kullanılabilir durumda; max reasoning ise ek güvenlik testleri tamamlandıktan sonra gelecek. Şirket, sürümü kodlama ve uzun süreli ajan görevlerine odaklanan bir güncelleme olarak tanımlıyor.

Dolayısıyla 2 Eylül’de geliştiricilere açılan ürün ile lansmandaki en yüksek bazı benchmark sonuçlarını üreten yapılandırma aynı erişim durumunda değil. Bugün Muse Code veya API üzerinden kullanılabilen en yüksek düzey xhigh; max sonuçları ise henüz genel bir geliştirici hesabından alınabilen performansı göstermiyor.

Bugün kullanılabilen yapılandırma xhigh

Muse Spark 1.3’ün Muse Code içinde xhigh yapılandırmasıyla uzun süreli kodlama görevini tamamlaması

Muse Spark 1.3 ile hemen çalışacak ekipler için esas alınması gereken yapılandırma xhigh. Max, aynı model ailesinin daha fazla akıl yürütme hesabı kullanan seçeneği olsa da mevcut genel dağıtımın parçası değil. Bu ayrım, yalnızca bir erişim etiketi değil; üretimde tekrarlanabilecek performansın sınırını belirliyor.

Güncelleme, tek bir uzun konuşma içinde birden fazla iş akışını takip etme, araçlarla bağlam toplama, plandaki eksikleri düzeltme ve sonuç doğurabilecek işlemlerden önce onay isteme gibi ajan davranışlarına odaklanıyor. Meta mühendislerinin şirket içi kodlama karşılaştırmalarında yeni sürüm, Spark 1.2’ye göre yaklaşık yüzde 20 daha az araç çağrısı ve yüzde 25 daha az token kullandı. Bunlar Meta’nın kendi iş akışlarından gelen sonuçlar; farklı araçlar, istemler ve görev kümeleri aynı tasarrufu garanti etmiyor.

Bu nedenle erişilebilir sürüm hakkında çıkarılabilecek sağlam sonuç şimdilik sınırlı: xhigh, Muse Code ve Meta Model API içinde gerçek görevlerle değerlendirilebilir. Max içinse genel API erişimi, üretim kararlılığı ve aynı görevlerde oluşacak tüketim henüz doğrudan gözlenemiyor.

Benchmark sonuçları max ve xhigh arasında bölünüyor

Muse Spark 1.3 xhigh ve max benchmark sonuçlarının ayrı yapılandırmalar olarak karşılaştırılması

VentureBeat’in yapılandırma karşılaştırması, GDPval-AA v2’de max için 1.754 Elo, xhigh için 1.709 Elo; OSWorld 2.0’da sırasıyla 66,9 ve 57,2; JobBench’te 64,9 ve 61,2 sonuçlarını aktarıyor. DeepSearchQA’da iki yapılandırma da 89,4 alırken Terminal-Bench 2.1’de xhigh 89,2 ile max’in 88,8 sonucunun az farkla önüne geçiyor.

Tablo, max’in her testte üstün olduğunu göstermiyor. Bununla birlikte en büyük farklardan bazıları genel erişimde olmayan max lehine ve Meta’nın değerlendirme materyallerindeki öne çıkan sonuçların bir bölümü bu yapılandırmaya dayanıyor. “Muse Spark 1.3 skoru” ifadesi bu nedenle tek başına yeterli değil; skorun xhigh mı yoksa max çalıştırmasına mı ait olduğu belirtilmeli.

Aynı incelemede Artificial Analysis Intelligence Index sonucu max için 62, dağıtımdaki xhigh için 61 olarak veriliyor. Max, sınırlı bir iş ortağı ön izlemesinde değerlendirilmiş ve bu yapılandırma için genel bir API sağlayıcısı listelenmemiş. Bir puanlık fark küçük olsa da iki sonucu ayıran asıl konu puandan çok erişim: xhigh tekrarlanabilir bir ürün, max ise şimdilik kontrollü bir değerlendirme yapılandırması.

Fiyat aynı kaldı, fakat iki düzeyin maliyeti karşılaştırılamıyor

Axios’un lansman haberi, Muse Spark 1.3 fiyatlandırmasının önceki sürümle aynı kaldığını ve max reasoning’in ek güvenlik testlerinden sonra sunulacağını bildiriyor. Bu, xhigh için mevcut tarifenin korunması anlamına geliyor; max’in genel kullanıma açıldığında aynı fiyat ve kullanım koşullarına tabi olup olmayacağı ise açıklanmış değil.

Token tarifesinin değişmemesi, tamamlanan bir görevin toplam maliyetinin Spark 1.2 ile aynı kalacağı anlamına gelmez. Ajanın kullandığı giriş ve çıkış tokenları, araç çağrıları, yeniden denemeler ve akıl yürütme düzeyi faturayı birlikte belirler. Şirket içi karşılaştırmalardaki daha düşük token ve araç çağrısı tüketimi olumlu bir işaret olsa da bu ölçüm yalnızca Meta’nın kullandığı kodlama iş akışlarını kapsıyor.

Max henüz genel API trafiğinde denenemediği için iki yapılandırmayı gerçek görev maliyeti bakımından yan yana koymak mümkün değil. xhigh için erişim ve tarife biliniyor; max tarafında ise üretim kullanımı, hız, tüketim ve olası fiyatlandırma açıkta. Bu yüzden max skorlarını xhigh maliyetiyle birleştirerek tek bir fiyat-performans sonucu üretmek yanıltıcı olur.

Max için kesin bir çıkış tarihi yok

Muse Spark 1.3 xhigh API isteğinin çalışması ve max yapılandırmasının güvenlik testinde beklemesi

Mevcut durum iki parçalı: Muse Spark 1.3 yayımlandı ve xhigh dâhil önceki akıl yürütme seçenekleri Muse Code ile Meta Model API’de kullanılabiliyor. Max reasoning ise ek güvenlik değerlendirmesinde ve genel erişime açılmış değil.

Meta, max’in güvenlik testlerinden sonra kısa süre içinde geleceğini belirtiyor; ancak kesin tarih, aşamalı dağıtım planı veya ayrı fiyatlandırma paylaşmadı. Bu bilgiler açıklanana kadar üretim kararı için doğrulanabilir seçenek xhigh. Max benchmarkları model ailesinin kontrollü koşullarda ulaştığı üst kapasiteyi gösteriyor, geliştiricilerin bugün satın alıp çalıştırabildiği yapılandırmayı değil.

Ayrıca okuyun:

Paylaş:

Bültenimize abone olun

En son Web3, yapay zekâ ve kripto haberleri doğrudan gelen kutunuza gelsin.

0