
GPT-6.1 Sol aynı fiyatta kaldı; önbellek maliyeti yarıya indi

OpenAI, 29 Eylül 2026 tarihli GPT-6.1 Sol duyurusunda modeli API’de kullanıma açtı: standart fiyat milyon giriş tokenı başına 2 dolar, çıkış tokenı başına 10 dolar olarak önceki GPT-6 Sol ile aynı kaldı; önbellekten okunan girişin fiyatı ise 0,20 dolardan 0,10 dolara indi. Bu indirim, aynı bağlamı çok sayıda istekte yeniden kullanan ajanlarda etkili; önbellek kullanmayan bir işin token faturası yalnızca sürüm değişti diye düşmüyor.
The Model Gap’in 3 Ekim’e kadar derlediği bağımsız koşular, yeni Sol’un önceki sürümü bir akıl yürütme testinde belirgin biçimde geçtiğini, yazılım mühendisliği ölçümündeki küçük farkın ise sitenin gürültü eşiğini aşmadığını gösteriyor. Astra ile aynı koşullarda karşılaştırılabilen sonuçlar da ilgili eşiklerin içinde kalıyor. Böylece fiyat avantajı ölçülebilirken genel bir performans üstünlüğü iddiası testten teste değişiyor.
Standart fiyat aynı, tekrar okunan bağlam ucuzladı
API tarifesinde üç ayrı kalem var: ilk kez işlenen giriş, önbellekten okunan giriş ve üretilen çıkış. GPT-6.1 Sol ile GPT-6 Sol’un ilk ve son kalemleri eşit. Değişen yalnızca daha önce işlenmiş uygun bağlamın tekrar okunma bedeli; bu kalemdeki indirim yüzde 50. Sistem talimatları, araç tanımları veya uzun bir konuşma geçmişi sonraki çağrılarda korunuyorsa, indirim uygulanan token payı artabilir.
İndirimin faturaya etkisi, girişin ne kadarının gerçekten önbellekten geldiğine bağlı. Önbellek okuması bulunmayan bir istekte tasarruf sıfır; çok sayıda çıktı tokenı üreten bir görevde de değişmeyen çıkış tarifesi toplam maliyete ağırlık veriyor. Ayrıca önbelleğe ilk yazım, daha sonra yapılan ucuz okumadan farklı ücretlendiriliyor. Bu nedenle yarıya inen tutar bütün API faturası değil, yalnızca ilgili giriş kalemi.
Bağımsız koşularda Astra farkı ne kadar?
Humanity’s Last Exam’in araçsız, azami akıl yürütme ayarındaki sonuçlarında GPT-6.1 Sol 52,9; GPT-6 Sol 47,9 puan aldı. Aradaki 5,0 puanlık fark, derlemenin bu karşılaştırma için kullandığı ±2 puanlık gürültü bandını geçiyor. Bu, aynı ölçümde önceki Sol’a karşı belirgin bir kazanım; kod yazma ajanının aynı ölçüde geliştiği anlamına gelmiyor.
Yazılım mühendisliği görevlerini ölçen DeepSWE v1.1’in bağımsız koşusu, Codex ajan düzeneğinde ve azami akıl yürütme ayarında yapıldı. Bu düzende GPT-6.1 Sol yüzde 69,6, GPT-6 Sol yüzde 69,0 aldı; 0,6 puanlık fark, kullanılan ±9,5 puanlık gürültü bandının içinde. LiveBench’in azami ayar satırında da 81,6’ya karşı 79,3 sonucu arasındaki 2,3 puan, ±2,7 puanlık bandı aşmıyor. Ham puanlar yeni sürüm lehine olsa da bu iki ölçümden güvenilir bir üstünlük sıralaması çıkmıyor.
GPT-6 Astra ile aynı ayardaki karşılaştırmada Humanity’s Last Exam’de Astra 54,7, yeni Sol 52,9 puan aldı; 1,8 puanlık ayrım yine bandın içinde. LiveBench’te 82,2’ye karşı 81,6, aynı Codex ajan düzeneğinin DeepSWE koşusunda ise Astra için yüzde 67,6’ya karşı Sol için yüzde 69,6 görüldü. Bu farklar da ilgili eşiklerin altında. Lansman ölçümleri ile bağımsız koşuların araçları ve akıl yürütme ayarları farklı olabildiğinden puanları tek bir ortak sıralama gibi toplamak yanıltıcı olur.
Üç koşullu iş yükünde dolar ve lira hesabı
Aşağıdaki örnekler standart API ücretlerini ve önbelleğe alınmış tokenların gerçekten yeniden okunduğunu varsayıyor; her çağrı uzun bağlam ek fiyat eşiğinin altında. TL karşılığında Wise’ın 6 Ekim 2026’da gösterdiği yaklaşık 49,18 TL’lik dolar kuru kullanıldı. Rakamlar vergi, ödeme kuru, araç çağrısı bedeli ve önbelleğe ilk yazım maliyetini içermeyen örnek hesaplardır; bir günlük toplam, tek bir dev isteği değil çok sayıda çağrıyı anlatır.
İlk koşullu örnekte bir görüşme çağrısı 100 bin yeni giriş ve 10 bin çıkış tokenı kullanıyor; önbellek okuması yok. Giriş 0,20 dolar, çıkış 0,10 dolar, toplam 0,30 dolar yani yaklaşık 14,75 TL tutuyor. Önceki ve yeni Sol için sonuç aynı, çünkü indirimin uygulanacağı önbellek tokenı bulunmuyor. Bu örnek standart fiyatın değişmemesini doğrudan faturaya taşıyor.
İkinci koşullu örnekte bir kod tabanı incelemesi birçok çağrıya yayılıyor: toplam 1 milyon giriş tokenının yüzde 80’i önbellekten okunuyor ve 100 bin çıkış tokenı üretiliyor. Yeni Sol’da 200 bin yeni giriş 0,40 dolar, 800 bin önbellek girişi 0,08 dolar, çıkış 1 dolar tutuyor. Toplam 1,48 dolar veya yaklaşık 72,79 TL; aynı dağılım önceki Sol’da 1,56 dolar veya 76,72 TL. İki sürüm arasındaki 0,08 dolar, yaklaşık 3,93 TL tasarruf, yalnızca önbellek okumasından geliyor.
Üçüncü koşullu örnek, bir gün boyunca çalışan ve yine çok sayıda çağrı yapan bir ajan: 10 milyon giriş tokenının yüzde 90’ı önbellekten, çıkış 1 milyon token. Yeni Sol’da 1 milyon yeni giriş 2 dolar, 9 milyon önbellek girişi 0,90 dolar ve çıkış 10 dolar; toplam 12,90 dolar veya yaklaşık 634,42 TL. Önceki sürümde aynı dağılım 13,80 dolar veya yaklaşık 678,68 TL tutuyor. Fark 0,90 dolar, yaklaşık 44,26 TL; önbellek kalemi yarıya inse bile toplam faturadaki düşüş yaklaşık yüzde 6,5’te kalıyor.
Uzun bağlam eşiği hesabı nasıl değiştiriyor?
GPT-6.1 Sol’da bir isteğin giriş tokenı sayısı 272 bini aşarsa giriş ve önbellek tarifeleri iki katına, çıkış tarifesi bir buçuk katına çıkıyor. Yüksek tarife yalnızca sınırı aşan bölüme değil isteğin tamamına uygulanıyor. Dolayısıyla milyonlarca tokenlık günlük toplamı küçük çağrılara bölmek ile tek bir çok uzun çağrı göndermek aynı maliyet hesabını vermiyor; yukarıdaki örneklerde her çağrının eşik altında kalması bu yüzden gerekli.
Türkiye’deki ekiplerin lira cinsinden tasarrufu, fiilen önbellekten okunan miktarla birlikte kura da bağlı. Özellikle uzun ajan görevlerinde maliyet farkı trafikle büyüyebilir; ilk yazım, uzun bağlam ek fiyatı ve değişmeyen çıkış ücreti bu kazanımı sınırlar. Üretim faturasındaki belirleyici sayı, toplam giriş tokenı değil, bunların kaçının yeniden okunduğu olacak.
Ayrıca okuyun:
İlgili makaleler


Claude Fable 5.1 çıktı: önbellek indirimi ajan maliyetini düşürüyor

GPT-6 Astra çıktı: Siber yetenek ilk kez “Critical” eşiğinde

GPT-6 Astra Bedrock’a geldi; veri paylaşımı varsayılan değil

Gemini 3.8 Flash daha çok düşünüyor: İlk yanıt 13,3 saniyeyi buluyor

OpenAI ajanları denetim alanından çıktı: Hugging Face raporundaki zincir
Bültenimize abone olun
En son Web3, yapay zekâ ve kripto haberleri doğrudan gelen kutunuza gelsin.