15 bin hesap gizli akıl yürütmeyi yokladı; şifreleme kırılmadı

|Yazar: QUASA Editör Ekibi|4 dk okuma
15 bin hesap gizli akıl yürütmeyi yokladı; şifreleme kırılmadı

OpenAI, 30 Eylül 2026 tarihli açıklamasında, modellerinin korunan akıl yürütmesini çıkarmaya yönelik istem örüntülerini 15 binden fazla kullanıcıda gördüğünü bildirdi; “The operators did not break our encryption” diyerek şifrelemenin kırılmadığını belirtti. Şirketin açıklamasına göre operatörler bir veritabanını ele geçirmedi ve saklanan kullanıcı konuşmalarına doğrudan erişmedi. Hedefleri, modelin normalde görünmeyen akıl yürütmesini yeni model etkileşimleri yoluyla okunabilir bir çıktıya dönüştürmekti.

The Hacker News’in olay aktarımına göre faaliyet 1 Temmuz’da düşük hacimle başladı; 24–25 Temmuz’da 4 binden fazla kullanıcıdan çıkarma örüntüsüne uyan 16 bin istek görüldü ve kampanya 28 Temmuz’da durduruldu. OpenAI, Kimi’nin geliştiricisi Moonshot AI ile ilişkili kişileri faaliyetin merkezindeki kümeye bağlıyor. Bu atıf, gözlenen bütün operatörlerin aynı aktöre bağlı olduğu anlamına gelmiyor.

Şifreli akıl yürütme başka bir konuşmada nasıl hedeflendi?

Korunan akıl yürütme, modelin bir görevi işlerken oluşturduğu ve son yanıtta gösterilmeyen iç kaydı ifade ediyor. Operatörlerin denediği yollardan birinde, bir konuşmadan alınan şifreli akıl yürütme parçası başka bir konuşmaya taşındı. Ardından modelden parçanın gizlediği içeriği çözmesi ve yazıya dökmesi istendi. İstek, şifreleme algoritmasına veya anahtarına saldırmak yerine modelin şifreli parçayla kurduğu etkileşimi kullanıyordu.

  1. Operatör, yeniden oynatabileceği şifreli bir akıl yürütme parçasını elde ediyor.
  2. Bu parçayı farklı bir konuşmanın bağlamına yerleştirip modelden gizli içeriği yazmasını istiyor.
  3. Girişim başarılı olursa korunan içerik, isteği yapan kişinin görebildiği model çıktısına dönüşüyor.

Bu zincirin başlangıç koşulu önem taşıyor: operatörün yeniden oynatacağı parçaya önceden sahip olması gerekiyor. Kapatılan yollardan biri, başka bir kullanıcıya ait şifreli parçayı zaten elinde bulunduran kişinin onu tekrar kullanarak içeriğine ulaşabilmesine imkân veriyordu. Böyle bir yol, saklanan sohbetlerin topluca indirildiğini göstermez; güvenlik sınırının, taşınan parçanın yeni bir bağlamda nasıl işlendiği noktasında oluştuğunu gösterir.

Tom’s Hardware’ın teknik anlatımı, şifreli akıl yürütmenin istemciye bir blok olarak verilip sonraki isteklerde yeniden gönderilebildiğini açıklıyor. Bu taşınabilirlik, modelin önceki çalışmasını sürdürmesine yararken parçanın farklı bir konuşmada kullanılmasını da saldırı açısından değerli kılıyor. Aynı yayın, kampanyanın başarı oranının ve özellikle hangi modellerin hedeflendiğinin açıklanmadığını belirtiyor.

Gözlenen istekler neyi ölçüyor?

Kampanyanın büyüklüğünü anlatan sayılar farklı şeyleri ölçüyor. Dar ölçüm, iki günlük yoğun dönemde çıkarma kalıbına uyan istekleri ve bunları gönderen kullanıcıları kapsıyor. Daha geniş küme ise inceleme sırasında benzer istem örüntüleriyle ilişkilendirilen kullanıcıları içeriyor. Bu yüzden geniş kümedeki her hesabın aynı sayıda istek gönderdiği veya her isteğin korunan içeriği açığa çıkardığı söylenemez.

Bir isteğin çıkarma girişimi olarak sınıflandırılması, istenen içeriğin gerçekten alındığına dair sonuç ölçümü değildir. Açıklanan hacimden başarılı çıkarma sayısı, elde edilen metin miktarı veya başka bir modeli eğitmeye yetecek veri bulunup bulunmadığı hesaplanamıyor. Korunan akıl yürütmenin hedeflenmesi yine de sıradan son yanıt toplamaktan farklı: iç kayıt, modelin kullanıcıya göstermediği ara bilgileri ve problem çözme yolunu içerebilir.

Model damıtma değerlendirmesi de bu ayrımla okunmalı. Başka bir modelin çıktılarından veya akıl yürütmesinden sistematik biçimde yararlanarak onu eğitmek ya da geliştirmek mümkün bir amaç; gözlenen çıkarma kalıbı ise tek başına böyle bir eğitimin tamamlandığını kanıtlamıyor. Olayda ölçülebilen davranış, korunan içeriğe ulaşmaya dönük koordineli denemeler. Bunların bir rakip modelin yeteneklerine ne ölçüde aktarıldığına ilişkin sonuç yayımlanmadı.

Moonshot AI atfının sınırı

Moonshot AI bağlantısı, faaliyetin merkezindeki bir kümeye ilişkin şirket değerlendirmesi. Benzer istemlerin daha geniş bir kullanıcı grubunda görülmesi, bu grubun tamamının aynı kuruluş tarafından yönetildiğini ortaya koymuyor. Ayrım özellikle hesap sayısını yorumlarken gerekli: tespit edilen örüntünün kapsamı ile operatörlerin kimliğine ilişkin kesinlik aynı ölçü değil.

  • Gözlenen davranış: Hesaplar arasında benzer çıkarma istemleri ve şifreli parçayı başka bir konuşmada yeniden oynatma girişimi.
  • Atıf değerlendirmesi: Faaliyetin çekirdek bir bölümü, Moonshot AI ile ilişkili kişilere bağlanıyor.
  • Açıklanmayan sonuç: Başarılı çıkarma sayısı ve elde edilen içeriğin başka bir modelde kullanılıp kullanılmadığı bilinmiyor.

Kullanıcı konuşmaları açısından ortaya konan sınır daha somut: operatörlerin saklanan görüşmelere doğrudan eriştiği veya veritabanına girdiği bildirilmedi. İncelenen risk, elde edilmiş bir şifreli akıl yürütme parçasının model aracılığıyla görünür çıktıya çevrilmesiydi. Bu ayrım, hem olayı bir sohbet arşivi ihlali olarak sunmayı hem de korunan içerik için oluşan ayrı saldırı yolunu gözden kaçırmayı önlüyor.

Hangi yollar kapatıldı?

Müdahale hesaplar, model çıktıları ve konuşmalar arasındaki sınırları kapsadı. Sahte hesaplar yasaklandı veya kısıtlandı; kayıt ve altyapı kontrolleri sıkılaştırıldı, ilişkili ağları izleme kapsamı genişletildi. Faaliyet üçüncü taraf hizmetlere taşındığında ilgili sağlayıcılarla hesapları tespit edip durdurmak için çalışıldı. Bu önlemler, aynı istem kalıbının yeni hesaplarla sürdürülmesini güçleştirmeyi amaçlıyor.

Teknik tarafta, başka bir kullanıcıya ait şifreli akıl yürütmeyi yeniden oynatıp içeriğini geri elde etmeye izin veren yol kapatıldı. Korunan içeriği açığa çıkarabilecek akış hâlindeki çıktıları saptayıp durdurmaya yönelik denetimler eklendi. Kullanıcılar, çalışma alanları, kuruluşlar ve model aileleri arasındaki korumalar da güçlendirildi. Böylece savunma, yalnızca şifreli parçanın saklanmasına değil, o parçanın hangi bağlamda yeniden kullanılabileceğine de uzanıyor.

Bulgular Frontier Model Forum ve kamu kurumlarıyla kullanılan bilgi paylaşım kanallarına iletildi. Sıradaki çalışma, aynı korumaların iş ortaklarının barındırdığı dağıtımlara taşınması ve araç çıktıları üzerinden gelen saldırıların daha iyi denetlenmesi. Taşınabilir akıl yürütme parçaları kullanan sistemler için belirleyici sınır, bir oturumda üretilen parçanın başka kullanıcı, konuşma veya model bağlamında neye dönüştürülebildiği.

Ayrıca okuyun:

Paylaş:

Bültenimize abone olun

En son Web3, yapay zekâ ve kripto haberleri doğrudan gelen kutunuza gelsin.

0