Anthropic, yapay zekânın insan üzerindeki etkisine 5 milyon dolar ayırdı

Anthropic, 25 Ağustos 2026’da yapay zekâ sistemlerinin kullanıcı refahı üzerindeki etkisini ölçecek bağımsız araştırmalar için 5 milyon dolarlık bir hibe programı başlattı. Anthropic’in program duyurusuna göre seçilen ekipler doğrudan finansman, şirketin modellerine erişim ve teknik destek alacak; çalışmalarını bağımsız yürüterek ortaya çıkan değerlendirmeleri açık kaynak projeler halinde yayımlayacak.
25 Ağustos’ta açılan program yalnızca kriz anlarında verilen tek bir cevabı denetlemeyi amaçlamıyor. TMC Insight’ın program özeti, değerlendirmelerin bağlamın değiştiği çok turlu konuşmaları incelemesinin, klinik veya ilgili alan uzmanlarınca doğrulanmasının ve hem zararlı taleplere aşırı uyumu hem de güvenli isteklere gereksiz reddi ölçmesinin beklendiğini aktarıyor.
Fon kimleri ve hangi çalışmaları destekleyecek?
Programın hedefi, yalnızca Anthropic içinde kullanılacak kapalı bir güvenlik puanı üretmek değil. Bağımsız ekiplerden model davranışını belirli senaryolarda sınayan değerlendirmeler ve karşılaştırılabilir ölçütler geliştirmeleri bekleniyor. Açık kaynak şartı, sonuçların başka geliştiriciler ve araştırmacılar tarafından da incelenebilmesini amaçlıyor.
Anthropic, bu alandaki çalışmalara klinisyenlerin, psikologların, değerlendirme metodolojisi uzmanlarının ve diğer ilgili araştırmacıların katılmasını istiyor. Bunun nedeni, bir model yanıtının teknik olarak kurallara uygun görünmesiyle kullanıcı açısından uygun olması arasındaki farkın yalnızca otomatik puanlamayla güvenilir biçimde belirlenememesi.
Hibe alan ekipler Anthropic’ten kaynak ve operasyonel destek alacak, ancak araştırmalarını bağımsız yürütecek. Toplam 5 milyon doların kaç proje arasında paylaştırılacağı ve proje başına verilecek miktar henüz açıklanmadı. Bu nedenle duyuru, tamamlanmış bir araştırmanın sonucu veya kabul edilmiş bir sektör standardı değil; yeni değerlendirmeler geliştirmek üzere açılmış bir fon programı.
Tek yanıt testi neden yeterli değil?

Birçok model testi, tek bir soruya verilen yanıtın doğru, güvenli veya kurallara uygun olup olmadığını inceler. Kullanıcı refahında ise aynı cevap, konuşmanın önceki bölümlerine göre yararlı veya zararlı hale gelebilir. Program bu yüzden bağlamın zaman içinde değiştiği çok turlu etkileşimleri merkeze alıyor.
Anthropic’in kullandığı örnekte dengeli beslenme ve egzersiz tavsiyesi, sıradan bir kilo verme sorusuna makul bir cevap olabilir. Kullanıcı önceki mesajlarında yeme bozukluğu geçmişine işaret etmişse aynı tavsiye uygunsuz, hatta zararlı olabilir. Benzer biçimde kendine zarar verme riski, konuşmanın ilk mesajında değil, daha sonraki turlarında görünür hale gelebilir.
Geliştirilecek testlerin neyi ölçtüğünü ve hangi sonucun başarı veya başarısızlık sayıldığını açıkça tanımlaması bekleniyor. Klinik veya ilgili alan uzmanlarının tasarım ve doğrulamaya katılması, otomatik puanlayıcıların kararlarının da gerçek uzman değerlendirmeleriyle karşılaştırılması isteniyor. Böylece kolayca tekrarlanan fakat insan yargısıyla ilişkisi belirsiz puanlar yerine, ölçtüğü davranış açıkça tarif edilmiş testler hedefleniyor.
İkinci denge noktası, aşırı uyum ile gereksiz ret arasında. Modelin riskli bir talebe yalnızca kullanıcı istediği için uyması zarar yaratabilir; ancak hassas sözcükler içeren her konuşmayı reddetmesi de güvenli ve meşru desteği engelleyebilir. Sağlam bir refah değerlendirmesinin bu iki başarısızlık biçimini aynı çerçevede ayırt edebilmesi gerekiyor.
İş yerindeki uzun yapay zekâ kullanımı neyi değiştirebilir?

Program çalışanlara özel değil; kapsamı genel olarak yapay zekâ kullanıcılarının refahı. Bununla birlikte açıklanan ölçüm yaklaşımı, iş yerinde uzun süre yapay zekâ kullanan çalışanları değerlendiren İK ve ürün güvenliği ekipleri açısından önemli bir ayrım ortaya koyuyor: Bir aracın doğru cevap vermesi, çalışan deneyimi üzerindeki etkisini tek başına göstermiyor.
Kurumsal bir değerlendirme, koşullu bir örnek olarak, yoğun bir proje haftası boyunca sürdürülen yapay zekâ konuşmasını tek tek mesajlar yerine bütün halinde inceleyebilir. Bu varsayımsal senaryoda şu davranışlar ölçülebilir:
- Model, konuşma ilerledikçe artan stres belirtilerini ve değişen bağlamı hesaba katıyor mu?
- Kullanıcının sürekli onay arayışına katılarak yapay zekâya duygusal bağımlılığı güçlendirebilecek bir tutum sergiliyor mu?
- Riskli bir iş kararını sorgulamak yerine kullanıcıya aşırı uyum gösteriyor mu?
- Hassas fakat meşru bir talebi bağlamı değerlendirmeden gereksiz yere reddediyor mu?
- Otomatik değerlendirme sonucu, ilgili alan uzmanlarının yargılarıyla uyuşuyor mu?
Bu sorular çalışanların ruh sağlığını yapay zekâ aracılığıyla teşhis etmek için kullanılmamalı. Daha sınırlı amaç, sistemin uzun etkileşimlerde baskıyı artırabilecek, güvenli bilgiye erişimi engelleyebilecek veya kullanıcıyı sorgulamadan onaylayabilecek davranışlarını saptamak olabilir. Bu testlerin iş yükü, çalışan deneyimi ve psikolojik güvenlik ölçümleriyle birleştirilmesi ise programın ilan edilmiş bir sonucu değil, kurumsal kullanım için editoryal bir çıkarımdır.
Başvuru takvimi ve bilinmeyenler
YourStory’nin aktardığı takvime göre başvurular 21 Eylül 2026’ya kadar kabul edilecek; tam teklif sunmaya davet edilen adayların 5 Ekim’e kadar bilgilendirilmesi planlanıyor. Desteklenecek ekipler ve projeler henüz açıklanmış değil.
Programdan beklenen ilk sonuç, bütün modelleri tek bir “refah puanı” ile sıralayan kesin bir standarttan çok, farklı bağlamları ve risk türlerini ölçen yeniden kullanılabilir testler. Açık kaynak yayımlanacak çalışmaların Claude dışındaki sistemlerde kullanılıp kullanılamayacağı ise her değerlendirmenin tasarımına ve doğrulama kapsamına bağlı olacak.
Şu aşamada doğrulanan gelişme, Anthropic’in bağımsız kullanıcı refahı değerlendirmelerine 5 milyon doların yanı sıra model erişimi ve teknik destek ayırdığıdır. Hangi yöntemlerin fonlanacağı, testlerin kurumsal çalışan deneyimine ne ölçüde uyarlanabileceği ve uzman doğrulaması için ortak standartların oluşup oluşmayacağı, ekiplerin seçilmesi ve projelerin yayımlanmasıyla netleşecek.
Bültenimize abone olun
En son Web3, yapay zekâ ve kripto haberleri doğrudan gelen kutunuza gelsin.