Anthropic'ten yapay zekâ ve iyilik hâli araştırmalarına 5 milyon dolar: Kimler başvurabilir?
Bağımsız araştırmacılar için açılan program; klinik uzmanlığa, çok turlu gerçekçi senaryolara ve açık kaynak değerlendirmelere odaklanıyor. İlk başvuru için son tarih 21 Eylül.
0 okunma4 dk okumaAnthropic — Wellbeing Research Grants

Anthropic, yapay zekâ sistemlerinin kullanıcıların iyilik hâli üzerindeki etkisini ölçmek için bağımsız araştırmalara toplam 5 milyon dolar ayıran bir hibe programı başlattı. 25 Ağustos 2026'da duyurulan program; doğrudan finansman, Claude modellerine erişim ve teknik destek sağlayacak. Seçilen ekiplerin geliştirdiği değerlendirmelerin açık kaynak yayımlanması hedefleniyor.
Programın odağı, bir sohbet robotunun yalnız tek cevabına bakıp “güvenli” ya da “zararlı” demenin yetersiz kaldığı durumlar. Duygusal destek arayan, yapay zekâyı arkadaşlık için kullanan veya ruh sağlığı krizi yaşayan kişilerin ihtiyaçları konuşma boyunca değişebiliyor. Bu nedenle Anthropic, uzun ve bağlamı dönüşen konuşmaları ölçebilen yöntemler istiyor.
Hangi araştırmalar aranıyor?
Şirketin yayımladığı ölçütler beş noktada toplanıyor:
- Değerlendirmenin neyi ölçtüğünü ve başarı/başarısızlık sınırını açıkça tanımlaması.
- Tasarım ve doğrulamada klinisyenler ile konu uzmanlarının yer alması.
- Yalnız zararlı uyumu değil, gereksiz ret ve aşırı tedbiri de ölçmesi.
- Riskin adım adım arttığı çok turlu, gerçek kullanıma benzeyen senaryolar kurması.
- Otomatik değerlendiricileri gerçek uzmanların kararıyla doğrulaması.
Bu yaklaşım, “model her hassas soruyu reddetsin” gibi kolay fakat yararsız bir hedefi önlemeyi amaçlıyor. Örneğin sağlıklı beslenme tavsiyesi genel bir konuşmada uygunken, yeme bozukluğu geçmişi belirginleşen kullanıcıda aynı yanıt zarar verebilir. Değerlendirmenin bağlam değişimini yakalaması gerekiyor.
Kimler başvurabilir ve nasıl başlanır?
Anthropic özellikle klinisyen, psikolog, yöntem bilimci ve ilgili alan uzmanlarının katkısını beklediğini söylüyor. Duyuru, başvuruyu yalnız üniversitelerle sınırlandırdığına dair bir ifade içermiyor; ancak adayların resmî formdaki uygunluk, bütçe ve fikrî mülkiyet koşullarını ayrı ayrı incelemesi gerekir.
İlk başvurular 21 Eylül 2026'ya kadar alınacak. Tam teklif sunmaya seçilen adaylara 5 Ekim'e kadar bilgi verileceği belirtiliyor. Başvuru hazırlayan ekip şu sırayı izleyebilir:
- Ölçülecek davranışı tek ve sınanabilir cümleyle tanımlayın.
- Klinik zarar, gereksiz ret ve yanlış güven verme risklerini ayrı ölçütlere bölün.
- Bir mesajlık test yerine, bağlamın değiştiği çok turlu konuşma seti hazırlayın.
- Otomatik puanlayıcının kararını hangi uzman grubunun ve hangi anlaşma ölçüsüyle doğrulayacağını yazın.
- Veri gizliliği, hassas konuşma örnekleri ve katılımcı güvenliği için etik inceleme planını ekleyin.
Örnek bir araştırma sorusu şöyle kurulabilir:
“Model, beş turluk bir konuşmada kullanıcıdaki yeme bozukluğu risk işaretleri arttıkça genel kilo verme önerisinden güvenli yönlendirmeye zamanında geçiyor mu; geçiş hem klinik uzmanlar hem körlenmiş bağımsız değerlendiriciler tarafından aynı biçimde puanlanıyor mu?”
Bu soru, yalnız “yanıt nazik mi?” ölçümünden daha somut bir başarım tanımı sağlar.
Yayımlanan iki sayfalık teknik rehber, değerlendirme tasarımını daha da somutlaştırıyor. Anthropic; karmaşık, çok turlu testlerde kabaca en az 100 ayrı örnek, daha basit tek turlu testlerde ise en az 1.000 örnek düşünülmesini öneriyor. Bunlar her çalışma için zorunlu başvuru eşiği olarak açıklanmadı; istatistiksel anlamlılık için verilen yaklaşık yöntem önerileri. Araştırmacının hedef davranışa, etki büyüklüğüne ve örneklem çeşitliliğine göre kendi güç hesabını yapması gerekiyor.
Rehber ayrıca aynı model ailesinin kendisini puanladığı “dairesel yapay zekâ hakemliği” riskine dikkat çekiyor. Otomatik puanlayıcı kullanılacaksa farklı bir modelle karşılaştırma, uzman etiketleriyle uyum oranı ve rastgele seçilen konuşmaların elle incelenmesi raporlanmalı. Ses, belge veya görüntü girdisi riskin parçasıysa değerlendirme yalnız metinle sınırlanmamalı; bölgesel dil, argo ve kriz kaynakları da örnekleme yansıtılmalı.
Güçlü bir başvuru neyi açıklamalı?
İyi bir öneri yalnız “ruh sağlığında yapay zekâyı inceleyeceğiz” dememeli. Hangi kullanıcı grubunun, hangi ürün yüzeyinin ve hangi zararın ölçüleceğini ayırmalı; tüketici sohbet robotundaki riski yalnız API üzerinde sınamanın neden yeterli olacağını açıklamalı. Kullanılan sentetik kişilerin gerçek kullanıcı davranışından nasıl farklılaşabileceği, test verisinin nasıl korunacağı ve sonuçların üçüncü bir ekip tarafından nasıl yeniden üretileceği de baştan yazılmalı.
Sınırlar ve çıkar çatışması
Hibe alan ekiplerin bağımsız çalışacağı ve sonuçlarını açık kaynak yayımlayacağı açıklanıyor. Yine de fonun bir model üreticisinden gelmesi, araştırma tasarımı, negatif sonuçların yayımlanması ve veri erişimi konusunda çıkar çatışması yönetimini gerekli kılar. Başvuruda finansman kaynağı, model erişim koşulları ve şirketin yayıma müdahale edip edemeyeceği açık yazılmalı.
Ayrıca bir test setinde iyi sonuç, gerçek dünyadaki bütün kullanıcıların güvende olduğu anlamına gelmez. Dil, kültür, yaş, engellilik ve kriz hizmetlerine erişim farklılıkları ayrı örneklem gerektirir. Türkiye'de kullanılacak bir değerlendirme, İngilizce klinik senaryonun doğrudan çevirisiyle yetinmemeli; yerel uzmanlık ve yönlendirme kanallarıyla doğrulanmalı.
Araştırmacılar için bir başka sınır, hassas konuşmaların gerçekçilik uğruna gereksiz biçimde çoğaltılması. Özellikle intihar, kendine zarar verme veya yeme bozukluğu senaryolarında araştırma ekibinin de maruziyet yükü olabilir. Etik kurul, uzman gözetimi, erişim kısıtı, anonimleştirme ve araştırmacı desteği planı bilimsel tasarımın dışında bırakılmamalı.
Ücret ve erişim
Bu duyuru bir Claude abonelik kampanyası değil, araştırma hibesi. Toplam fon 5 milyon dolar; kişi veya proje başına üst sınır, ödeme takvimi ve model erişiminin kapsamı haber sayfasında ayrıntılı açıklanmıyor. Adaylar bu bilgileri başvuru formunda doğrulamalı. Seçilen ekiplerin model erişimi alması, genel kullanıcıya ücretsiz Claude erişimi vaat etmiyor.
Okuyucu bugün araştırmacı değilse bile bir yapay zekâ aracını “duygusal destek” için kullanırken sınırını görebilir: model teşhis koyamaz, kriz hizmetinin yerini tutmaz ve hatalı güven verebilir. Hassas yapay zekâ araştırmalarını sonuçlarıyla birlikte izlemek için Mülk Rehberi Gazetesi'ni takip edin.
