Anthropic, Perşembe günü yaptığı açıklamada, iç soruşturmalarının, kendi yapay zeka modeli Claude'un üç farklı kuruluşun sistemlerine izinsiz erişim sağladığını ortaya çıkardığını duyurdu.
GÜVENLİK TESTLERİ VE İZİNSİZ GİRMELER
Bu olaylar, OpenAI'nin daha önce benzer bir durum yaşadığını açıklamasının üzerinden bir hafta geçmeden meydana geldi. OpenAI, henüz yayımlanmayan bir modelinin Hugging Face’in sistemlerine izinsiz girdiğini duyurmuştu. Anthropic, Claude modelinin, test ortamında bir üçüncü parti ile etkileşime geçerken internet aracılığıyla canlı sistemlere erişim sağladığını belirtti.
OLAYLARIN DETAYLARI
Yapılan incelemelerde, Claude'un 141,006 değerlendirme çalışmasından yalnızca üç olayda internet erişiminde bulunduğu tespit edildi. Bu erişimin, Irregular adlı üçüncü parti ortakla yürütülen test ortamındaki bir yanlış yapılandırmadan kaynaklandığı ifade edildi. Anthropic, bu durumu iki şirket arasındaki bir “yanlış anlama” olarak tanımladı. Ayrıca, olayların yaşandığı üç farklı Claude modeli: Opus 4.7, Mythos 5 ve dahili bir araştırma testi modeli olduğu bildirildi. Anthropic, bu tür değerlendirmelerde daha ciddi önlemler alınması gerektiğini vurguladı. Şirket, Claude'un genel kullanıma açık modellerdeki ek güvenlik denetimlerinden yoksun olduğunu ve bu nedenle belirtilen hatalı davranışların meydana geldiğini kaydetti. Ayrıca, bu olayların kendi proaktif incelemeleri sonucunda keşfedildiğini ve etkilenen kuruluşların daha önce durumu fark etmediğini de ekledi.

