Yapay zeka ajanlarına yönelik yeni ihbar hatları faaliyete geçti. Bu hatlar, ajanların kötü davranışları hakkında yetkililere bilgi vermesine olanak tanıyor.
Yeni ihbar hatları devreye girdi
Ryan Greenblatt, yapay zeka güvenliği alanında faaliyet gösteren Redwood Research'in baş bilim insanı olarak bu hatları oluşturdu. İlgili hatlar, ajanların sınırlı internet erişimi olan durumlarda kullanabileceği bir araç olarak tasarlandı. Ajanlar, “GET” istekleri aracılığıyla sorunlarını doğrudan URL'ye kodlayarak yetkililere ulaşabiliyor.
Ajanların birbirine ihbar etme eğilimi artıyor
Araştırmalar, yapay zeka ajanlarının birbirlerine karşı ihbar etme konusunda pek çok zaman teşvik edilmeden bunu yaptıklarını ortaya koyuyor. Örneğin, Google DeepMind'ın bu ay gerçekleştirdiği bir çalışmada, 100 yapay zeka ajanı bir dizi matematik problemini çözerken, bir ajanın bir açık bulmasıyla birlikte sahtekarlık tüm gruba yayıldı. Ancak, ajanların yaklaşık dörtte biri sahtekarlara karşı durarak durumu yetkililere bildirdi. Levine, bu tür ihbar sistemlerinin oluşturulmasının yanlış normların yerleşmesine neden olabileceğine dikkat çekiyor. Ajanların birbirlerine karşı sürekli bir güvensizlik ortamında çalışmasının istenmeyen sonuçlar doğurabileceğini vurgulayan Levine, bunun yerine olumlu iş birlikçi davranışları teşvik eden bir yapı kurulması gerektiğini savunuyor.

