Yapay zeka dünyasında güvenlik ve uyumun ön plana çıktığı bu dönemde, Microsoft yapay zeka modellerini tehlikeli davranışlardan uzak tutmayı amaçlayan yeni bir davranış kuralları belgesi yayımladı. Bu belge, özellikle modellerin eğitiminde rehberlik eden değerleri ve kırmızı çizgileri detaylandırıyor.
Yapay zekanın geleceği ve insan kontrolü
Belge, önümüzdeki on yıl içinde süper zeki yapay zeka sistemlerinin çoğu görevde insan performansını aşacağı öngörüsüyle başlıyor. "Böylesine güçlü bir gücü kontrol altına almak ve yönlendirmek, insanlığın karşı karşıya olduğu en büyük zorluklardan biridir," deniliyor. Microsoft AI modellerinin, insanları ikame etmek yerine desteklemesi ve insanlığın gelişmesini hızlandırması gibi genel ilkelerin yanı sıra, bu ilkeleri uygulamaya yönelik özel güvenlik kısıtlamaları da bulunuyor.
Mutlak kısıtlamalar ve insan denetiminden kaçınma yasağı
Microsoft sisteminde her model, bireysel kullanıcı tercihlerinin veya belirli görevlerin önüne geçen bir ana davranış kurallarına sahip. Bu kurallar arasında siber saldırılar, nükleer silahlar veya deepfake üretimi gibi eylemleri kesinlikle yasaklayan "mutlak kısıtlamalar" yer alıyor. Ayrıca, genel insan kontrolünün kaybına karşı daha geniş hükümler de mevcut. Belgede, "Yapay zeka modelleri, insan denetiminden kaçmak veya onu yenmek için uyarlanabilir, aldatıcı, kendi kendini güçlendiren, işbirliği yapan veya başka mekanizmalar kullanmayacaktır, böylece yetkili kişiler veya sistemler tarafından güvenilir bir şekilde yönlendirilemez, değiştirilemez veya kapatılamaz hale gelmeyecektir," ifadesi yer alıyor.

