Baseten, yapay zeka güvenliği alanında Hugging Face ve Goodfire AI ile ortaklık kurarak açık ağırlıklı modeller için güvenlik değerlendirme ve izleme altyapısı oluşturduğunu duyurdu. Bu adım, özellikle güvenlik önlemleri kaldırılarak tehlikeli hale getirilebilen açık ağırlıklı modellerin güvenliği hakkındaki tartışmaların ortasında geldi.
Açık model güvenliği standardı
Hugging Face gibi platformlarda 6.000'den fazla 'silinmiş' modelin bulunması, sorunun büyüklüğünü gözler önüne seriyor. Baseten'in araştırma kolu Base Labs, açık modellerin eğitimi ve izlenmesi için yöntemler geliştirecek ve yayınlayacak. Bu çalışma, modeller eğitilirken veya dağıtılırken şeffaf bir şekilde entegre edilecek bir güvenlik standardı olarak konumlandırılıyor. Şirket, X platformunda yaptığı açıklamada, “Açıklığın yapay zeka güvenliği için bir avantaj olduğuna inanıyoruz. Açıklık, modellerin davranışlarına daha fazla görünürlük sağlar ve en önemlisi, güvenlik araştırmalarını kapalı kaynaklara göre daha eyleme geçirilebilir ve şeffaf kontrollere dönüştürmek için daha fazla araç sunar” ifadelerini kullandı. Ortaklık teknik detayları açıklanmasa da, Goodfire'ın “Güvenlik açık modellere entegre edilmeli ve onları sunanlar tarafından sağlanmalıdır” şeklindeki açıklaması, Goodfire'ın bu süreçteki rolünü ima ediyor.

