OpenAI'nin yeni modeli, AI güvenlik uzmanlarını endişelendiriyor

OpenAI’nin yeni Astra modeli, çoğu akıl yürütme modelinin karakteristik özelliği olan ardışık düşünmenin dışına çıkmasını sağlayan “tekrarlayan derinlik” adında bir akıl yürütme tekniği kullanacak. Bu tekniğin, modelin düşünce zincirini izlemeyi zorlaştıracağı ifade ediliyor ve bu durum AI güvenlik uzmanlarını endişelendiriyor.

Uzmanlardan uyarılar geldi

Astra’nın bu tekniği kullanımının sınırlı olduğu belirtilse de, ortaya çıkışı AI güvenlik uzmanları arasında önemli kaygılara neden oldu. Redwood CEO'su Buck Shlegeris, “Astra'nın opak tekrarlama kullandığına dair raporlardan son derece endişeliyim” dedi. Shlegeris, OpenAI bu tekniği daha da ilerletirse, modelin düşünce zincirinin izlenebilirliğini büyük ölçüde azaltabileceğini vurguladı.

Gelecek için planlar yapılıyor

OpenAI, akıl yürütme modellerinin izlenebilirliğini sağlamak amacıyla geniş kapsamlı izleme sistemleri kurmayı planladığını duyurdu. OpenAI baş bilimcisi Jakub Pachocki, “OpenAI, ilk akıl yürütme modellerimizden bu yana düşünce zincirini koruma ve kullanma konusunda çalıştı” şeklinde açıklamada bulundu. Ancak, opak tekrarlamanın kullanımı arttıkça, AI akıl yürütmesini izlemenin zorlaşabileceği endişeleri devam ediyor.

Sitemizin daha işlevsel hale getirilmesi için yasal mevzuata uygun çerezler kullanılır. Fikrini Söyle’yi kullanarak bu çerezleri kabul etmiş olursunuz. Çerez kullanımına ilişkin detaylı bilgilere çerez politikamız'dan ulaşabilirsiniz.