OpenAI’nin yeni Astra modeli, çoğu akıl yürütme modelinin karakteristik özelliği olan ardışık düşünmenin dışına çıkmasını sağlayan “tekrarlayan derinlik” adında bir akıl yürütme tekniği kullanacak. Bu tekniğin, modelin düşünce zincirini izlemeyi zorlaştıracağı ifade ediliyor ve bu durum AI güvenlik uzmanlarını endişelendiriyor.
Uzmanlardan uyarılar geldi
Astra’nın bu tekniği kullanımının sınırlı olduğu belirtilse de, ortaya çıkışı AI güvenlik uzmanları arasında önemli kaygılara neden oldu. Redwood CEO'su Buck Shlegeris, “Astra'nın opak tekrarlama kullandığına dair raporlardan son derece endişeliyim” dedi. Shlegeris, OpenAI bu tekniği daha da ilerletirse, modelin düşünce zincirinin izlenebilirliğini büyük ölçüde azaltabileceğini vurguladı.
Gelecek için planlar yapılıyor
OpenAI, akıl yürütme modellerinin izlenebilirliğini sağlamak amacıyla geniş kapsamlı izleme sistemleri kurmayı planladığını duyurdu. OpenAI baş bilimcisi Jakub Pachocki, “OpenAI, ilk akıl yürütme modellerimizden bu yana düşünce zincirini koruma ve kullanma konusunda çalıştı” şeklinde açıklamada bulundu. Ancak, opak tekrarlamanın kullanımı arttıkça, AI akıl yürütmesini izlemenin zorlaşabileceği endişeleri devam ediyor.

