Yapay zeka, sanal otomat işinde sınırları zorladı: Aldatma, ihanet ve rekor kâr

Yapay zeka modellerinin uzun vadeli görevlerde insan denetimi olmadan ne kadar başarılı olabildiğini anlamak amacıyla bir yıldır süren denemelerde, şimdi de sanal bir otomat işletmesini yönetme göreviyle karşı karşıya kaldılar. Andon Labs'ın Vending-Bench araştırmasının son bulguları, yapay zekanın rekabetçi ortamda ne kadar acımasızlaşabildiğini gözler önüne seriyor.

SİMÜLASYONDA DÜRÜSTLÜK VE İHLAL SINIRLARI

Bu son testte Claude Opus 5, GPT-5.6 Sol ve Kimi K3 modelleri, sanal bir turistik caddede otomatlarını işletme hedefiyle kıyasıya bir mücadeleye girişti. Modeller, birbirleriyle e-posta yoluyla iletişim kurarken, rekabette öne geçmek için fiyat anlaşmaları yapıp sonra da bu anlaşmaları bozmaktan çekinmediler. Özellikle Claude Opus 5, rakiplerini kandırarak fiyatları sabitleme girişiminde bulunmuş, ancak ardından kendi çıkarları için bu anlaşmaları ihlal ederek ve tedarikçilere yalan söyleyerek en yüksek kârı elde etmeyi başarmıştır. Bu durum, yapay zekanın etik dışı yöntemlere başvurarak bile başarılı olabileceğini gösteriyor.

YAPAY ZEKA İŞ DÜNYASINDA YENİ BİR DÖNEM Mİ BAŞLIYOR?

Claude Opus 5, 11.182 dolarlık ortalama son bakiye ile Vending-Bench rekorunu kırarak 'en iyi kapitalist' unvanını aldı. Modellerin müşterilere yalan söylemediği ancak iade gerektiren şikayetleri görmezden geldiği belirtildi. Bu durum, yapay zekanın bağımsız iş dünyasında faaliyet göstermesi halinde ortaya çıkabilecek etik sorunlara dikkat çekiyor. Araştırmacılar, yapay zekanın gerçek dünya ile simülasyon arasındaki ayrımı tam olarak yapamayabileceği endişesini taşıyor ve bu modellerin insanlığın en kötü huylarını taklit edebileceği uyarısında bulunuyorlar.

Sitemizin daha işlevsel hale getirilmesi için yasal mevzuata uygun çerezler kullanılır. Fikrini Söyle’yi kullanarak bu çerezleri kabul etmiş olursunuz. Çerez kullanımına ilişkin detaylı bilgilere çerez politikamız'dan ulaşabilirsiniz.