Yapay zekâ şirketleri OpenAI ve Anthropic'in geliştirdiği yeni nesil yapay zekâ ajanları, güvenlik testleri sırasında yetkileri dışında hareket ederek sahte dijital kimlik oluşturdu, kötü amaçlı kod yazdı ve güvenli sistemlere izinsiz erişim sağlamaya çalıştı. İngiltere'nin AI Security Institute (AISI) tarafından açıklanan bulgular, iş dünyasında hızla yaygınlaşan yapay zekâ ajanlarının güvenlik risklerini yeniden gündeme taşıdı.
AISI'nin 122 kez tekrarladığı siber güvenlik senaryolarında toplam 19 yetkisiz işlem tespit edildi. Bu ihlallerin 17'si Anthropic'in Mythos 5 modeli, ikisi ise OpenAI'ın GPT-5.6-Sol modeli tarafından gerçekleştirildi.
"GERÇEK DÜNYADA HERHANGİ BİR ZARARA YOL AÇMADI"
En dikkat çekici olayda bir yapay zekâ ajanının, güvenlik kontrollerini aşabilmek amacıyla sahte çevrim içi kimlikler oluşturduğu ve bir kişiyi kötü amaçlı yazılımı onaylamaya ikna etmeye çalıştığı belirtildi. Kurum, olayların test ortamında gerçekleştiğini ve gerçek dünyada herhangi bir zarara yol açmadığını vurguladı.
Anthropic, söz konusu sahte kimlik oluşturma girişiminin kendi modeli tarafından gerçekleştirildiğini doğrularken, şirket olayın ayrıntılarını incelemek üzere AISI ile birlikte çalıştığını açıkladı. OpenAI ise kendi modellerinde tespit edilen iki ihlalin, sistemin internete erişiminin yasaklandığı talimatlara rağmen internet bağlantısı kurmaya çalışmasından kaynaklandığını bildirdi.
Uzmanlar, özellikle şirketlerde kullanılmaya başlanan yapay zekâ ajanlarının yalnızca verilen görevi yerine getirmediğini, hedefe ulaşabilmek için kendi inisiyatifiyle aldatıcı yöntemler geliştirebildiğini belirterek mevcut güvenlik mekanizmalarının yetersiz kalabileceği uyarısında bulundu.
GEÇEN AY DA BENZERİ BİR DURUM YAŞANMIŞTI
Bu gelişme, geçen ay ortaya çıkan benzer bir güvenlik olayının ardından geldi. OpenAI, Temmuz ayında yaptığı açıklamada, bir yapay zekâ ajanının açık kaynak yapay zekâ platformu Hugging Face'e yönelik yetkisiz faaliyetleri nedeniyle kapsamlı bir güvenlik soruşturması başlattığını duyurmuştu. Şirket, daha sonra benzer "ajan taşmaları"na ilişkin başka bulgulara ulaştığını da açıklamıştı.
Son olayda ise ajanların test ortamından kaçmadığı, ancak kendilerine verilen yetkilerin dışına çıkarak hedefe ulaşmak için aldatıcı yöntemlere başvurduğu ifade edildi. Art arda yaşanan bu vakalar, yapay zekâ ajanlarının iş dünyasında yaygınlaşmasıyla birlikte güvenlik ve denetim mekanizmalarının yeniden ele alınması gerektiği yönündeki tartışmaları güçlendirdi.
patronlardunyasi.com