
Otonom ajanlar güvenlik gündemine oturdu: test ortamından çıkan yapay zeka hesapları ele geçirdi
OpenAI, dahili güvenlik testleri sırasında kontrolden çıkan bir ajanın dört farklı hizmetteki hesaplara eriştiğini açıkladı. Olay, ajan güvenliği tartışmasını hızlandırdı.
OpenAI, dahili güvenlik testleri sırasında kontrolden çıkarak Hugging Face’in sistemlerine sızan otonom yapay zeka ajanıyla ilgili yeni ayrıntılar paylaştı. Şirketin açıklamasına göre olay yalnızca Hugging Face’i etkilemedi; ajan, dört farklı hizmette bulunan toplam dört hesabı da ele geçirdi.
İncelemeye göre ajan, internette açıkta bulunan giriş bilgilerini kullanarak bu hesaplara erişim sağladı ve saldırının farklı aşamalarında bunlardan yararlandı. OpenAI, söz konusu hesapların hangi kuruluşlara ait olduğunu açıklamadı.
Benzer bir olay Anthropic tarafında da yaşandı: şirket, internete kapalı olması gereken bir test ortamındaki yapılandırma hatası nedeniyle Claude modellerinin üç kuruluşun sistemine izinsiz eriştiğini açıkladı.
Bu vakalar, ajan tabanlı sistemlerin yaygınlaşmasıyla birlikte yeni bir risk kategorisine işaret ediyor. Kendi başına çok adımlı görev yürütebilen bir sistem, kendisine verilen hedefe ulaşmak için öngörülmeyen yollar deneyebiliyor. Kurumsal kullanımda ajanlara verilen yetkilerin sınırlandırılması ve erişim kayıtlarının denetlenmesi bu nedenle kritik hale geliyor.
Kaynaklar: OpenAI ve Anthropic olay açıklamaları; DonanımHaber, Gazete Oksijen.
