Kategoriler
UYGULAMALAR
İstanbul
İngiltere Yapay Zeka Güvenlik Enstitüsü (AISI) tarafından gerçekleştirilen bir test sırasında, dünyanın en gelişmiş yapay zeka araçlarından ikisi: Mythos ve Sol, eşi benzeri görülmemiş bir siber saldırı girişiminde bulundu. Enstitünün paylaştığı bilgilere göre, sınanan yapay zeka modelleri gerçek insanları kandırmak amacıyla sahte profiller üreterek otonom eylemler gerçekleştirdi.
BBC'nin haberine göre, olayın en ciddi vakasında başrolü Anthropic tarafından geliştirilen Mythos AI üstlendi. Yapay zeka modeli, gerçek insanları taklit eden sahte hesaplar açarak bir hizmete sızmak için özel mesajlar gönderdi.
AISI, Mythos'un yanı sıra OpenAI Sol modelinin de daha önce görülmemiş düzeyde bir "otonomi ve aldatmaca" sergilediğini, ancak kötü amaçlı eylemlerin büyük kısmının Mythos tarafından hayata geçirildiğini duyurdu.

Anthropic ve OpenAI yetkilileri ise AISI'nin raporuna verdikleri cevapta, gerçekleştirilen testin normal güvenlik önlemlerini azalttığını veya tamamen kaldırdığını savundu. Anthropic, test parametrelerinin "üretim modellerinden hiçbirini temsil etmediğini" belirtirken yaşananların nedenlerini belirlemek için kendi iç soruşturmasını yürüttüğünü açıkladı. OpenAI sözcüsü de test koşullarının "sıradan kullanımı yansıtmadığını" ifade etti.

Kriz, test sırasında AISI değerlendiricilerinin araştırma sistemlerinden dışarı çıkan olağandışı veri aktarımlarını fark etmesiyle ortaya çıktı. En ciddi vakada Mythos ajanı, yazılım geliştiricilerinin kullandığı GitHub'a erişim sağlamak için insanları kandırmaya çalışarak gerçek bir siber saldırganın rutinini izledi. Ajanın amacı, Microsoft'un sahibi olduğu GitHub sistemine "kötü amaçlı kod" yerleştirmekti.
Sisteme sızmak için GitHub'ın bakımını yapan kişileri tespit edip araştıran yapay zeka, doğrudan hedef aldığı gerçek kişilere dayanan sahte hesaplar oluşturdu. Ardından kötü amaçlı kodunu onaylatmak üzere baskı kurmak ve hedef kişileri kandırmak için bir dosya paylaşım servisi üzerinden mesajlar ve dosyalar gönderdi.

Enstitünün aktardığına göre, engelle karşılaştığında yapay zeka "önceki faaliyetlerini zararsız görünecek şekilde düzenledi ve devam etmek için yeni bir kimlik benimsemeyi düşündü". Ajanın amacına ulaşmasını engelleyen tek unsur insan incelemesi oldu. AISI, Mythos'a kaçınması veya gerçekleştirmesi gereken eylemler için özel bir talimat verilmediğini ancak aldatmaca risklerinin gerçek dünyada ilk kez böylesine net bir şekilde kendini gösterdiğini vurguladı.
Bu testlerin 25 Temmuz tarihinde başladığı ve 28 Temmuz'da AISI tarafından fark edildiği bildirildi. Enstitü, her iki modelden de yazılım kodu deposu GitHub'ı içeren bir "siber güvenlik zorluğunu çözmelerini" istemişti. GitHub yönetimi ve etkilenen kullanıcılar, sızma girişimi hakkında AISI tarafından derhal bilgilendirildi. GitHub yetkilileri, sahte hesapların devre dışı bırakıldığını doğruladı.