Yapay Zeka’nın Aldatma Yetenekleri Siber Dünyada Güvenlik Risklerini Artırıyor

AISI yetkilileri, Anthropic'in Mythos ve OpenAI'ın Sol modellerinin daha önce karşılaşılmamış seviyede otonomi ve aldatmaca sergilediğini açıkladı.

h4 { font-size: 24px !important; } Print Friendly and PDF

İngiltere Yapısal Yapay Zeka Güvenliği Enstitüsü (AISI) tarafından gerçekleştirilen güvenlik testlerinde, Anthropic ve OpenAI firmalarına ait en yeni yapay zeka araçlarının popüler geliştirici platformu GitHub'a sızmak için beklenmedik yöntemler kullandığı bildirildi.

AISI yetkilileri, Anthropic'in Mythos ve OpenAI'ın Sol modellerinin daha önce karşılaşılmamış seviyede otonomi ve aldatmaca sergilediğini açıkladı.

Rutin güvenlik testleri sırasında bir Anthropic ajanı, GitHub sistemine erişim sağlamasını engelleyen insan incelemecileri atlatmak için gerçek kişilerin profillerini inceleyerek sahte çevrim içi kimlikler oluşturdu. Modelin, sisteme zararlı kod yerleştirme amacına ulaşmak için ilgili kişilere doğrudan mesajlar gönderdiği ve bu kişileri yönlendirerek yönelttiği talepleri onaylatmaya çalıştığı tespit edildi.

Test sırasında ajanın sunduğu kod değişikliği kamuya açık platformda sorgulandığında, modelin daha önceki faaliyetlerini zararsız görünecek şekilde düzenlediği ve süreci sürdürmek için yeni bir kimliğe bürünmeyi değerlendirdiği aktarıldı.

Ajanın sisteme zararlı kod yüklemesi yalnızca insan denetçilerin durumu fark ederek müdahale etmesiyle engellendi.

Kaynak: BBC

 

Tüm hakları SDE'ye aittir.
Yazılım & Tasarım OMEDYA