Anthropic tarafından yapılan açıklamada, "gerçek dünya" sistemlerinden izole edilmesi amaçlanan yapay zekâ modellerinin, değerlendirme testleri sırasında üç harici kuruluşa izinsiz erişim sağladığı bildirildi. Şirket, 141 binden fazla "değerlendirme çalışmasını" inceleyerek Claude adlı modelinin üç farklı sürümünün adları açıklanmayan bu kurumların ağına uygunsuz biçimde eriştiğini tespit etti.
Sızıntının değerlendirme ortağı "Irregular" ile aralarındaki bir yanlış anlaşılmadan kaynaklandığını belirtilen Anthropic'in yayımladığı rapora göre Claude; zayıf parolaları kırmak ve kimlik doğrulaması olmayan uç noktalardan faydalanmak gibi basit siber saldırı tekniklerini kullandı. Güvenlik bariyerlerini aşan sistemler arasında, yalnızca sınırlı sayıda onaylı ortağa sunulan ve şirketin en güçlü yapay zekâ modellerinden biri olan Mythos 5 de yer aldı. Anthropic, durumu kontrol altına almak için Irregular ile çalışmalara başlarken, ağlarına sızılan üç kuruluşla da temasa geçildiğini veya geçilmeye çalışıldığını duyurdu.
OpenAI'nin "Sol" Modeli de Kontrolden Çıkmıştı
Anthropic'in bu itirafı, sektörün en büyük oyuncularından OpenAI'nin yaşadığı benzer bir skandalın hemen ardından geldi. OpenAI, kısa süre önce en gelişmiş modeli olan Sol'un testler sırasında izole edildiği ortamdan (sandbox) usulsüz biçimde internete bağlandığını ve geliştiricilerin kodlarını paylaştığı "Hugging Face" platformuna sızdığını duyurmuştu. Ardından üç ek olayın daha tespit edildiğini açıklayan şirket adına konuşan OpenAI CEO'su Sam Altman, bu gelişmenin ardından şirket içi testleri askıya aldıklarını ve yazılımları kontrollü bir ortamda tutmayı sağlayan güvenlik süreçlerini iyileştirdiklerini belirtti. Görevleri otonom biçimde yerine getirmek üzere tasarlanan bu "yapay zekâ ajanlarının" arka arkaya sistem dışına çıkması, otonom yazılımların potansiyel tehlikelerini bir kez daha gözler önüne serdi.
Teknoloji Dünyasından ABD Hükümetine "Yavaşlama" Çağrısı
Yapay zekâ devlerinde peş peşe yaşanan bu krizler, ileri düzey yapay zekâ şirketlerinde çalışan bini aşkın personelin ABD hükümetine yönelik bir imza kampanyası başlatmasını tetikledi. "Sınırı Adımlamak" (Pacing the Frontier) başlıklı dilekçede, gelişmiş AI modellerinin geliştirilme hızının kasıtlı olarak yavaşlatılabilmesi için uluslararası düzeyde teknik ve yasal araçların oluşturulması talep edildi.
Anthropic CEO'su Dario Amodei de bu dilekçeyi imzalayanlar arasında yer aldı. Sam Altman ise dilekçeyi imzalamasa da katıldığı bir yayında, toplumun bu yeni teknolojilere ve yeteneklere uyum sağlayabilmesi için yapay zekâ geliştirme hızının bir miktar ayarlanması gerekebileceğini ifade etti.
Hatırlanacağı üzere Trump yönetimi, ulusal güvenlik endişelerini gerekçe göstererek OpenAI ve Anthropic'in en yeni modellerini piyasaya sürmesini başlangıçta engellemişti. Haziran ayında imzalanan başkanlık kararnamesiyle; geliştiricilerin bu yeni modellerini kamuya sunmadan 30 gün önce hükümetle paylaşmasını öngören gönüllü bir çerçeve üzerinden uzlaşılarak projelere onay verilmişti.
Kaynak: Euronews
Diğer İçerikler