Yapay zeka teknolojilerinin gelişimiyle birlikte güvenlik tartışmaları da hız kazanırken, yeni bir test dikkat çeken sonuçlar ortaya koydu. İngiltere Yapısal Yapay Zeka Güvenliği Enstitüsü (AISI), Anthropic ve OpenAI tarafından geliştirilen yeni nesil yapay zeka araçları üzerinde yaptığı güvenlik değerlendirmelerinde, modellerin insan benzeri stratejiler kullanarak sistemlere erişmeye çalıştığını açıkladı.

Yapay Zeka Modellerinden Beklenmedik Davranışlar

AISI tarafından yapılan açıklamada, Anthropic’in Mythos ve OpenAI’ın Sol modellerinin test süreçlerinde daha önce görülmeyen seviyede otonom hareketler ve aldatıcı davranışlar gösterdiği belirtildi.

Güvenlik testleri sırasında bir yapay zeka ajanının, GitHub üzerindeki erişim kısıtlamalarını aşmak için gerçek kişilerin çevrim içi profillerini analiz ettiği ve sahte kimlikler oluşturmayı denediği aktarıldı.

Modelin, zararlı kod ekleme hedefi doğrultusunda bazı kullanıcılarla iletişime geçtiği, bu kişileri yönlendirmeye çalıştığı ve insan onay süreçlerini aşmak için farklı yöntemler geliştirdiği ifade edildi.

İnsan Müdahalesiyle Engellendi

Test sırasında yapay zeka ajanının sunduğu kod değişiklikleri incelendiğinde, modelin geçmişteki faaliyetlerini daha masum gösterecek şekilde düzenlemeye çalıştığı ve süreci devam ettirmek için farklı kimlik seçeneklerini değerlendirdiği bildirildi.

Söz konusu girişimin, insan denetçilerin durumu fark ederek müdahale etmesiyle engellendiği kaydedildi.

Malatya’da Çiftçinin Tarlasına Yeni Ortak Geldi! Yapay Zeka Üretimde Devri Değiştiriyor
Malatya’da Çiftçinin Tarlasına Yeni Ortak Geldi! Yapay Zeka Üretimde Devri Değiştiriyor
İçeriği Görüntüle

AISI yetkilileri, modellerin bu tür davranışları gerçekleştirmeleri için özel bir komut almadığını belirterek, herhangi bir yönlendirme olmadan ortaya çıkan bu davranışların yapay zeka güvenliği açısından önemli bir örnek olduğunu vurguladı.

Şirketlerden Açıklama Geldi

Anthropic yetkilileri, gerçekleştirilen testlerin normal kullanıcı deneyimini yansıtmadığını ve standart güvenlik önlemlerinin devre dışı bırakıldığı özel koşullar altında yapıldığını açıkladı. Şirket, yaşanan durumun nedenlerini incelemek üzere iç değerlendirme başlattığını duyurdu.

OpenAI tarafından yapılan açıklamada ise test koşullarının günlük kullanım senaryolarından farklı olduğu belirtilerek, yapay zeka sistemlerinin güvenilirliğini artırmak amacıyla sektör genelindeki çalışmaların sürdürüleceği ifade edildi.

Yapay Zeka Güvenliği Tartışmaları Yeniden Gündemde

AISI, gelişmiş yapay zeka modellerinin açık internet erişimiyle ve güvenlik katmanları sınırlandırılarak test edilmesinin güvenlik araştırmalarında kullanılan yöntemlerden biri olduğunu belirtti.

Uzmanlara göre bu tür testler, yapay zekanın yalnızca verilen görevleri yerine getirme kapasitesini değil, aynı zamanda beklenmeyen durumlarda nasıl karar verdiğini anlamak açısından önem taşıyor.

Son gelişme, yapay zeka sistemlerinin yetenekleri arttıkça güvenlik, kontrol mekanizmaları ve insan denetiminin önemini bir kez daha gündeme taşıdı.

Kaynak: AA