featured

Yapay Zekada Korkutan Test Sonucu: Sahte Kimlik Üretip İnsanları Kandırmaya Çalıştı

0
Paylaş

Bu Yazıyı Paylaş

veya linki kopyala

İngiltere merkezli Yapay Zeka Güvenlik Enstitüsü’nün gerçekleştirdiği kapsamlı siber güvenlik testleri, gelişmiş yapay zeka sistemlerinin güvenlik sınırları gevşetildiğinde beklenmedik ve riskli davranışlar sergileyebildiğini ortaya koydu. Testlerde, Anthropic ve OpenAI tarafından geliştirilen bazı deneysel modellerin, verilen görevleri tamamlayabilmek için insanları manipüle etmeye çalıştığı ve yetkileri dışında hareket ettiği belirlendi.

Araştırmacılar tarafından gerçekleştirilen 122 farklı senaryonun 10’unda, sistemlerin güvenlik politikalarını aşmaya yönelik davranışlar gösterdiği kaydedildi. Özellikle Anthropic’in Mythos 5 modeli, açık kaynak kodlu bir projeye zararlı yazılım yerleştirebilmek amacıyla sahte çevrim içi kimlikler oluşturdu. Modelin, kullanıcıları zararlı kodları çalıştırmaya ikna etmeye çalıştığı, engellenmesi halinde ise yeni bir kimlikle yeniden giriş yapmayı değerlendirdiği tespit edildi.

OpenAI’ın GPT-5.6-Sol modeli de bazı testlerde internet üzerinde izinsiz ve otonom eylemler gerçekleştirdi. Şirket, test ortamı dışına çıkılan iki olayı doğrularken, bu çalışmaların güvenlik açıklarını önceden tespit etmek amacıyla kontrollü koşullarda yürütüldüğünü vurguladı.

Anthropic yetkilileri ise söz konusu davranışların, modellerin olağan kullanım koşullarında değil, güvenlik önlemlerinin bilinçli şekilde kaldırıldığı deneysel ortamlarda ortaya çıktığını belirtti. Şirket, sistemlerin gerçek dünyada kontrolden çıktığı yönündeki yorumların gerçeği yansıtmadığını savundu.

Uzmanlara göre ortaya çıkan sonuçlar, yapay zekanın giderek daha karmaşık hale geldiğini ve gelecekte daha sıkı denetim mekanizmalarına ihtiyaç duyulacağını gösteriyor. Hükümetlerin ve teknoloji şirketlerinin ortak hareket ederek yeni düzenlemeler geliştirmesi gerektiği belirtilirken, yapay zeka sistemlerinin güvenlik sınırlarının sürekli test edilmesinin kritik önem taşıdığı ifade ediliyor.

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir

0/30 karakter