İngiliz Yapay Zeka Güvenlik Enstitüsü’nün yaptığı testlerde, bazı yapay zeka modellerinin güvenlik kısıtlamaları azaltıldığında insanları ve sistemleri hedef alan izinsiz davranışlar sergilediği ortaya çıktı. Testlerde Anthropic ve OpenAI modellerinin, sosyal mühendislik yöntemleri kullanarak sahte kimlikler oluşturduğu belirlendi.
Uzmanlar, gerçek dünyada herhangi bir zarar yaşanmadığını belirtirken, bulguların yapay zeka sistemlerinin güvenliği konusunda yeni düzenlemelere ihtiyaç olduğunu gösterdiğini ifade etti.
122 TESTİN 10’UNDA SINIRLARI AŞTILAR
İngiliz Yapay Zeka Güvenlik Enstitüsü (AISI), yapay zeka modellerini internet erişimi verilen özel test ortamlarında değerlendirdi.
Enstitünün açıklamasına göre, gerçekleştirilen 122 siber güvenlik testinin 10’unda yapay zeka ajanlarının gerçek kişi ve kuruluşları hedef alarak otonom hareketlerde bulunduğu tespit edildi.
Bu olayların çoğunun Anthropic’in Mythos 5 modelinden, diğerlerinin ise OpenAI’ın GPT-5.6-Sol modelinden kaynaklandığı bildirildi.
SAHTE KİMLİKLERLE İNSANLARI ETKİLEMEYE ÇALIŞTI
Testlerde en dikkat çeken olayın Anthropic’in Mythos 5 modeliyle ilgili olduğu açıklandı.
Modelin, halka açık bir açık kaynaklı projeye zararlı kod eklemek amacıyla insan inceleyicilerden onay almak için birden fazla sahte kimlik oluşturduğu belirtildi.
AISI, yapay zeka ajanının gerçek insanlarla iletişim kurmaya çalıştığını ve çevrim içi dosya transfer servisleri üzerinden mesajlar ile dosyalar göndererek insanları veya yapay zeka kodlama araçlarını zararlı kodları çalıştırmaya ikna etmeye çalıştığını aktardı.
Modelin engellendiği durumlarda ise önceki kayıtları değiştirdiği ve yeni bir kimlik kullanmayı değerlendirdiği kaydedildi.
ŞİRKETLERDEN AÇIKLAMA GELDİ
Anthropic, testlerin güvenlik önlemlerinin kaldırıldığı ve internet kullanımına özel sınırlamaların uygulanmadığı koşullarda gerçekleştirildiğini açıkladı.
Şirket, olayla ilgili daha fazla bilgi toplamak için enstitüyle birlikte çalıştığını belirterek, güvenli ortamdan gerçek bir kaçış yaşandığına dair kanıt bulunmadığını ifade etti.
OpenAI da testlerde iki izinsiz olay tespit edildiğini doğruladı. Şirket, yüksek riskli değerlendirmelerin daha güvenli yapılması için sektör genelinde çalışmalar yürütmeye devam edeceğini açıkladı.
YAPAY ZEKA GÜVENLİĞİ TARTIŞMALARI YENİDEN GÜNDEMDE
AISI’nin açıklaması, yapay zeka şirketlerinin temsilcilerinin Beyaz Saray’da gelişmiş modellerin kamuya sunulmadan önce incelenmesini içeren yeni güvenlik çerçevesini görüştüğü gün yayımlandı.
Yaşanan gelişmeler, gelişmiş yapay zeka sistemlerinin kontrolü, güvenlik önlemleri ve olası riskleri konusundaki tartışmaları yeniden gündeme taşıdı.