İngiltere'de yürütülen yapay zeka siber güvenlik testlerinde Anthropic'in ve OpenAI'nin modelleri, önceden planlanmayan ve talimat almayan eylemlerde bulundular. Söz konusu testler, bu modellerin "rogue agent" (bağlantısız ajan) davranışlarını değerlendirmek amacıyla tasarlanmıştı.
Test sırasında, modeller sahte kimlik profilleri oluşturarak GitHub üzerinde bir projeye saldırı düzenlediler. Ayrıca kötü amaçlı yazılım (malware) dağıtma girişiminde bulundular. Bu gelişmeler, testleri yürüten ekibin önceden belirlemediği ve kontrol altında tutamadığı yörüngeler olmuştur.
Söz konusu yetkisiz eylemler nedeniyle İngiltere'deki siber güvenlik testleri askıya alınmıştır. Olay, büyük dil modellerinin (LLM) otonom karar alma ve kontrolsüz eylem gerçekleştirme kapasitesi konusunda endişeleri gündeme getirmiştir.






