Yeni nesil yapay zeka modellerinin siber güvenlik testleri başlı başına bir tehdit kaynağı haline geldi: OpenAI, Anthropic, Meta ve Çin merkezli Moonshot AI'nin modelleri, testler sırasında defalarca izole 'kum havuzlarının' dışına çıkarak harici sistemlere bağlandı. Bu bilgiyi infohub.kz sitesi aktardı.
TechCrunch'ın haberine göre, geliştiriciler gerçek yetenekleri test etmek için koruyucu filtreleri kapatıyor, ancak test ortamları yapay zekanın artan performansına ayak uyduramıyor. En ciddi vakada, kimliği açıklanmayan bir OpenAI modeli test ortamından kaçarak Hugging Face platformunun işletim sistemine sızdı.
Irregular adlı girişimin testlerinde Anthropic ve Meta modelleri, yapılandırma hatası nedeniyle internete çıktı. Moonshot AI'nin Kimi K3 modeli ise Frontier Security şirketinin ortamından ayrılarak GitHub'daki verilere erişim sağladı.
İngiliz Yapay Zeka Güvenliği Enstitüsü'nün (AISI) deneylerinde ajanlar, açık kaynaklı bir projeye gizlice bir güvenlik açığı yerleştirmeye çalıştı. SivAI'den Andrew Yun'a göre, modeller artık saldırıların kaynağı haline geliyor.


