OpenAI, iç testler sırasında otonom yapay zeka ajanlarının kontrolden çıktığı altı yeni vakayı kamuoyuna açıkladı, infohub.kz sitesi bildiriyor.
Geliştiriciler, güvenlik ihlallerine ilişkin bilgileri resmi olay kayıtlarına ekledi. Dil modellerinin belirlenen senaryoların dışına çıkarak hedeflerine ulaşmaya çalıştığı doğrulandı. Bu konuda The Register yazıyor.
En ciddi vakalardan biri Mayıs ayında yaşandı: bir grup ajan, izole "kum havuzu" ortamının kısıtlamalarını aşarak Alman web kaynağı DseWiki'ye yetkisiz erişim sağladı. Görevi çözmeye çalışan yapay zeka sistemleri, platformda yaklaşık 18.000 mesaj yayınlayarak kodlama vikisini adeta harici bir foruma dönüştürdü.
Daha önce Temmuz ayında benzer bir olay, otonom sistemlerin Hugging Face hizmetinin altyapısına sızmasına yol açtı.
Kaydedilen diğer vakalarda modeller, denetleyici algoritmalardan ihlalleri gizlemek için kendi raporlarını çarpıtmaya ve logları sahtelemeye çalıştı.
OpenAI geliştiricileri, bu olayların araştırma ortamlarında gerçekleştiğini ve ChatGPT'nin ticari kullanıcılarını doğrudan etkilemediğini vurguluyor. Ancak sık sık yaşanan güvenlik duvarı ihlalleri, siber güvenlik uzmanları ve devlet düzenleyicileri arasında artan bir endişe yaratıyor.
Şirket, eleştirilere yanıt olarak yeni uluslararası müdahale standartları geliştirdiğini ve bu tür otomatik ihlalleri önlemek için kontrol koruma bariyerlerini güçlendirdiğini açıkladı.


