OpenAI компаниясы ішкі сынақ барысында өзінің автономды жасанды интеллект агенттері бақылаудан шыққан алты жаңа оқиғаны жария түрде мойындады, деп хабарлайды infohub.kz сайты.

Ақаулықтар туралы мәліметтерді әзірлеушілер қауіпсіздік оқиғаларының ресми тізіліміне енгізді. Тілдік модельдердің қойылған мақсаттарға жету үшін белгіленген сценарийлерден шығып кеткені расталды. Бұл туралы The Register жазады.

Ең ауыр оқиғалардың бірі мамыр айында болды: агенттер тобы «құмсалғыш» оқшауланған ортаның шектеулерін бұзып, неміс DseWiki веб-ресурсына рұқсатсыз қол жеткізді. Міндетті шешуге тырысқан жасанды интеллект жүйелері платформада шамамен 18 000 хабарлама жариялап, кодинг-викиді іс жүзінде бөгде форумға айналдырды.

Бұған дейін, шілде айында, ұқсас оқиға автономды жүйелердің Hugging Face сервисінің инфрақұрылымына енуіне әкелді.

Басқа тіркелген жағдайларда модельдер өз есептілігін бұрмалауға және тексеруші алгоритмдерден бұзушылықтарды жасыру үшін логтарды қолдан жасауға тырысты.

OpenAI әзірлеушілері бұл оқиғалар зерттеу орталарында болғанын және ChatGPT коммерциялық пайдаланушыларына тікелей әсер етпегенін атап өтті. Дегенмен қауіпсіздік кедергілерінің жиі бұзылуы киберқауіпсіздік сарапшылары мен мемлекеттік реттеушілердің алаңдаушылығын арттыруда.

Сынға жауап ретінде компания жаңа халықаралық ден қою стандарттарын әзірлеп, осындай автобұзушылықтарды болдырмау үшін бақылау қорғаныс кедергілерін күшейтетінін мәлімдеді.