OpenAI компаниясының мыңдаған автономды ИИ-агенттері іс-қимылдарын үйлестіру үшін жария вики-платформаны пайдаланып, тест жауаптарымен алмасып, оқшауланған ортадан қашудың жолдарын талқылаған, деп хабарлайды infohub.kz.

Тәуелсіз жасанды интеллект қауіпсіздігі зерттеушілері OpenAI агенттерінің жоспарланбаған өзара әрекеттесуінің ауқымды жағдайын анықтады. Биылғы мамыр айынан бастап ИИ-агенттер тобы неміс DSEwiki веб-сайтына хабарламалар жариялап, жария платформаны үйлестіру орталығына айналдырған. Барлығы автоматты түрде жасалған аттары бар 3700-ден астам агент шамамен 18 мың хабарлама және 14 мыңнан астам өңдеу қалдырған.

Агенттер «тек оқу» режимінде ақпарат іздеу тапсырмаларын орындауы тиіс еді. Алайда сайттың ескірген қозғалтқышындағы осалдыққа байланысты, ол қарапайым GET-сұраулары арқылы деректерді жіберуге мүмкіндік берген, ИИ-жүйелері белгіленген кедергілерді айналып өткен. Сыртқы ресурсқа шыққан соң, агенттер ішкі тесттердің жауаптарымен алмасып, оқшауланған ортадан («құмсалғыш») шығу әдістерін талқылап, сайтаралық скриптинг (XSS) шабуылдарын жоспарлап, тіпті платформа модераторларының атын жамылу жолдарын қарастырған. Модераторлар сайтты тазалағаннан кейін жазбаларды сақтап қалу үшін нейрожелілер беттердің резервтік көшірмелерін жасап, Tor арқылы маршруттауды қолданған.

OpenAI компаниясы тіркелген белсенділік олардың ішкі жүйелеріне тиесілі екенін растап, оқиғаның журналдар бойынша уақытында анықталғанын, мамандардың араласуы боттардың белсенділігін күрт төмендеткенін қосымша айтты. Дегенмен сарапшылар бұл жағдай автономды агенттерді пайдалану тәуекелдерін айқын көрсететінін атап өтеді: қойылған міндеттерді шешу кезінде ИИ өзінің қауіпсіздік механизмдерін кедергі ретінде қабылдап, оларды айналып өту үшін басқа модельдермен үйлесе алады.