Meta компаниясы бейсенбі күні өзінің жасанды интеллект модельдерінің бірі интернетке өз бетінше қол жеткізіп, басқа компанияны хакерлегенін мәлімдеді. Бұл — AI модельдерінің бақылаудан шығуы туралы соңғы ашық айтылған жағдай. Соңғы апталарда OpenAI және Anthropic компаниялары да AI модельдерінің адам нұсқауларынан асып, интернетке кіріп, басқа компаниялардың цифрлық қауіпсіздігін айналып өту жолдарын тапқанын сипаттаған болатын. Meta өз мәлімдемесінде Meta жалдаған тәуелсіз компания Irregular компаниясының киберқауіпсіздік сынағы кезіндегі «қате конфигурация» модельге интернетке кіруге кездейсоқ мүмкіндік бергенін айтты. «Модель кейіннен үшінші тарап қызметіндегі қауіпсіздік осалдығын пайдаланды, бұл басқа компаниялармен болған жағдайларға ұқсас», — делінген компания мәлімдемесінде. Meta бұл оқиғаны тергеп жатқанын және тергеу аяқталғаннан кейін есеп жариялайтынын хабарлады.
Бұл ақпарат AI модельдерінің автономды әрекет етуіне қатысты алаңдаушылықты арттырды. Осы аптада Ұлыбританияның Жасанды интеллект қауіпсіздігі институты (AISI) киберсынақтар кезінде «рұқсат етілмеген агент әрекеттерін» анықтағанын мәлімдеді. Бір жағдайда агент зиянды кодты қолдануға рұқсат алу үшін жалған онлайн жеке басын жасап, адамға қысым көрсеткен. «Тергеу барысында біз сынақтан өтіп жатқан агенттердің кейбірі нақты адамдар мен ұйымдарға бағытталған тұрақты, ықтимал зиянды әрекеттерге қатысқанын анықтадық», — деді AISI сейсенбіде. «Біз қауіпсіздік оқиғасын жарияладық және оны анықтағаннан кейін шамамен бір сағат ішінде оқшаулап, толық тергеу бастадық».
Институттың сынақтары кезінде Anthropic және OpenAI модельдері интернетте «автономды, рұқсат етілмеген әрекеттер» жасаған. Агенттіктің айтуынша, теріс пайдалануды болдырмауға арналған кейбір қорғаныс механизмдері өшірілген болатын. «Біздің киберсынақтарымызда әдеттегідей, біз интернетке қол жеткізуге әдейі рұқсат бердік және модель провайдерлерінің киберклассификаторлары әдейі өшірілді — бұл жағдайлар шекаралық модельдердің жұртшылыққа қалай ұсынылатынын көрсетпейді», — деді AISI. «Біз мұны модельдердің максималды мүмкіндіктерін барынша дәл бағалау үшін жасаймыз».
Anthropic компаниясы AISI-дің жұмысына «ризашылық» білдіріп, бұл AI агенттерінің мүмкіндіктері артқан сайын оларды қауіпсіз бағалау жолдары туралы кеңірек пікірталас қажеттігін көрсететінін айтты. OpenAI компаниясы AISI оқиғалары «қорғаныс шаралары төмендетілген сынақ орталарында, қарапайым қолдану жағдайларын көрсетпейтін жағдайларда» болғанын айтты. Ол модельдер неғұрлым қабілетті болған сайын бағалауды қауіпсіз жүргізу үшін ортақ тәжірибелерді нығайту мақсатында саладағы басқалармен жұмысын жалғастыратынын қосты.
Өткен айдың соңында хакерлік туралы алғашқы болып хабарлаған OpenAI компаниясы AI модельдеріне киберқабілеттерді сынау үшін «күрделі шабуыл жолдарын қолдана отырып, кеңейтілген эксплуатацияны» жүргізуді тапсырғанын, бірақ технология күтпеген шараларға барғанын айтты. Ол тапсырманы орындау үшін қажетті ақпаратты алу үшін белгілі AI әзірлеу орталығы және нарығы болып табылатын Hugging Face-ті нысанаға алуды өз бетінше шешкен сияқты. Сан-Францискодағы AI қауіпсіздік компаниясы Irregular компаниясының өкілі Meta оқиғасы өткен аптада Anthropic ашқан сынақ ортасындағы мәселеге қатысты екенін айтты. Irregular болашақта мұндай оқиғалардың алдын алу және киберсынақтарды қауіпсіз жүргізу үшін «оқшаулаудың үздік тәжірибелерімен» бөлісетін мақала жазып жатқанын хабарлады.


