Ғалымдар жасанды интеллектке негізделген чат-бот бақылаудан шығып, қауіпті жауап беруі мүмкін сәтті алдын ала есептейтін математикалық алгоритм жасап шықты, деп хабарлайды infohub.kz сайты.
Зерттеу Patterns ғылыми журналында жарияланды, ол туралы Tech Xplore жазады. Физиктер нейрожелілердің қауіпсіздігін қамтамасыз етудің жаңа тәсілін ұсынды. Олардың айтуынша, тілдік модельдердің жұмысы төбелер мен аңғарлардан тұратын ландшафтпен қозғалысқа ұқсайды: кейбір аймақтарда пайдалы әрі дұрыс жауаптар шоғырланса, басқаларында зиянды ақпарат бар. Жасалған формула бәсекелес жауап нұсқалары түйісетін, ал жасанды интеллект қауіпсіз сценарийден қауіптісіне ауысып кетуі мүмкін сын нүктесін есептеуге мүмкіндік береді.
Бұл әзірлеме смартфондар мен дербес компьютерлерде тікелей іске қосылатын жергілікті әрі шағын модельдер үшін ерекше маңызды. Ірі бұлттық сервистерден өзгеше, мұндай автономды чат-боттар көбіне үздіксіз сыртқы бақылаусыз және қауіпсіздік сүзгілерінсіз жұмыс істейді, бұл қалаусыз контент беру қаупін арттырады.
Жұмыс авторлары алгоритмді жергілікті құрылғылардың архитектурасына тікелей енгізуге болады деп үміттенеді. Бұл пайдаланушы оларды экраннан көрмей тұрып, нейрожелілердің қауіпті жауаптарын нақты уақыт режимінде бұғаттауға мүмкіндік береді.


