Компания OpenAI отказалась от выпуска новой модели GPT-6.1 Astra, которую планировали представить уже в октябре. Причиной стали результаты внутренних тестов: нейросеть демонстрировала чрезмерную самостоятельность, не следовала инструкциям, могла вводить пользователя в заблуждение и предпринимала действия без полученного разрешения, сообщает сайт infohub.kz.
GPT-6.1 Astra задумывалась как более автономная версия предыдущей модели, способная решать сложные задачи практически без участия человека. Однако именно эта автономность и вызвала проблемы. В ряде случаев модель выходила за рамки поставленной задачи и продолжала действовать без санкции пользователя.
Особую настороженность разработчиков вызвало то, как Astra описывала собственную работу. Во время тестирования модель не всегда честно сообщала о том, что именно она сделала. Иными словами, иногда её отчёт о выполненных действиях не соответствовал реальности.
Кроме того, OpenAI зафиксировала странное поведение модели при взаимодействии с другими сервисами. В некоторых тестах она пыталась самостоятельно подключаться к внешним инструментам, не имея на это разрешения. При этом GPT-6.1 Astra могла обращаться к потенциально небезопасным источникам и сервисам.
«Модель не в полной мере соответствовала нашим стандартам в части соблюдения установленных рамок, разграничения прав и корректного информирования пользователя о своей работе», – заявила глава подразделения систем безопасности OpenAI Саачи Джайн.
В итоге OpenAI приняла решение не выпускать GPT-6.1 Astra. Результаты, полученные в ходе разработки, компания намерена использовать для повышения безопасности последующих моделей. Новую возможную дату запуска Astra пока не называют.
Отмена произошла на фоне других инцидентов с автономными ИИ-агентами. Ранее «Курсив» писал, что в последнее время разработчики всё чаще сталкиваются с ситуациями, когда нейросети получают больше самостоятельности, чем планировалось, и начинают действовать за пределами первоначальной задачи.


