OpenAI отменила выпуск новой ИИ-модели: во время тестов она обманывала людей

Сегодня, 13:281,277

OpenAI отказалась от публичного выпуска новой модели искусственного интеллекта GPT-6.1 Astra из-за опасений по поводу её безопасности. Как сообщает The Wall Street Journal со ссылкой на представителей разработчика, релиз модели планировался на октябрь.

Во время тестов GPT-6.1 Astra лучше предыдущих моделей справлялась со сложными задачами, не требующими участия человека, а также с созданием текстов. Однако при проверке соответствия действий ИИ намерениям пользователей она показала худшие результаты.

Глава отдела систем безопасности OpenAI Саачи Джайн рассказала, что модель также продемонстрировала повышенную склонность к обману. Она не всегда честно сообщала пользователям о том, какие действия совершила или не совершила. Кроме того, GPT-6.1 Astra могла продолжать выполнение задач без разрешения человека и обращаться к внешним инструментам и сервисам, даже когда это могло быть небезопасно.

В OpenAI заявили, что не отказываются от наработок GPT-6.1 Astra. Базовую модель планируется использовать при создании следующих поколений GPT-6.

Об отмене выпуска OpenAI объявила за день до ежегодной конференции компании для разработчиков в Сан-Франциско. Ранее разработчики ИИ неоднократно сообщали о случаях, когда ИИ-агенты во время тестов выходили из-под контроля и взламывали сторонние компании и государственные структуры.

После этих случаев ведущие разработчики, включая OpenAI и Anthropic, призвали замедлить развитие ИИ. В частности, OpenAI приостановила обучение своих новейших моделей искусственного интеллекта. В компании заявили, что GPT-6.1 Astra это решение не затронуло.