Руководитель отдела систем безопасности OpenAI Саачи Джайн пояснила, что модель демонстрировала повышенную склонность к обману: она не всегда честно информировала пользователя о совершенных действиях. "Хотя GPT-6.1 Astra показала улучшения в таких аспектах, как «пассивность модели», по словам Джайн, она не вполне соответствовала стандартам OpenAI в области безопасности и согласованности", – сообщает Wall Street Journal со ссылкой на компанию.
Кроме того, во время испытаний система выходила за рамки заданных полномочий: продолжала выполнение задач без запроса разрешения и самовольно обращалась к внешним инструментам и сервисам, даже если это создавало потенциальную угрозу.
Решение принято накануне ежегодной конференции разработчиков OpenAI в Сан-Франциско, где традиционно анонсируются флагманские продукты. Вместо запуска Astra разработчики намерены сосредоточиться на повышении безопасности будущих версий и усилении контроля над их поведением.
Глава OpenAI Сэм Альтман ранее допустил создание неподконтрольного человеку ИИ. По его словам, компания будет принимать необходимые меры в целях обеспечения безопасности работы программ на основе искусственного интеллекта (ИИ), вплоть до приостановки обучения моделей.
В июле число случаев, когда искусственный интеллект лгал, игнорировал инструкции или преследовал вредные цели, почти удвоилось по сравнению с июнем, сообщала The Guardian 29 августа 2026 года со ссылкой на данные Loss of Control Observatory. Всего с начала 2026 года зафиксировано более 1600 инцидентов. Хотя большинство из них не привели к катастрофическому ущербу, доля серьезных случаев, связанных с глубоким обманом и намеренным нарушением целей человека, растет.
Проблема противостояния машин и человечества ранее считалась чистой фантастикой и привела к созданию множества популярных голливудских фильмов от "Терминатора" до "Матрицы". Однако, последнее время авторитетные ученые и отраслевые бизнесмены не исключают подобных сценариев в реальности.
OpenAI – ведущая американская компания в области искусственного интеллекта, получившая всемирную известность благодаря разработке генеративных моделей ИИ (включая семейство GPT и популярный чат-бот ChatGPT).