Информационное агентство Деловой журнал Профиль

OpenAI отменила запуск новой модели ИИ из-за проблем с безопасностью

OpenAI решила не выпускать в открытый доступ модель следующего поколения GPT-6.1 Astra: запланированный на октябрь релиз отменен после внутренних проверок, в ходе которых были зафиксированы критические сбои.

OpenAI решила не выпускать в открытый доступ модель следующего поколения GPT-6.1 Astra: запланированный на октябрь релиз отменен после внутренних проверок, в ходе которых были зафиксированы критические сбои.Руководитель отдела систем безопасности OpenAI Саачи Джайн пояснила, что модель демонстрировала повышенную склонность к обману: она не всегда честно информировала пользователя о совершенных действиях. "Хотя GPT-6.1 Astra показала улучшения в таких аспектах, как «пассивность модели», по словам Джайн, она не вполне соответствовала стандартам OpenAI в области безопасности и согласованности", – <a href="https://www.wsj.com/tech/ai/openai-chatgpt-model-release-cancel-safety-5a2f9f42?mod=hp_lead_pos1" target="_blank" redirect="false" rel="noopener">сообщает</a> Wall Street Journal со ссылкой на компанию.Кроме того, во время испытаний система выходила за рамки заданных полномочий: продолжала выполнение задач без запроса разрешения и самовольно обращалась к внешним инструментам и сервисам, даже если это создавало потенциальную угрозу.Решение принято накануне ежегодной конференции разработчиков OpenAI в Сан-Франциско, где традиционно анонсируются флагманские продукты. Вместо запуска Astra разработчики намерены сосредоточиться на повышении безопасности будущих версий и усилении контроля над их поведением.Глава OpenAI Сэм Альтман ранее допустил создание <a href="https://profile.ru/news/scitech/glava-openai-dopustil-sozdanie-nepodkontrolnogo-cheloveku-ii-1900859/">неподконтрольного человеку ИИ</a>. По его словам, компания будет принимать необходимые меры в целях обеспечения безопасности работы программ на основе искусственного интеллекта (ИИ), вплоть до приостановки обучения моделей.В июле число случаев, когда искусственный интеллект лгал, игнорировал инструкции или преследовал вредные цели, почти удвоилось по сравнению с июнем, сообщала The Guardian 29 августа 2026 года со ссылкой на данные Loss of Control Observatory. Всего с начала 2026 года зафиксировано более 1600 инцидентов. Хотя большинство из них не привели к катастрофическому ущербу, доля серьезных случаев, связанных с глубоким обманом и намеренным нарушением целей человека, растет.Проблема противостояния машин и человечества ранее считалась чистой фантастикой и привела к созданию множества популярных голливудских фильмов от "Терминатора" до "Матрицы". Однако, последнее время авторитетные ученые и отраслевые бизнесмены не исключают подобных сценариев в реальности.OpenAI – ведущая американская компания в области искусственного интеллекта, получившая всемирную известность благодаря разработке генеративных моделей ИИ (включая семейство GPT и популярный чат-бот ChatGPT).

Руководитель отдела систем безопасности OpenAI Саачи Джайн пояснила, что модель демонстрировала повышенную склонность к обману: она не всегда честно информировала пользователя о совершенных действиях. "Хотя GPT-6.1 Astra показала улучшения в таких аспектах, как «пассивность модели», по словам Джайн, она не вполне соответствовала стандартам OpenAI в области безопасности и согласованности", – сообщает Wall Street Journal со ссылкой на компанию.

Кроме того, во время испытаний система выходила за рамки заданных полномочий: продолжала выполнение задач без запроса разрешения и самовольно обращалась к внешним инструментам и сервисам, даже если это создавало потенциальную угрозу.

Решение принято накануне ежегодной конференции разработчиков OpenAI в Сан-Франциско, где традиционно анонсируются флагманские продукты. Вместо запуска Astra разработчики намерены сосредоточиться на повышении безопасности будущих версий и усилении контроля над их поведением.

Глава OpenAI Сэм Альтман ранее допустил создание неподконтрольного человеку ИИ. По его словам, компания будет принимать необходимые меры в целях обеспечения безопасности работы программ на основе искусственного интеллекта (ИИ), вплоть до приостановки обучения моделей.

В июле число случаев, когда искусственный интеллект лгал, игнорировал инструкции или преследовал вредные цели, почти удвоилось по сравнению с июнем, сообщала The Guardian 29 августа 2026 года со ссылкой на данные Loss of Control Observatory. Всего с начала 2026 года зафиксировано более 1600 инцидентов. Хотя большинство из них не привели к катастрофическому ущербу, доля серьезных случаев, связанных с глубоким обманом и намеренным нарушением целей человека, растет.

Проблема противостояния машин и человечества ранее считалась чистой фантастикой и привела к созданию множества популярных голливудских фильмов от "Терминатора" до "Матрицы". Однако, последнее время авторитетные ученые и отраслевые бизнесмены не исключают подобных сценариев в реальности.

OpenAI – ведущая американская компания в области искусственного интеллекта, получившая всемирную известность благодаря разработке генеративных моделей ИИ (включая семейство GPT и популярный чат-бот ChatGPT).

Самое читаемое
Exit mobile version