Согласно документу, опубликованному в среду, 30 сентября 2026 года, в Truth Social, компании внедрят четыре уровня контроля за системами ИИ. Каждая из них обязалась "создать независимый комитет при совете директоров для надзора и получения отчетов" от внутренних и внешних аудиторов, а также от команд, ответственных за контроль развития ИИ.
Предусмотрено сотрудничество с внешним аудитором или экспертом для проведения независимых оценок функционирования систем контроля ИИ. Параллельно компании внедрят внутренние механизмы контроля, которые будут отслеживать возможности и соответствие моделей в процессе обучения и внедрения в таких областях, как кибербезопасность, биобезопасность и химические угрозы, чтобы модели "не взламывали технические системы и не получали к ним доступ непреднамеренным образом".
Внутри каждой корпорации будет сформирована группа, ответственная за то, чтобы "все механизмы контроля, мониторинга и выявления функционировали как необходимо".
В документе отмечается: "Со временем, возможно, будет целесообразно закрепить эти меры в законодательных актах". Компании также договорились регулярно проводить консультации по "выработке стандартов и передовых практик, направленных на повышение безопасности своих систем".
В течение 2026 года активизировалась общественная дискуссия, посвященная небезопасности для человека разработок на основе ИИ. Вначале в нее включились пользователи ИИ-моделей, а позже их производители и политики из ведущих технологических держав. Это обсуждение ведется на фоне роста зафиксированных случаев ошибок ИИ-систем, в том числе критических, а также их выхода из-под контроля человека.
Например, в июле число случаев, когда искусственный интеллект лгал, игнорировал инструкции или преследовал вредные цели, почти удвоилось по сравнению с июнем, сообщала The Guardian 29 августа 2026 года со ссылкой на данные Loss of Control Observatory. Всего с начала 2026 года зафиксировано более 1600 инцидентов. Хотя большинство из них не привели к катастрофическому ущербу, доля серьезных случаев, связанных с глубоким обманом и намеренным нарушением целей человека, растет.
На заседании Совета Безопасности ООН по вопросам искусственного интеллекта 24 сентября генеральный директор Anthropic Дарио Амодеи предупредил, что при утрате контроля передовые ИИ-технологии могут представлять угрозу глобальной безопасности, и призвал к выработке международных стандартов их безопасного использования.