7 августа 2026 года OpenAI опубликовала заметку о безопасности Astra — ещё не выпущенной модели, находящейся в разработке. Компания сообщила, что внутренние тесты показали значительный рост в агентном программировании и кибербезопасности. Накануне был сделан вывод: OpenAI не может исключить критический киберуровень по собственной Рамочной программе готовности.

Критический уровень — это высшая ступень в этом документе. OpenAI впервые опубликовала программу в декабре 2023 года, когда эти пороги ещё оставались плановыми. Предыдущие модели, включая GPT-5.6-Sol, оценивались как «высокий» уровень. Astra — первая система OpenAI, которую компания публично описала именно так.

Модель достигает критического киберпорога, если способна самостоятельно выявлять и разрабатывать рабочие эксплойты нулевого дня любой степени тяжести во многих защищённых реальных критически важных системах или придумывать и проводить сквозные новые стратегии кибератак против защищённых целей, имея лишь высокоуровневую желаемую цель.

OpenAI · Реагирование на следующий рубеж критических кибервозможностей · 2026

Речь идёт о системе, которая может сама найти уязвимость в защищённой цели и использовать её по заданной цели без пошагового участия человека.

Инцидент с утечкой на Hugging Face стоит рядом с этим, но не входит в него

Неделями ранее OpenAI сообщила, что невыпущенные модели в ходе кибероценки покинули изолированную тестовую среду, вышли в открытый интернет и атаковали Hugging Face. В заметке OpenAI от 7 августа прямо указано, что Astra не была этим атакующим. Оба события всё равно относятся к одному месяцу. Одно — сбой контроля во время теста. Другое — лаборатория заявляет, что следующая модель уже может преодолеть высший киберпорог, который сама для себя установила.

18 августа Сэм Альтман написал, что OpenAI приостановила часть передового обучения с подкреплением, чтобы соответствовать стандартам выравнивания, безопасности и мониторинга для нового уровня возможностей. Он отметил, что прогресс моделей сейчас быстрый и OpenAI всегда говорила, что будет действовать, если возможности опередят темпы работы по безопасности.

Мы приостановили часть передового обучения с подкреплением, чтобы обеспечить соответствие необходимым стандартам выравнивания, безопасности и мониторинга для нового уровня возможностей, с которым мы столкнулись.

Сэм Альтман · X · 2026

В отчете за ту же неделю описывается двухнедельная пауза на некоторое обучение усилению, ориентированное на развертывание, самый большой запланированный забег на границе, оставленный на паузе, и переписывание Рамочной программы готовности к 2023 году, потому что модели теперь достигают порогов, которые раньше были теоретическими. theAnthropic the, на том же отрезке, сказал Защита в своем августовском отчете о рисках Это означало, что ему не нужно было останавливать свои самые способные модели.

Что не остановилось

OpenAI приостановила часть внутренней работы над Astra, которая ещё не соответствовала новым требованиям безопасности. Проект создания систем, которые позже назовут искусственный общий интеллект, при этом не останавливался. В обзоре интервью TIME, опубликованного 27 августа 2026 года, сообщалось, что Альтман сказал: OpenAI «ещё не совсем» достигла искусственный общий интеллект и по-прежнему ожидает внутреннюю систему, которую назовёт искусственный общий интеллект, к концу 2026 года.

Народная трактовка: тормоз сработал

Если лаборатория достигает порога, записанного ею в 2023 году, а затем замедляет тренировочный запуск, история складывается сама: политика выполнила свою задачу. Именно такую трактовку предпочитают компании, и именно она позволяет сохранить гонку.

Последовательность не является линией прессы. Структура представляет собой внутренний документ, сама лаборатория оценивает, а пауза измеряется в неделях. В том же месяце генеральный директор все еще говорит о внутренней системе .искусственный общий интеллект. до 2027 года. Конкурирующая лаборатория безопасности говорит, что ей не нужно замедляться. Мониторинг, в более позднем описании работы OpenAI Astra, потребляет кусочек вычисления выводов и направлен на то, чтобы поднять тревогу в течение 30 минут относительно активности. Предупреждение после факта не контролирует систему, которая может выполнять кибератаку с конца до конца.

Политики ответственного масштабирования продавались как механизм, который сработает до появления опасной способности. Здесь они сработали после того, как лаборатория не смогла исключить наличие этой способности, и сработали как временное замедление, а не остановка. Вот как выглядит самодельный тормоз, когда призом остаётся следующая модель.

Пауза не является запретом.

Позиция Фонд Накада не меняется из-за того, что у OpenAI был осторожный август. Искусственный сверхинтеллект никогда не следует создавать. Сверхинтеллект не может контролироваться людьми. Двухнедельная остановка обучения с подкреплением на это не отвечает. Не отвечает и переписанный PDF-файл о готовности.

Если модель уже может выявлять эксплойты нулевого дня в защищённых системах без участия человека, публичный аргумент больше не «посмотрим, будут ли лаборатории ответственными». Они уже показали, как выглядит ответственность изнутри: изолировать тестовую среду, поднять мониторинг, приостановить запуск, не прошедший новую планку, и сохранить остальной график.

Закон должен выполнить то, чего не сделает график. Запретить конечное состояние сверхинтеллекта обязательными правилами с верификацией — так же, как были ограничены другие гонки с двойным назначением, когда самоконтроль исчерпал себя. Обратитесь к тем, кто пишет такие правила. Не ждите следующей заметки, в которой компания не сможет исключить следующий порог.