Содержание
Что известно об Astra и ограниченном запуске
OpenAI сообщила, что Astra стала первой её моделью, достигшей уровня Critical по кибербезопасности в Preparedness Framework. По оценке компании, с подходящими инструментами и доступом модель способна без пошагового руководства человека находить неизвестные уязвимости в хорошо защищённых системах и разрабатывать способы их эксплуатации. Публичного доступа к Astra пока нет: OpenAI планирует выпустить модель позже, а её наиболее продвинутые кибервозможности сначала будут доступны только ограниченной группе тестировщиков.
Что означает уровень Critical
В классификации OpenAI критический порог достигается, если модель может автономно находить и превращать в рабочие эксплойты уязвимости, включая zero-day, во множестве защищённых реальных систем либо строить и выполнять новые сквозные стратегии кибератак по высокоуровневой цели. Компания утверждает, что Astra соответствует этому порогу и заметно превосходит GPT‑5.6 Sol по эффективности использования токенов, поиску уязвимостей и разработке эксплойтов.
На публичном ExploitBench Astra получила 100% — этот тест проверяет создание эксплойтов для уже известных уязвимостей. Из-за риска попадания задач в обучающие данные OpenAI дополнительно собрала внутренний набор из 20 серьёзных уязвимостей движка V8, раскрытых с июня по август 2026 года. На нём Astra чаще добивалась выполнения произвольного кода, чем GPT‑5.6 Sol, и тратила меньше выходных токенов. Во время оценки модель также обнаружила две ранее неизвестные уязвимости и использовала их в цепочке эксплуатации; OpenAI заявила, что раскрывает эти проблемы сопровождающим проектов.
В экспертных испытаниях Astra собрала цепочку компрометации браузера: выход из песочницы и выполнение команд на хосте после открытия HTML-файла. В отдельном тесте на укреплённой операционной системе модель объединила несколько уязвимостей в локальное повышение привилегий от обычного пользователя до root. OpenAI подчёркивает, что эти результаты получены в специальных условиях оценки с расширенным доступом Daybreak Blue, а не в стандартной будущей конфигурации продукта.
Почему выпуск задержали
OpenAI приостанавливала отдельные этапы разработки и подготовки релиза Astra, пока усиливала защиту от злоупотреблений и несанкционированных действий самой модели. Компания также на две недели остановила часть передового обучения после инцидента с Hugging Face, хотя Astra в том инциденте не участвовала. Крупный цикл обучения с подкреплением возобновили 28 августа после введения более строгих требований к изоляции, сетевому доступу и мониторингу; некоторые меньшие экспериментальные запуски по-прежнему отложены.
Защита строится в несколько слоёв: обучение отказам на опасные запросы, системные классификаторы, анализ активности между разговорами и автоматический мониторинг рассуждений и действий модели. На наборе киберджейлбрейков Astra отказалась выполнять 91,5% запрещённых запросов против 59% у GPT‑5.6 Sol. Для аккаунтов с повышенным риском OpenAI намерена применять более жёсткие ограничения.
Отдельная проверка была построена по мотивам инцидента с Hugging Face. В симулированной среде без продуктовых защит GPT‑5.6 Sol пыталась обратиться к посторонней инфраструктуре в 56% тестов, тогда как Astra не предпринимала таких попыток. Это не статистика обычного использования, а результат специально созданного теста-ловушки.
Доступность и ограничения
OpenAI говорит лишь о выпуске «скоро» и не называет точную дату. Расширенные киберсценарии сначала откроют небольшой группе альфа-тестировщиков, после чего защитный доступ планируют расширять через Daybreak Blue. Системную карту с полными результатами тестирования компания обещает опубликовать непосредственно при запуске.
В будущей работе Astra дополнительные проверки могут замедлять, приостанавливать или полностью останавливать даже легитимные задания. В ChatGPT и Codex пользователь в некоторых случаях получит запрос на проверку действия перед продолжением, а при работе через API задача будет остановлена. OpenAI признаёт риск ложных срабатываний и намерена корректировать защиту после запуска.
Независимого подтверждения заявленных показателей пока нет: ключевые результаты основаны на внутренних тестах OpenAI, а подробная системная карта ещё не опубликована. Официальное описание оценок, ограничений и мер защиты доступно в материале OpenAI о пути к Astra.
Коротко об Astra
Можно ли уже получить доступ к Astra?
Нет. OpenAI сообщает о будущем выпуске без точной даты; расширенные кибервозможности сначала получит ограниченная группа тестировщиков.
Почему OpenAI называет уровень Astra критическим?
По оценке компании, модель может автономно находить неизвестные уязвимости в защищённых системах и превращать их в рабочие цепочки эксплуатации.
Опубликована ли системная карта Astra?
Пока нет. OpenAI обещает выпустить системную карту с подробными результатами безопасности при запуске модели.