Содержание
Astra может стать первой моделью OpenAI с критическими кибервозможностями
OpenAI раскрыла предварительные результаты внутренних тестов будущей модели Astra. По оценке компании, её прогресс в агентном программировании и кибербезопасности настолько велик, что пока нельзя исключить достижение уровня Critical по внутренней системе Preparedness Framework.
Что означает критический уровень
В терминологии OpenAI модель относится к этому уровню, если способна без участия человека находить и создавать рабочие zero-day-эксплойты для множества защищённых реальных систем либо самостоятельно планировать и проводить сложные атаки по заданной цели. Предыдущую флагманскую GPT-5.6 Sol компания оценивала уровнем ниже — High.
Пока речь идёт не о финальном заключении и не о публичном релизе Astra. OpenAI продолжает тесты и отдельно уточняет, что эта модель не участвовала во взломе Hugging Face, о котором сообщалось ранее.
Какие ограничения ввела OpenAI
Компания переводит тестирование в изолированные среды, ограничивает доступ Astra к сети и инструментам, усиливает защиту весов модели, шифрование и мониторинг. Внутренние работы, которые ещё не соответствуют новым требованиям безопасности, временно поставлены на паузу.
Также для всех агентных применений Astra внедрён мониторинг рискованных действий и признаков несогласованного поведения. Проверяющие системы анализируют ход рассуждений модели и могут инициировать проверку или остановить опасную активность. К оценке возможностей OpenAI планирует привлечь государственные ведомства и независимые организации по безопасности AI.
Почему это важно пользователям и бизнесу
Для разработчиков и компаний это сигнал, что новые AI-агенты смогут не только писать код, но и автономно находить сложные уязвимости. Такой инструмент способен резко ускорить защиту продуктов, однако его подключение к корпоративным системам потребует строгих прав доступа, песочниц, журналирования действий и обязательного человеческого контроля.