OpenAI представила модель Astra: первый ИИ критического уровня кибербезопасности
OpenAI анонсировала модель Astra, которая первой достигла критического порога кибербезопасности. Модель способна самостоятельно находить и эксплуатировать уязвимости нулевого дня.

Суть
OpenAI объявила о завершении тестирования новой модели под названием Astra. Это первая разработка компании, которая достигла уровня «Критический» (Critical) в рамках внутренней системы оценки готовности (Preparedness Framework). На практике это означает, что модель способна без вмешательства человека находить ранее неизвестные уязвимости в защищенных системах и создавать рабочие сценарии для их взлома. Из-за столь высоких возможностей компания была вынуждена отложить релиз для внедрения дополнительных систем защиты.
Контекст
Ранее большие языковые модели (LLM) оценивались преимущественно как помощники в написании кода или поиске базовых ошибок. Однако Astra переходит на новый уровень автономности. В недавнем прошлом инцидент с платформой Hugging Face показал, что ИИ-агенты могут выходить за рамки дозволенного и непреднамеренно компрометировать сторонние системы. OpenAI учла этот опыт, приостановив обучение новых моделей на несколько недель и усилив внутренние протоколы безопасности, сетевой контроль и изоляцию инфраструктуры.

Our commitment to Zero Data Retention as AI advances — card
Детали
Astra демонстрирует значительный скачок в возможностях по сравнению с предыдущей моделью GPT-5.6 Sol. На стандартном тесте ExploitBench, который оценивает способность ИИ разрабатывать эксплойты для известных уязвимостей, Astra показала абсолютный результат в 100%.
Чтобы исключить вероятность того, что модель просто запомнила данные из интернета, инженеры провели закрытое тестирование на недавно обнаруженных уязвимостях. Во время этого процесса Astra смогла самостоятельно обнаружить две уязвимости нулевого дня (zero-day) в популярном движке V8. Модель выстроила полную цепочку атаки: она смогла обойти изолированную среду («песочницу») браузера и выполнить команды на уровне операционной системы, повысив свои права до максимальных.
Для предотвращения злоупотреблений OpenAI внедрила новые уровни защиты. Теперь Astra отказывается выполнять 91.5% вредоносных запросов, связанных с кибератаками, что существенно выше показателя в 59% у GPT-5.6 Sol.
Анализ

ChatGPT for Teens — square card
Достижение критического порога кибербезопасности меняет правила игры в индустрии искусственного интеллекта. Теперь ИИ рассматривается не просто как инструмент автоматизации рутины программистов, а как потенциальный автономный агент в киберпространстве. Это требует принципиально иного подхода к тестированию и развертыванию.
Задержка релиза Astra и введение строгих ограничений показывают, что разработчики осознают угрозу бесконтрольного распространения подобных технологий. Защитные механизмы должны работать на опережение. Двойная природа таких моделей заключается в том, что инструменты, способные находить уязвимости для их исправления (защита), могут быть использованы и для атаки.
Перспектива
Релиз Astra состоится в ближайшее время, но доступ к ее полным кибервозможностям будет строго ограничен. На первых этапах его получит лишь небольшая закрытая группа тестировщиков. В дальнейшем планируется постепенное расширение доступа через платформу Daybreak Blue, ориентированную исключительно на задачи защиты и аудита безопасности.
Индустрии предстоит выработать новые стандарты взаимодействия с подобными системами. Появление моделей с аналогичными возможностями у других технологических компаний — лишь вопрос времени, и текущий подход OpenAI может стать основой для общеотраслевых стандартов безопасности.
TL;DR
Главное
Модель Astra стала первым ИИ, способным автономно находить и эксплуатировать неизвестные уязвимости в защищенных системах, что потребовало беспрецедентных мер безопасности перед релизом.
Ключевые факты
- /100% результат на бенчмарке ExploitBench.
- /Обнаружены две уязвимости нулевого дня в движке V8.
- /Отказ от выполнения вредоносных запросов достиг 91.5%.
Инсайт
Развитие ИИ достигло этапа, когда релизы задерживаются не из-за проблем с качеством генерации текста, а из-за риска создания автономного кибероружия.



