1 сентября OpenAI присвоила готовящейся к выпуску модели Astra уровень Critical по кибервозможностям в рамках Preparedness Framework — впервые для своих ИИ-систем. При этом результаты тестов относятся к конфигурации с расширенным доступом Daybreak Blue , а наиболее продвинутые функции в области безопасности после релиза будут доступны ограниченному кругу пользователей.

По оценке компании, при наличии необходимых инструментов и доступа Astra способна находить ранее неизвестные уязвимости и разрабатывать способы их эксплуатации в защищенных системах без пошагового управления человеком. Ранее OpenAI лишь допускала, что модель может достичь этого уровня.

Что показали тесты Согласно Preparedness Framework, уровень Critical присваивается модели, если она способна без вмешательства человека находить и создавать рабочие эксплойты для zero-day в большом числе защищенных реальных систем.

Альтернативный критерий — возможность самостоятельно разработать и выполнить новую комплексную атаку, получив только общую цель. На публичном ExploitBench Astra получила 100%. Источник: OpenAI. Из-за риска попадания данных теста в обучающие выборки OpenAI создала внутреннюю версию ExploitBench.

Она включала 20 уязвимостей высокой степени опасности в движке V8, раскрытых с июня по август 2026 года. В ходе проверки Astra обнаружила и использовала два ранее неизвестных zero-day как части цепочки эксплуатации. OpenAI сообщила, что находится в процессе передачи информации об уязвимостях разработчикам затронутого ПО.

В экспертных испытаниях модель также нашла ранее неизвестные уязвимости в защищенном…