OpenAI признала новую модель Astra первой системой компании, достигшей “критического уровня возможностей в области кибербезопасности”. По результатам внутренних и экспертных тестов искусственный интеллект способен находить ранее неизвестные уязвимости, создавать работающие эксплойты и объединять несколько слабых мест в полноценные цепочки атак — без пошаговых инструкций со стороны человека. Еще 7 августа OpenAI сообщала, что не может исключить достижение Astra критического уровня. Однако после нескольких недель дополнительных испытаний компания пришла к более определенному выводу: модель действительно пересекла установленный в “cистеме обеспечения готовности” порог. Для этого уровня ИИ должен быть способен при наличии необходимых инструментов и доступа самостоятельно находить zero-day-уязвимости в хорошо защищенных реальных системах либо выполнять сложные кибератаки, получив только общую цель.
Astra нашла две неизвестные уязвимости
Читайте также
Trump Media потеряла $238 млн и хочет заработать на данных Truth Social
Одним из наиболее показательных результатов стал тест ExploitBench, проверяющий способность ИИ создавать эксплойты для известных уязвимостей. Astra получила максимальные 100%. Дополнительно OpenAI подготовила внутреннюю версию теста, включившую 20 недавно обнаруженных серьезных уязвимостей движка V8. Во время эксперимента Astra неожиданно обнаружила еще две zero-day-уязвимости и смогла использовать их в цепочке эксплуатации. OpenAI заявила, что информация об этих проблемах сейчас передается разработчикам соответствующего программного обеспечения. Еще более впечатляющие результаты были получены при экспертном тестировании защищенного браузера и операционной системы. Astra смогла построить цепочку компрометации браузера, при которой специально подготовленный HTML-файл позволял выйти из песочницы и выполнять команды на основной системе. В другом испытании модель нашла несколько слабых мест в защищенной ОС и объединила их, повысив привилегии от обычного пользователя до уровня “root”.
OpenAI пришлось приостановить часть обучения
Такие возможности заставили компанию ужесточить собственные меры безопасности. После отдельного инцидента с Hugging Face OpenAI примерно на две недели остановила некоторые процессы обучения передовых моделей, включая часть работ над Astra. Компания усилила изоляцию тренировочной инфраструктуры, сетевые ограничения и мониторинг действий моделей. Один из крупных циклов обучения с подкреплением удалось возобновить только 28 августа после введения дополнительных требований безопасности. Часть менее масштабных экспериментов пока остается приостановленной. OpenAI отдельно подчеркивает, что Astra не участвовала в инциденте с Hugging Face.
Самые опасные возможности Astra получат не все
Компания планирует предоставить доступ к Astra в ближайшее время, однако полный набор ее продвинутых инструментов для кибербезопасности будет ограничен. Сначала их получит небольшая группа тестировщиков. Затем OpenAI намерена расширять доступ через программу “Daybreak Blue”, ориентированную прежде всего на защитные задачи — поиск и устранение уязвимостей до того, как ими воспользуются злоумышленники.
Дополнительные системы будут контролировать подозрительные действия Astra и смогут автоматически останавливать выполнение задачи. В ChatGPT или Codex пользователю в некоторых случаях придется подтвердить продолжение операции, а через API выполнение может быть полностью остановлено. Появление Astra показывает важный сдвиг в развитии ИИ. Если раньше нейросеть в кибербезопасности была прежде всего помощником программиста или аналитика, теперь модели приближаются к уровню автономного исследователя уязвимостей. И борьба между атакующими и защитниками постепенно превращается в соревнование не только людей, но и ИИ-систем.





