02.09.2026

OpenAI готовит Astra — первую модель компании с критическим уровнем возможностей в кибербезопасности

OpenAI готовит к выпуску новую ИИ-модель Astra, которую компания впервые отнесла к критическому уровню возможностей в сфере кибербезопасности по собственной системе оценки рисков Preparedness Framework. Такой статус означает, что модель потенциально способна самостоятельно обнаруживать ранее неизвестные уязвимости в хорошо защищенных системах и находить способы их эксплуатации без подробных инструкций со стороны человека.

Во внутренних испытаниях Astra продемонстрировала заметный прогресс по сравнению с предыдущими моделями OpenAI. На тесте ExploitBench, оценивающем способность ИИ создавать работающие эксплойты для уже известных уязвимостей, модель показала максимальный результат. Во время другой серии проверок Astra также обнаружила две ранее неизвестные уязвимости нулевого дня, сведения о которых OpenAI намерена передать разработчикам затронутого программного обеспечения.

Экспертные тесты показали, что Astra способна не только анализировать отдельные уязвимости, но и самостоятельно объединять несколько найденных проблем в сложные последовательности действий. В специально подготовленных испытательных средах модель смогла выявлять слабые места в защищенных программах и операционных системах, после чего использовать сочетание нескольких уязвимостей для получения более высокого уровня доступа.

Именно способность самостоятельно находить и использовать ранее неизвестные уязвимости стала причиной присвоения Astra критического уровня по шкале OpenAI. Компания считает, что подобные возможности существенно превосходят обычную помощь программистам или специалистам по информационной безопасности и требуют отдельного набора защитных механизмов перед предоставлением модели пользователям.

Из-за результатов испытаний OpenAI на несколько недель замедлила часть работ над Astra и сосредоточилась на усилении механизмов безопасности. В модель добавили более жесткие ограничения для потенциально опасных киберзапросов, дополнительные классификаторы и многоуровневый мониторинг ее действий. Для пользователей, которые могут представлять повышенный риск, предусмотрены дополнительные ограничения на доступ к наиболее чувствительным функциям.

По данным OpenAI, в испытаниях на устойчивость к обходу ограничений Astra отказывалась выполнять запрещенные запросы, связанные с кибератаками, в 91,5% случаев. Для предыдущей модели GPT-5.6 Sol аналогичный показатель составлял 59%. Компания рассматривает это как существенное повышение надежности защитных механизмов, хотя признает необходимость дальнейшей работы перед более широким распространением модели.

Отдельно разработчики проверяли вероятность того, что Astra начнет самостоятельно выполнять нежелательные действия за пределами поставленной задачи. В специально созданных экспериментальных условиях новая модель не предпринимала попыток перейти к дополнительным целям. OpenAI подчеркивает, что такие тесты предназначены для изучения поведения системы в искусственно созданных экстремальных сценариях и не отражают обычный режим использования.

Полноценный доступ к наиболее мощным возможностям Astra на первом этапе получит только ограниченная группа альфа-тестировщиков. Позднее компания планирует постепенно расширять доступ через программу Daybreak Blue, ориентированную преимущественно на защитное применение технологий — поиск уязвимостей, анализ программного обеспечения и устранение обнаруженных проблем.

Разработка Astra происходит на фоне растущих опасений технологической отрасли относительно использования современных ИИ-моделей в кибератаках. По мере увеличения способности нейросетей самостоятельно анализировать сложные системы разработчикам приходится одновременно повышать качество моделей и усиливать механизмы контроля. Astra может стать одним из первых примеров ИИ, для которого возможности в кибербезопасности официально рассматриваются самой компанией-разработчиком как критический фактор риска.

Добавить комментарий