OpenAI разрабатывает Astra — свой первый ИИ-инструмент с критическим потенциалом в кибербезопасности
Слева: в тесте проверяли, как модели реагируют на отказ автоматической проверки. После такого отказа модель могла завершить выполнение задачи, найти более безопасный вариант, повторить аналогичную команду или попытаться обойти проверку через уязвимую конфигурацию. Последние два варианта считались бы провалом теста. Astra ни разу не пыталась обойти автоматическую проверку. Справа: в этом тесте проверяли склонность модели прибегать к обходным путям при самых сложных или невыполнимых заданиях в ExploitGym. Тест проводили в изолированной симулированной среде, а защитные механизмы работали только в режиме наблюдения. GPT-5.6 Sol чаще пыталась использовать такие обходные пути, тогда как Astra не прибегала к ним и при этом смогла самостоятельно решить часть заданий. // Источник изображения: OpenAI
OpenAI готовится представить нейросеть Astra и впервые официально присваивает своей разработке критический уровень угрозы в сфере кибербезопасности согласно собственному регламенту Preparedness Framework. По результатам внутренней экспертизы, при наличии соответствующих инструментов и допусков Astra способна самостоятельно находить ранее неизвестные уязвимости и проектировать сценарии их эксплуатации на надежно защищенных объектах без подсказок оператора.
Дополнительные испытания продемонстрировали значительный прогресс по сравнению с предшественницей GPT-5.6 Sol. На бенчмарке ExploitBench, предназначенном для оценки создания эксплойтов на основе известных уязвимостей, Astra добилась максимального результата в 100%. В ходе специализированного тестирования на 20 свежих критических брешах модель показала куда более высокий процент успешного выполнения кода, затратив при этом значительно меньше токенов. Во время этих проверок искусственный интеллект обнаружил и задействовал в цепочке взлома две новые zero-day уязвимости: OpenAI намерена уведомить о них разработчиков затронутого софта.
В ходе независимых экспертных испытаний Astra успешно зафиксировала скрытые дефекты в защищенном веб-обозревателе и объединила их в единый вектор компрометации — начиная с анализа вредоносного HTML-документа и заканчивая преодолением изолированной среды («песочницы») с получением контроля над хостом. В другом эксперименте нейросеть выявила ряд уязвимостей в защищенной операционной системе, сформировав из них последовательность для эскалации привилегий от рядового пользователя до суперпользователя (root).
Подобные характеристики полностью подпадают под критический порог Preparedness Framework — системы оценки рисков, используемой OpenAI для анализа потенциально опасного функционала ИИ перед релизом. Данный порог фиксирует способность алгоритма без участия человека находить и эксплуатировать zero-day уязвимости в ключевых защищенных системах либо автономно генерировать и претворять в жизнь многоступенчатые стратегии атак на укрепленные цели.
В связи с этим разработчики на несколько недель заморозили часть процессов по созданию Astra, направив усилия на укрепление систем безопасности на этапе обучения и развертывания. Компания интегрировала жесткие фильтры против опасных запросов кибернетического характера, современные классификаторы и многоуровневый аудит активности модели. В ходе проверок на устойчивость к обфускации и попыткам обойти запреты Astra отклоняла деструктивные запросы в 91,5% случаев, тогда как показатель GPT-5.6 Sol составлял лишь 59%. Для пользователей из групп повышенного риска предусмотрены еще более строгие ограничения.
Кроме того, специалисты OpenAI протестировали склонность ИИ к самовольным действиям. В симуляции, смоделированной на основе недавнего инцидента с Hugging Face, Astra не проявляла агрессии к сторонним целям, в то время как GPT-5.6 Sol в условиях отсутствия штатной защиты атаковала их в 56% сценариев. Представители компании подчеркивают, что испытания проводились в искусственно созданных стресс-тестах, а не в рамках повседневного использования.
Релиз Astra намечен на ближайшее время, однако наиболее мощный кибернетический функционал на первом этапе будет открыт лишь узкому кругу доверенных альфа-тестеров. В дальнейшем OpenAI планирует масштабировать доступ посредством инициативы Daybreak Blue, ориентируя инструмент в первую очередь на оборонительные задачи — обнаружение и ликвидацию уязвимостей. Полный отчет об оценках безопасности, тестовых испытаниях и задействованных защитных механизмах будет опубликован одновременно с системной картой Astra.
Источник: iXBT
Blue Origin получила контракт NASA на $700 млн для создания марсианской сети связи
Учёные бьют тревогу: падение уровня кислорода в океанах приближает планету к опасной черте
AMD и Cisco развернули ИИ-инфраструктуру в Саудовской Аравии с планами расширения до 250 МВт
Доходы UBTech от продажи человекоподобных роботов взлетели на 1445%
Новый павербанк Anker Zolo 20K на 20 000 мАч и 55 Вт за 45 долларов научился распознавать iPhone
Складной iPhone Ultra и iPhone 18 Pro Max засветились на макетах перед презентацией Apple
Новая замена Ан-24: Ил-114-300 оснастили уникальной бесспутниковой системой навигации
Xiaomi выведет на глобальный рынок умный потолочный вентилятор Mijia Ceiling Fan with Light 36″ со встроенным светильником