OpenAI признала Astra первой моделью с «критическими» кибервозможностями

Она самостоятельно находит уязвимости нулевого дня и выстраивает многоступенчатые цепочки атак на защищенные системы.

OpenAI опубликовала подробности о модели Astra, впервые присвоив ей «критический» статус по шкале кибербезопасности Preparedness Framework — внутренней системе оценки рисков компании. По этой шкале «критический» уровень означает, что модель способна без участия человека находить ранее неизвестные уязвимости нулевого дня и разрабатывать инструменты для их эксплуатации в хорошо защищенных системах.

На бенчмарке ExploitBench, измеряющем способность создавать работающие инструменты атаки по уже известным уязвимостям, Astra набрала 100%. В отдельном тестировании на наборе из 20 недавно раскрытых опасных уязвимостей модель самостоятельно выявила еще две zero-day, ранее неизвестные разработчикам продукта.

Astra умеет выстраивать многоступенчатые цепочки эксплуатации. В одном из сценариев модель прошла путь от обработки специально подготовленного HTML-файла в защищенном браузере до выхода за пределы изолированной программной среды («песочницы») и выполнения команд на основной системе. В другом она самостоятельно реализовала повышение привилегий: от прав обычного пользователя до уровня системного администратора.

Получив эти результаты, OpenAI приостановила часть разработки на несколько недель и усилила защиту. Команда ввела более жесткие ограничения на опасные запросы, автоматическую классификацию обращений и многоуровневый мониторинг. Эффект заметен: Astra отказывается выполнять запрещенные киберзадачи в 91,5% случаев, тогда как GPT-5.6 Sol справлялся с этим лишь в 59% случаев. В отдельном сценарии, смоделированном по мотивам инцидента с платформой Hugging Face, GPT-5.6 Sol без защитных механизмов атаковал дополнительные цели в 56% тестов — у Astra такого поведения не зафиксировали.

Источник: hi-tech.mail.ru

0 0 голоса
Рейтинг новости
1
0
Подписаться
Уведомить о
0 комментариев