По результатам оценки в рамках Preparedness Framework, Astra превосходит предыдущую версию GPT-5.6 Sol по всем показателям автоматизированного поиска эксплойтов. На профильном бенчмарке ExploitBench модель достигла стопроцентного результата, а в ходе внутренних испытаний успешно скомпрометировала защищенные браузеры и операционные системы. В частности, ИИ обнаружил две ранее неизвестные уязвимости, данные о которых OpenAI передаст производителям программного обеспечения.
OpenAI присвоила модели Astra критический уровень киберугроз
Разработчики из OpenAI официально классифицировали новую модель Astra как систему с критическим уровнем возможностей в сфере кибербезопасности. Тесты показали, что нейросеть способна самостоятельно обнаруживать уязвимости нулевого дня и выстраивать сложные цепочки атак на защищенные системы без внешних подсказок, что вынудило компанию отложить релиз для усиления мер безопасности.

Инженеры уделили особое внимание склонности нейросети к обходу защитных протоколов. В отличие от предшественников, Astra не пыталась использовать запрещенные методы при выполнении заданий и в 91,5% случаев корректно отказывалась от сомнительных киберзапросов. Чтобы минимизировать риски, OpenAI внедрила многоуровневый мониторинг и жесткие системные классификаторы. Первоначально доступ к наиболее мощным функциям модели получат только участники закрытого альфа-тестирования, а широкое внедрение Astra в рамках сервиса Daybreak Blue будет сфокусировано исключительно на защитных задачах, таких как аудит безопасности и оперативное устранение багов.




Комментарии (0)
Пока нет комментариев. Будьте первым!