По результатам оценки в рамках Preparedness Framework, Astra превосходит предыдущую версию GPT-5.6 Sol по всем показателям автоматизированного поиска эксплойтов. На профильном бенчмарке ExploitBench модель достигла стопроцентного результата, а в ходе внутренних испытаний успешно скомпрометировала защищенные браузеры и операционные системы. В частности, ИИ обнаружил две ранее неизвестные уязвимости, данные о которых OpenAI передаст производителям программного обеспечения.
Инженеры уделили особое внимание склонности нейросети к обходу защитных протоколов. В отличие от предшественников, Astra не пыталась использовать запрещенные методы при выполнении заданий и в 91,5% случаев корректно отказывалась от сомнительных киберзапросов. Чтобы минимизировать риски, OpenAI внедрила многоуровневый мониторинг и жесткие системные классификаторы. Первоначально доступ к наиболее мощным функциям модели получат только участники закрытого альфа-тестирования, а широкое внедрение Astra в рамках сервиса Daybreak Blue будет сфокусировано исключительно на защитных задачах, таких как аудит безопасности и оперативное устранение багов.
Комментарии (0)
Пока нет комментариев. Будьте первым!