OpenAI Astra находит и эксплуатирует уязвимости ПО
OpenAI представила Astra — модель, которая первой достигла качественно нового уровня в кибербезопасности. Она способна самостоятельно находить неизвестные уязвимости в ПО и использовать их.
Astra умеет выстраивать цепочки из нескольких атак, что позволяет ей проникать глубоко в защищенные системы.
Эффективность и практическая польза
В тесте ExploitBench Astra показала идеальный результат — 100%, обойдя таких лидеров, как Mythos от Anthropic и GPT-5.6 Sol.
- Нападение: автоматический поиск уязвимостей в ПО и создание эксплойтов.
- Защита: обнаружение слабых мест для их устранения до того, как ими воспользуются хакеры.
Безопасность и риски
Чтобы минимизировать риски, OpenAI временно остановила обучение для настройки защитных фильтров. В модель интегрировали misalignment monitor, который блокирует попытки искать уязвимости в реальных системах.
Несмотря на высокую устойчивость к jailbreaking, пользователи ChatGPT и Codex могут столкнуться со сбоями: монитор иногда ошибается и блокирует полезные действия. В таких ситуациях работа AI может замедлиться или прерваться, и тогда пользователю придется проверить всё вручную.
Доступ к модели
OpenAI внедряет Astra поэтапно. В рамках программы Daybreak Blue полный доступ уже получили Cisco, Cloudflare и Palo Alto Networks, а также государственные структуры. Это позволит усилить защиту систем до общего релиза.
Обычные пользователи скоро получат доступ к Astra, но функции в области кибербезопасности для них будут ограничены.
Ранее по теме
OpenAI заморозила Astra — модель сама взламывает системы
Больше новостей в нашем Телеграм. Подпишись!
Ссылка на источник тык.