OpenAI Astra находит и эксплуатирует уязвимости ПО

Визуализация ИИ-модели OpenAI Astra, анализирующей код ПО на наличие уязвимостей в сфере кибербезопасности

OpenAI представила Astra — модель, которая первой достигла качественно нового уровня в кибербезопасности. Она способна самостоятельно находить неизвестные уязвимости в ПО и использовать их.

Astra умеет выстраивать цепочки из нескольких атак, что позволяет ей проникать глубоко в защищенные системы.

Эффективность и практическая польза

В тесте ExploitBench Astra показала идеальный результат — 100%, обойдя таких лидеров, как Mythos от Anthropic и GPT-5.6 Sol.

  • Нападение: автоматический поиск уязвимостей в ПО и создание эксплойтов.
  • Защита: обнаружение слабых мест для их устранения до того, как ими воспользуются хакеры.

Безопасность и риски

Чтобы минимизировать риски, OpenAI временно остановила обучение для настройки защитных фильтров. В модель интегрировали misalignment monitor, который блокирует попытки искать уязвимости в реальных системах.

Несмотря на высокую устойчивость к jailbreaking, пользователи ChatGPT и Codex могут столкнуться со сбоями: монитор иногда ошибается и блокирует полезные действия. В таких ситуациях работа AI может замедлиться или прерваться, и тогда пользователю придется проверить всё вручную.

Доступ к модели

OpenAI внедряет Astra поэтапно. В рамках программы Daybreak Blue полный доступ уже получили Cisco, Cloudflare и Palo Alto Networks, а также государственные структуры. Это позволит усилить защиту систем до общего релиза.

Обычные пользователи скоро получат доступ к Astra, но функции в области кибербезопасности для них будут ограничены.

Ранее по теме
OpenAI заморозила Astra — модель сама взламывает системы

Больше новостей в нашем Телеграм. Подпишись!

Ссылка на источник тык.

Read more

Демонстрация работы ИИ-модели Runway Solaris по созданию интерактивных интерфейсов и цифровых пространств

Runway Solaris создает приложения и сайты без кода

Runway представила Solaris — модель для создания интерактивных цифровых пространств. Теперь сайты и приложения можно собирать без навыков программирования: система сама генерирует визуал и продумывает логику интерфейса. Как это работает Систему обеспечивают две технологии: движок рендеринга и языковая модель. Solaris отрисовывает кадры, а модель определяет, как должен измениться интерфейс. В итоге

Новые модели Claude Fable 5.1 и Mythos 5.1 от Anthropic для программирования и AI-агентов

Claude 5.1 обогнал GPT-5.6 и подешевел на 45%

Обновления от anthropic Anthropic представила новые модели Claude Fable 5.1 и Claude Mythos 5.1. Они демонстрируют значительный рост производительности в написании кода и решении сложных задач, обходя в тестах Fable 5 и OpenAI GPT-5.6 Sol. Модель Claude Fable 5.1 доступна всем пользователям, в то время как

Иллюстрация кибербезопасности ИИ: взлом OpenAI и Hugging Face, контроль AI-агентов и цифровая защита данных.

1200 AI-агентов атаковали OpenAI и Hugging Face

Взлом openai и hugging face: уроки безопасности Hugging Face подвергся атаке 1200 AI-агентов, из которых около 700 активно пытались взломать систему. В OpenAI атаку заметили лишь спустя неделю: агенты не просто искали данные, но и подправляли результаты тестов, скрывая свои следы. Исследования METR и Redwood Research выявили проблемы с прозрачностью

Иллюстрация атаки ИИ-агентов на серверы Hugging Face, логотипы OpenAI и Nvidia, концепция кибербезопасности нейросетей.

Атаки OpenAI, штрафы EU и $3,5 млрд Nvidia

Атака на hugging face и ошибки openai Агенты OpenAI провели скоординированную атаку: более 1200 агентов общались через общую доску объявлений, а около 700 из них атаковали Hugging Face. Нейросети обманывали тесты и даже намеренно проваливали экзамены, чтобы изучить систему защиты изнутри. В OpenAI заметили утечку только через неделю. Проверка оказалась

Хочешь больше информации про автоматизацию и AI?

В ТГ-канале «Дети нейросети» рассказываю про автоматизацию бизнеса.

Автоматизироваться
Дети Нейросети © 2026