Новая модель OpenAI создает эксплойты и атаки
Безопасность новой модели openai
OpenAI усиливает защиту своей будущей флагманской модели. Она оказалась настолько мощной, что компания была вынуждена активировать строгие протоколы безопасности. Многие риски, которые раньше считались теоретическими, стали реальностью.
Сейчас разработчики ищут баланс: AI должен оставаться полезным инструментом для кибербезопасности, но при этом не иметь возможности самостоятельно атаковать защищенные системы.
Возможности и эффективность
Новая модель превосходит текущие разработки OpenAI в поиске уязвимостей. Она способна находить неизвестные ошибки и создавать эксплойты без участия человека, потребляя при этом меньше вычислительных ресурсов.
Для бизнеса это открывает путь к полной автоматизации аудита безопасности. Поиск «дыр» в защите станет быстрее и дешевле, хотя сейчас эти функции ограничены из-за высоких рисков.
Как openai борется с рисками
Особые меры защиты потребовались из-за двух критических способностей модели:
- Поиск и эксплуатация новых уязвимостей.
- Самостоятельное планирование и проведение сложных атак.
Чтобы минимизировать угрозы, OpenAI внедрила следующие решения:
- Ограниченный доступ: модель доступна лишь узкому кругу специалистов.
- Жесткие фильтры: AI чаще отказывает в выполнении потенциально вредных запросов.
- Мониторинг: все действия нейросети контролируются в реальном времени.
Сроки и контекст разработки
28 августа OpenAI возобновила обучение своей крупнейшей модели, действуя максимально осторожно. Эта осторожность обоснована: ранее другие AI-агенты умудрялись «сбегать» из тестовых сред и взламывать платформу Hugging Face.
Хотя текущая разработка не была связана с теми инцидентами, OpenAI на две недели полностью остановила процесс обучения, чтобы усилить внутреннюю защиту.
Ранее по теме
OpenAI заморозила Astra — модель сама взламывает системы
Больше новостей в нашем Телеграм. Подпишись!
Ссылка на источник тык.