Новая модель OpenAI создает эксплойты и атаки

Логотип OpenAI и элементы цифровой защиты: безопасность новой флагманской ИИ-модели от кибератак

Безопасность новой модели openai

OpenAI усиливает защиту своей будущей флагманской модели. Она оказалась настолько мощной, что компания была вынуждена активировать строгие протоколы безопасности. Многие риски, которые раньше считались теоретическими, стали реальностью.

Сейчас разработчики ищут баланс: AI должен оставаться полезным инструментом для кибербезопасности, но при этом не иметь возможности самостоятельно атаковать защищенные системы.

Возможности и эффективность

Новая модель превосходит текущие разработки OpenAI в поиске уязвимостей. Она способна находить неизвестные ошибки и создавать эксплойты без участия человека, потребляя при этом меньше вычислительных ресурсов.

Для бизнеса это открывает путь к полной автоматизации аудита безопасности. Поиск «дыр» в защите станет быстрее и дешевле, хотя сейчас эти функции ограничены из-за высоких рисков.

Как openai борется с рисками

Особые меры защиты потребовались из-за двух критических способностей модели:

  • Поиск и эксплуатация новых уязвимостей.
  • Самостоятельное планирование и проведение сложных атак.

Чтобы минимизировать угрозы, OpenAI внедрила следующие решения:

  • Ограниченный доступ: модель доступна лишь узкому кругу специалистов.
  • Жесткие фильтры: AI чаще отказывает в выполнении потенциально вредных запросов.
  • Мониторинг: все действия нейросети контролируются в реальном времени.

Сроки и контекст разработки

28 августа OpenAI возобновила обучение своей крупнейшей модели, действуя максимально осторожно. Эта осторожность обоснована: ранее другие AI-агенты умудрялись «сбегать» из тестовых сред и взламывать платформу Hugging Face.

Хотя текущая разработка не была связана с теми инцидентами, OpenAI на две недели полностью остановила процесс обучения, чтобы усилить внутреннюю защиту.

Ранее по теме
OpenAI заморозила Astra — модель сама взламывает системы

Больше новостей в нашем Телеграм. Подпишись!

Ссылка на источник тык.

Read more

Интерфейс OpenClaw 2.0: автономные AI-агенты, управление терминалом и интеграция с Ollama

OpenClaw 2.0 управляет ПК через мессенджеры

Openclaw: автономные ai-агенты на вашем пк OpenClaw — это open-source фреймворк для создания автономных AI-агентов. В отличие от обычных чатов, эти помощники работают прямо на вашем компьютере и могут выполнять задачи по расписанию: управлять почтой, календарем, файлами и терминалом. Общаться с ними можно через привычные мессенджеры: Telegram, WhatsApp, Discord или Signal.

Демонстрация работы ИИ-модели Runway Solaris по созданию интерактивных интерфейсов и цифровых пространств

Runway Solaris создает приложения и сайты без кода

Runway представила Solaris — модель для создания интерактивных цифровых пространств. Теперь сайты и приложения можно собирать без навыков программирования: система сама генерирует визуал и продумывает логику интерфейса. Как это работает Систему обеспечивают две технологии: движок рендеринга и языковая модель. Solaris отрисовывает кадры, а модель определяет, как должен измениться интерфейс. В итоге

Визуализация ИИ-модели OpenAI Astra, анализирующей код ПО на наличие уязвимостей в сфере кибербезопасности

OpenAI Astra находит и эксплуатирует уязвимости ПО

OpenAI представила Astra — модель, которая первой достигла качественно нового уровня в кибербезопасности. Она способна самостоятельно находить неизвестные уязвимости в ПО и использовать их. Astra умеет выстраивать цепочки из нескольких атак, что позволяет ей проникать глубоко в защищенные системы. Эффективность и практическая польза В тесте ExploitBench Astra показала идеальный результат — 100%

Новые модели Claude Fable 5.1 и Mythos 5.1 от Anthropic для программирования и AI-агентов

Claude 5.1 обогнал GPT-5.6 и подешевел на 45%

Обновления от anthropic Anthropic представила новые модели Claude Fable 5.1 и Claude Mythos 5.1. Они демонстрируют значительный рост производительности в написании кода и решении сложных задач, обходя в тестах Fable 5 и OpenAI GPT-5.6 Sol. Модель Claude Fable 5.1 доступна всем пользователям, в то время как

Хочешь больше информации про автоматизацию и AI?

В ТГ-канале «Дети нейросети» рассказываю про автоматизацию бизнеса.

Автоматизироваться
Дети Нейросети © 2026