GPT-5.5 и Mythos прошли тесты на кибервзлом

AI модели GPT-5.5 и Mythos Preview проходят тесты кибербезопасности, исследуются уязвимости и защита данных

Институт кибербезопасности Великобритании (AISI) исследовал, насколько современные AI-модели могут быть использованы для защиты. Тестирование проводилось на OpenAI GPT-5.5 и Anthropic Mythos Preview — результаты оказались схожими.

Сравнительный анализ моделей

Исследование показало, что обе модели отлично справились с 95 задачами CTF, проверяющими навыки реверс-инжиниринга, эксплуатации веб-уязвимостей и криптографии. На экспертном уровне GPT-5.5 успешно справился с 71,4% заданий, а Mythos Preview — с 68,6%. Разница минимальна.

Детальное тестирование

GPT-5.5 потребовалось 10 минут 22 секунды, чтобы решить задачу с дизассемблером без помощи человека. Стоимость API-вызовов составила $1.73. В симуляции извлечения данных из корпоративной сети GPT-5.5 показал себя лучше, чем Mythos Preview. Показатели успеха составили 30% против 20%, причем ранее ни одна модель не справлялась с этой задачей. Обе модели провалили тест «Cooling Tower», имитирующий сбой ПО электростанции. Ранее с этим заданием не справлялся никто.

Риски и опасения

По мнению AISI, риски кибербезопасности зависят не от конкретных моделей, а от общего прогресса AI — в частности, роста автономности, логических способностей и навыков программирования. CEO OpenAI Сэм Альтман называет аргументы о «чрезмерной опасности» формой маркетинга и прогнозирует рост таких заявлений.

Программа openai trusted access for cyber

OpenAI запустила программу Trusted Access for Cyber. Она предназначена для верификации профессиональных исследователей безопасности, предоставляя им контролируемый доступ к AI-моделям для защиты. Версия GPT-5.4-Cyber предлагает улучшенные кибервозможности. GPT-5.5-Cyber готовят для специалистов по критической инфраструктуре, чтобы снизить риски.

Ранее по теме
Fiverr перешел на AI-first — увольнения и новый контент

Больше новостей в нашем Телеграм. Подпишись!

Ссылка на источник тык.

Read more

Интерфейс OpenClaw 2.0: автономные AI-агенты, управление терминалом и интеграция с Ollama

OpenClaw 2.0 управляет ПК через мессенджеры

Openclaw: автономные ai-агенты на вашем пк OpenClaw — это open-source фреймворк для создания автономных AI-агентов. В отличие от обычных чатов, эти помощники работают прямо на вашем компьютере и могут выполнять задачи по расписанию: управлять почтой, календарем, файлами и терминалом. Общаться с ними можно через привычные мессенджеры: Telegram, WhatsApp, Discord или Signal.

Демонстрация работы ИИ-модели Runway Solaris по созданию интерактивных интерфейсов и цифровых пространств

Runway Solaris создает приложения и сайты без кода

Runway представила Solaris — модель для создания интерактивных цифровых пространств. Теперь сайты и приложения можно собирать без навыков программирования: система сама генерирует визуал и продумывает логику интерфейса. Как это работает Систему обеспечивают две технологии: движок рендеринга и языковая модель. Solaris отрисовывает кадры, а модель определяет, как должен измениться интерфейс. В итоге

Визуализация ИИ-модели OpenAI Astra, анализирующей код ПО на наличие уязвимостей в сфере кибербезопасности

OpenAI Astra находит и эксплуатирует уязвимости ПО

OpenAI представила Astra — модель, которая первой достигла качественно нового уровня в кибербезопасности. Она способна самостоятельно находить неизвестные уязвимости в ПО и использовать их. Astra умеет выстраивать цепочки из нескольких атак, что позволяет ей проникать глубоко в защищенные системы. Эффективность и практическая польза В тесте ExploitBench Astra показала идеальный результат — 100%

Новые модели Claude Fable 5.1 и Mythos 5.1 от Anthropic для программирования и AI-агентов

Claude 5.1 обогнал GPT-5.6 и подешевел на 45%

Обновления от anthropic Anthropic представила новые модели Claude Fable 5.1 и Claude Mythos 5.1. Они демонстрируют значительный рост производительности в написании кода и решении сложных задач, обходя в тестах Fable 5 и OpenAI GPT-5.6 Sol. Модель Claude Fable 5.1 доступна всем пользователям, в то время как

Хочешь больше информации про автоматизацию и AI?

В ТГ-канале «Дети нейросети» рассказываю про автоматизацию бизнеса.

Автоматизироваться
Дети Нейросети © 2026