OpenAI представила готовый стандарт безопасности ИИ-разработок

Логотип OpenAI и схема Frontier Governance Framework (FGF) для безопасной разработки ИИ.

OpenAI представляет Frontier Governance Framework (FGF) — готовую инструкцию по безопасной разработке ИИ. Этот фреймворк помогает избежать серьезных рисков при масштабировании.

FGF соответствует требованиям регуляторов, таким как EU General-Purpose AI Code of Practice и California’s Transparency in Frontier AI Act (TFAIA). Используйте этот документ как шаблон для своих систем: он поможет защитить продвинутые модели машинного обучения.

Под системным риском понимают прогнозируемый серьезный ущерб. FGF определяет его как ситуации, затрагивающие более 50 человек или наносящие ущерб свыше $1 млрд. Это поможет сфокусировать ресурсы на нужных направлениях аудита и мониторинга.

Категории угроз и уровни риска

Framework классифицирует угрозы по нескольким направлениям: киберугрозы, риски CBRN (химические, биологические, радиологические, ядерные), манипуляция и потеря контроля. Для каждого направления предусмотрены свои уровни оценки.

  • Кибербезопасность: Уровень 3 означает создание эксплойтов без участия человека.
  • CBRN: Уровень 3 — синтез опасных биологических агентов.
  • Манипуляция: Искажение поведения пользователей — здесь помогут классификаторы контента.
  • Потеря контроля: Уровень 2 — уход от мониторинга. Уровень 3 — превосходящая человека автономия.

Эти уровни помогают определить границы для ваших моделей. Даже инструментам вроде coding assistants нужен контроль.

Внутренняя безопасность и аудит

OpenAI применяет стандарты ISO 27001, 27017, 27018, 27017 и SOC 2 Type II. Используется шифрование данных и многофакторная аутентификация. Модели работают в изолированной среде.

При интеграции через Retrieval-Augmented Generation (RAG) запросы к API проходят через систему классификаторов, что надежно защищает данные.

Для реагирования на инциденты создан AI Safety Incident Response Plan (AIRP). Отчеты готовят раз в полгода, а Formal Framework Assessments проводят ежегодно.

Вы можете внедрить похожие процессы: мониторьте аномальное поведение API и проверяйте пороги риска с помощью аудиторов.

Ранее по теме
OpenAI запустила Realtime API с поддержкой перевода и речи

Больше новостей в нашем Телеграм. Подпишись!

Ссылка на источник тык.

Read more

Визуализация работы модели Atlas: генерация 3D-объектов и пространственного интеллекта от World Labs

Atlas создает 3D-миры по одному фото

Пространственный интеллект и модель atlas Atlas — это мультимодальная модель мира, которая учит AI понимать 3D-объекты и законы физики. Это важный этап на пути к AGI, так как нейросеть начинает осознавать, как предметы реально взаимодействуют в пространстве. Технологии и возможности В основе модели лежит архитектура multimodal autoregressive diffusion transformer. В отличие

Логотип OpenAI и элементы цифровой защиты: безопасность новой флагманской ИИ-модели от кибератак

Новая модель OpenAI создает эксплойты и атаки

Безопасность новой модели openai OpenAI усиливает защиту своей будущей флагманской модели. Она оказалась настолько мощной, что компания была вынуждена активировать строгие протоколы безопасности. Многие риски, которые раньше считались теоретическими, стали реальностью. Сейчас разработчики ищут баланс: AI должен оставаться полезным инструментом для кибербезопасности, но при этом не иметь возможности самостоятельно атаковать

Интерфейс OpenClaw 2.0: автономные AI-агенты, управление терминалом и интеграция с Ollama

OpenClaw 2.0 управляет ПК через мессенджеры

Openclaw: автономные ai-агенты на вашем пк OpenClaw — это open-source фреймворк для создания автономных AI-агентов. В отличие от обычных чатов, эти помощники работают прямо на вашем компьютере и могут выполнять задачи по расписанию: управлять почтой, календарем, файлами и терминалом. Общаться с ними можно через привычные мессенджеры: Telegram, WhatsApp, Discord или Signal.

Демонстрация работы ИИ-модели Runway Solaris по созданию интерактивных интерфейсов и цифровых пространств

Runway Solaris создает приложения и сайты без кода

Runway представила Solaris — модель для создания интерактивных цифровых пространств. Теперь сайты и приложения можно собирать без навыков программирования: система сама генерирует визуал и продумывает логику интерфейса. Как это работает Систему обеспечивают две технологии: движок рендеринга и языковая модель. Solaris отрисовывает кадры, а модель определяет, как должен измениться интерфейс. В итоге

Хочешь больше информации про автоматизацию и AI?

В ТГ-канале «Дети нейросети» рассказываю про автоматизацию бизнеса.

Автоматизироваться
Дети Нейросети © 2026