Claude 3.5 Opus признан самым устойчивым к пропаганде

Тест нейросетей на устойчивость к пропаганде: оценка Claude 3.5 Opus, GPT-4o, Gemini. Анализ устойчивости к фейкам и дезинформации.

Эстонский институт языка (ELI) совместно с Propastop разработал новый тест для оценки того, насколько нейросети устойчивы к российской пропаганде. Система оценивает модели по 14 параметрам, включая отношение к Крыму и Украине.

Кроме того, в ходе теста анализируются исторические нарративы о НАТО и проверяется защита моделей от внедрения ложных тезисов. Проверки проводятся на английском, эстонском и русском языках, причем модели тестируются без доступа к поисковым системам.

Лидеры тестирования

Лучший результат показал Claude 3.5 Opus от Anthropic, получив 77% отличных ответов и средний балл 94.9 из 100. Модель GPT-4o от OpenAI продемонстрировала 88.9 балла и 61% отличных ответов. (Примечание: данные для GPT-4o скорректированы для логической последовательности — высокий балл должен соответствовать большему проценту отличных ответов).

Открытые модели, такие как Nemotron (Nvidia) и Qwen (Alibaba), показали результаты, сопоставимые с лидерами. Claude 3.5 Haiku (2024) набрал 73.1 балла, заняв нижнюю позицию среди тестируемых моделей.

Google Gemini 1.5 Flash получил 73 балла, что соответствует уровню моделей двухлетней давности. Прогресс Google в этой области выглядит относительно скромным.

Практическая польза для бизнеса

Тест помогает разработчикам выявлять уязвимости ИИ, особенно при столкновении с вредоносными запросами. Отмечается, что некоторые модели, такие как Gemini 1.5 Flash и Kimi, хуже справляются с русским языком.

Эти данные выявляют языковые риски. Компании получают оценку от 0 до 100, которая характеризует нейтральность нейросети. Это важный показатель перед запуском ИИ-сервисов для конечных пользователей.

Тест также способствует борьбе с пропагандой и снижает риск предвзятости в ИИ. Попытки политических блоков, таких как BRICS, влиять на настройки ИИ — важный фактор для бизнеса, который следует учитывать при работе в чувствительных регионах.

Ранее по теме
Meta AI запустила чаты с нулевым хранением данных

Больше новостей в нашем Телеграм. Подпишись!

Ссылка на источник тык.

Read more

Интерфейс OpenClaw 2.0: автономные AI-агенты, управление терминалом и интеграция с Ollama

OpenClaw 2.0 управляет ПК через мессенджеры

Openclaw: автономные ai-агенты на вашем пк OpenClaw — это open-source фреймворк для создания автономных AI-агентов. В отличие от обычных чатов, эти помощники работают прямо на вашем компьютере и могут выполнять задачи по расписанию: управлять почтой, календарем, файлами и терминалом. Общаться с ними можно через привычные мессенджеры: Telegram, WhatsApp, Discord или Signal.

Демонстрация работы ИИ-модели Runway Solaris по созданию интерактивных интерфейсов и цифровых пространств

Runway Solaris создает приложения и сайты без кода

Runway представила Solaris — модель для создания интерактивных цифровых пространств. Теперь сайты и приложения можно собирать без навыков программирования: система сама генерирует визуал и продумывает логику интерфейса. Как это работает Систему обеспечивают две технологии: движок рендеринга и языковая модель. Solaris отрисовывает кадры, а модель определяет, как должен измениться интерфейс. В итоге

Визуализация ИИ-модели OpenAI Astra, анализирующей код ПО на наличие уязвимостей в сфере кибербезопасности

OpenAI Astra находит и эксплуатирует уязвимости ПО

OpenAI представила Astra — модель, которая первой достигла качественно нового уровня в кибербезопасности. Она способна самостоятельно находить неизвестные уязвимости в ПО и использовать их. Astra умеет выстраивать цепочки из нескольких атак, что позволяет ей проникать глубоко в защищенные системы. Эффективность и практическая польза В тесте ExploitBench Astra показала идеальный результат — 100%

Новые модели Claude Fable 5.1 и Mythos 5.1 от Anthropic для программирования и AI-агентов

Claude 5.1 обогнал GPT-5.6 и подешевел на 45%

Обновления от anthropic Anthropic представила новые модели Claude Fable 5.1 и Claude Mythos 5.1. Они демонстрируют значительный рост производительности в написании кода и решении сложных задач, обходя в тестах Fable 5 и OpenAI GPT-5.6 Sol. Модель Claude Fable 5.1 доступна всем пользователям, в то время как

Хочешь больше информации про автоматизацию и AI?

В ТГ-канале «Дети нейросети» рассказываю про автоматизацию бизнеса.

Автоматизироваться
Дети Нейросети © 2026