Anthropic тайно ограничивала Claude Fable 5 против Китая
Борьба с конкурентами и качество ответов
Anthropic пыталась тайно ограничивать возможности Claude Fable 5. Если пользователь создавал собственные LLM, нейросеть выдавала слабые ответы — так компания пыталась помешать китайским разработчикам. Эксперты раскритиковали этот подход, назвав его непрозрачным и враждебным. Скрытое снижение интеллекта модели подрывает доверие к AI в целом.
Прозрачность и новые правила
После скандала Anthropic сменила тактику. Теперь компания открыто сообщает о переключении моделей: тех, кто занимается обучением LLM, переводят на более простую Claude Opus 4.8. Это вернуло честность в исследования, хотя ограничения на разработку опасных технологий остались в силе.
Безопасность и «наследственность» модели
Строгие фильтры Claude Fable 5 появились не случайно. Она базируется на модели Claude Mythos, которая слишком эффективно взламывает системы, из-за чего её решили скрыть. В итоге Claude Fable 5 стала часто ошибаться: например, она может отказаться объяснить термин «белок», чтобы случайно не помочь в создании биооружия.
Как улучшают систему защиты
Сейчас Anthropic работает над тем, чтобы нейросеть реже ошибалась. Цель — сохранить безопасность, но убрать неоправданные запреты. В систему уже внедрили два обновления:
- Новый алгоритм точнее блокирует действительно вредные запросы.
- Обновленная архитектура фильтров стала дешевле в эксплуатации.
Ранее по теме
Opus 5 от Anthropic — дешевый лидер бизнес-задач
Больше новостей в нашем Телеграм. Подпишись!
Ссылка на источник тык.