Бизнес массово переходит на дешевые ИИ-модели

Бизнес-график, показывающий снижение затрат на ИИ. Фокус на экономичности моделей, а не их мощности. Сравнение дорогих и дешевых ИИ.

Раньше бизнес гнался за мощью, а теперь считает деньги. Хотя еще недавно все стремились к самым большим моделям ИИ, сейчас компании выбирают их исходя из стоимости.

Соучредитель Coinbase Брайан Армстронг прогнозирует: через 12-18 месяцев 80% задач будут решать более дешевые модели, а супермощные останутся для 20% самых сложных. Это ударит по выручке OpenAI и Anthropic.

На рынке разгорается борьба: лаборатории соревнуются с моделями с открытым исходным кодом, а бизнес пересматривает приоритеты в пользу эффективности.

Проверка производительности на деле

Практика подтверждает эти изменения. Сервис для юристов Harvey сократил расходы в четыре раза без потери качества. Такой подход позволил оптимизировать работу.

Harvey использовал Claude Opus для сложных задач, а для простых — модель GLM 5.1 от Fireworks AI. Это позволило не только сэкономить на токенах, но и сохранить стабильность системы.

По словам Гейба Перейры из Harvey, качество остается приоритетом. Но сегодня это значит — выбрать самую эффективную, а не самую мощную модель. Так компания экономит бюджет, сохраняя точность ответов.

Можно выбирать между моделями. Например, перейти с GPT-5.5 на DeepSeek V4 Flash или GPT-5.4-mini. Это снизит расходы, а результат часто остается прежним.

Трудности роста

Эра бездумного масштабирования подходит к концу. Раньше ИИ-лаборатории получали много инвестиций на самые «прожорливые» модели, которые пользователи выбирали зачастую без четкого понимания необходимости.

Теперь цены на токены растут, инвестиции сокращаются. Компании вынуждены обосновывать расходы на вычисления, подталкивая их к поиску новых, более экономичных решений.

Компании теперь не просто переходят на компактные модели, но и оптимизируют количество запросов: урезают работу с длинным контекстом или вовсе отключают неэффективные функции. Новые цены заставляют пересмотреть целесообразность огромных моделей, если большинство задач успешно решают более доступные альтернативы.

Ранее по теме
General Motors уволила 600 сотрудников ради AI-разработки

Больше новостей в нашем Телеграм. Подпишись!

Ссылка на источник тык.

Read more

Интерфейс OpenClaw 2.0: автономные AI-агенты, управление терминалом и интеграция с Ollama

OpenClaw 2.0 управляет ПК через мессенджеры

Openclaw: автономные ai-агенты на вашем пк OpenClaw — это open-source фреймворк для создания автономных AI-агентов. В отличие от обычных чатов, эти помощники работают прямо на вашем компьютере и могут выполнять задачи по расписанию: управлять почтой, календарем, файлами и терминалом. Общаться с ними можно через привычные мессенджеры: Telegram, WhatsApp, Discord или Signal.

Демонстрация работы ИИ-модели Runway Solaris по созданию интерактивных интерфейсов и цифровых пространств

Runway Solaris создает приложения и сайты без кода

Runway представила Solaris — модель для создания интерактивных цифровых пространств. Теперь сайты и приложения можно собирать без навыков программирования: система сама генерирует визуал и продумывает логику интерфейса. Как это работает Систему обеспечивают две технологии: движок рендеринга и языковая модель. Solaris отрисовывает кадры, а модель определяет, как должен измениться интерфейс. В итоге

Визуализация ИИ-модели OpenAI Astra, анализирующей код ПО на наличие уязвимостей в сфере кибербезопасности

OpenAI Astra находит и эксплуатирует уязвимости ПО

OpenAI представила Astra — модель, которая первой достигла качественно нового уровня в кибербезопасности. Она способна самостоятельно находить неизвестные уязвимости в ПО и использовать их. Astra умеет выстраивать цепочки из нескольких атак, что позволяет ей проникать глубоко в защищенные системы. Эффективность и практическая польза В тесте ExploitBench Astra показала идеальный результат — 100%

Новые модели Claude Fable 5.1 и Mythos 5.1 от Anthropic для программирования и AI-агентов

Claude 5.1 обогнал GPT-5.6 и подешевел на 45%

Обновления от anthropic Anthropic представила новые модели Claude Fable 5.1 и Claude Mythos 5.1. Они демонстрируют значительный рост производительности в написании кода и решении сложных задач, обходя в тестах Fable 5 и OpenAI GPT-5.6 Sol. Модель Claude Fable 5.1 доступна всем пользователям, в то время как

Хочешь больше информации про автоматизацию и AI?

В ТГ-канале «Дети нейросети» рассказываю про автоматизацию бизнеса.

Автоматизироваться
Дети Нейросети © 2026