Google выпустила Gemma 4 — ускорение до 3 раз

Логотип Google Gemma 4, иллюстрация работы ИИ на мобильных устройствах и компьютерах, графика ускорения производительности.

Google представила Gemma 4 — новое поколение открытых моделей, созданных на основе передовых технологий Gemini AI. Gemma 4 оптимизирована для работы непосредственно на вашем устройстве.

Компания Google открыла доступ к Gemma 4 по лицензии Apache 2.0. Это упрощает работу для разработчиков. Модели универсальны: они работают на обычных видеокартах, поддерживаются мобильные процессоры и интегрирована поддержка чипов TPU от Google.

Как gemma 4 ускоряет работу

Главное новшество Gemma 4Multi-Token Prediction (MTP). Эта технология устраняет «узкое место» при генерации текста. Раньше модель генерировала только один символ за раз.

MTP использует легкую модель-«черновик», которая предсказывает сразу несколько следующих символов. Затем основная модель Gemma проверяет их. Если предсказание верно, модель подтверждает весь блок данных разом, генерируя несколько символов за одно действие. Модели-«черновики» используют общие с основной моделью данные контекста, что значительно экономит время.

Результаты ускорения

Тесты показывают значительный рост скорости: ускорение достигает 3 раз в зависимости от устройства. На телефонах Pixel модель E2B работает в 2.8 раза быстрее, а E4B — в 3.1 раза. На чипах Apple M4 большая модель Gemma 4 ускоряется в 2.5 раза.

Польза для бизнеса и пользователей

MTP решает проблемы с производительностью и снижает задержку, что особенно актуально для больших моделей. Теперь они лучше работают на обычном оборудовании. Для телефонов это означает лучшую энергоэффективность: заряд батареи расходуется экономнее.

Качество ответов при этом сохраняется. Основная модель гарантирует точность. Локальная работа AI повышает конфиденциальность, так как вам не нужно отправлять данные в облако.

Простая интеграция

Интегрировать MTP в проекты на базе Gemma 4 не составит труда. Модели-«черновики» доступны бесплатно и могут быть интегрированы в популярные системы, такие как MLX, VLLM, SGLang и Ollama.

Ранее по теме
Google запустил Gemini Enterprise Agent Platform для контроля ИИ-агентов

Больше новостей в нашем Телеграм. Подпишись!

Ссылка на источник тык.

Read more

Логотип Google Gemini 1.5 Flash и инфографика со стоимостью токенов нейросети

Gemini 1.5 Flash — быстрее и дешевле

Скорость и реальная польза Gemini 1.5 Flash работает быстрее и точнее предшественников, эффективнее справляясь с тестами и сложными задачами. А значит, вы получите точный результат гораздо быстрее. Цены для быстрого старта Google снизил стоимость Gemini 1.5 Flash до 31 декабря, сделав использование модели максимально выгодным: * Входные данные: $0.

Интерфейс функции Ask YouTube с технологией Agentic Video Understanding от Google Gemini для анализа видео

Google обновил Ask YouTube — затраты упали на 66%

Google обновил функцию Ask YouTube, внедрив в неё технологию Agentic Video Understanding на базе Gemini. Если раньше AI просто анализировал случайные кадры, то теперь он самостоятельно выбирает наиболее подходящие фрагменты видео для максимально точного ответа. Где найти и как использовать Обычные пользователи могут найти инструмент в приложении Gemini или нажать

Интерфейс функции Battery usage summaries на Google Pixel 11 с AI-анализом расхода батареи

Pixel 11 заменил графики заряда AI-отчетами

Умный анализ заряда батареи Google внедрил функцию Battery usage summaries для линейки Pixel 11. Теперь AI заменяет сложные графики понятными текстовыми отчетами. Больше не нужно вручную разбираться в таблицах — сразу видно, какие приложения «съедают» заряд и почему. Система в фоновом режиме анализирует работу устройства и: * Выявляет самых энергозатратных приложений. * Отслеживает

Визуализация нейросети Grok 4.7 от SpaceXAI с параметрами 2,1 триллиона

SpaceXAI выпустит Grok 4.7 для инженеров 12 сентября

Дата выхода и возможности SpaceXAI выпустит нейросеть Grok 4.7 12 сентября — ровно через месяц после выхода Grok 4.6. Технические характеристики новой версии стали еще внушительнее: * Масштаб: модель насчитывает 2,1 триллиона параметров. * Эффективность: обработка данных стала качественнее и точнее, чем в Grok 4.6. * Скорость: время генерации ответов

Хочешь больше информации про автоматизацию и AI?

В ТГ-канале «Дети нейросети» рассказываю про автоматизацию бизнеса.

Автоматизироваться
Дети Нейросети © 2026