Google представила Gemini Omni для создания видео

Логотип Google Gemini Omni на экране, символизирующий ИИ-генерацию видео из текста, фото и других видео.

Google представила Gemini Omni — новое поколение AI-моделей для создания видео из фото, видео и текста. Первая версия, Omni Flash, уже доступна на платформе Google "Flow". Gemini Omni расширяет возможности модели Veo, лучше сохраняя персонажей. Кроме того, модель опирается на физические законы реального мира.

Как работает gemini omni

Gemini Omni создает контент, переводя данные между различными форматами. Вы можете загрузить видео и текстовое описание, затем нейросеть создаст новый ролик. Также доступно редактирование готового видео с помощью текстовых команд. Несмотря на прогресс, у модели есть ограничения: объекты могут менять внешний вид, например, посуда может исчезнуть.

Gemini Omni лучше реагирует на правки, но результат бывает непредсказуемым — порой появляются лишние детали, например, у персонажа могут вырасти рога. Тем не менее, модель хорошо справляется с созданием убедительных дипфейков, имитируя путешествия или ужины.

Стоимость использования gemini omni

Gemini Omni работает по кредитной системе. Создание видео стоит 15-40 кредитов в зависимости от длины ролика и исходных данных. Каждое последующее редактирование обходится в 40 кредитов. Подписка "AI Pro" за $20 в месяц предоставляет 1000 кредитов.

Тестирование 20 роликов и нескольких правок почти исчерпало месячный лимит, оставив 145 кредитов. Если вам нужно много разных версий или вы планируете серию правок, стоимость может быть высокой. Gemini Omni подходит для развлечений, а также для творчества: создания анимации или клипов из текста.

Польза и риски gemini omni

Gemini Omni позволяет создавать дипфейки, например, имитировать путешествия или ужины. Благодаря высокой скорости работы, модель снижает порог входа — сложные видео теперь создавать проще, не требуя особых навыков. Реалистичность роликов поражает, их сложно отличить от настоящих.

Это создает проблемы: проверять подлинность контента станет сложнее. Инструмент открывает широкие возможности, но использовать его нужно с осторожностью. Пользователям следует быть внимательными и не принимать все за чистую монету.

Ранее по теме
Google внедрил голосовое управление в Workspace

Больше новостей в нашем Телеграм. Подпишись!

Ссылка на источник тык.

Read more

Визуализация работы модели Atlas: генерация 3D-объектов и пространственного интеллекта от World Labs

Atlas создает 3D-миры по одному фото

Пространственный интеллект и модель atlas Atlas — это мультимодальная модель мира, которая учит AI понимать 3D-объекты и законы физики. Это важный этап на пути к AGI, так как нейросеть начинает осознавать, как предметы реально взаимодействуют в пространстве. Технологии и возможности В основе модели лежит архитектура multimodal autoregressive diffusion transformer. В отличие

Логотип OpenAI и элементы цифровой защиты: безопасность новой флагманской ИИ-модели от кибератак

Новая модель OpenAI создает эксплойты и атаки

Безопасность новой модели openai OpenAI усиливает защиту своей будущей флагманской модели. Она оказалась настолько мощной, что компания была вынуждена активировать строгие протоколы безопасности. Многие риски, которые раньше считались теоретическими, стали реальностью. Сейчас разработчики ищут баланс: AI должен оставаться полезным инструментом для кибербезопасности, но при этом не иметь возможности самостоятельно атаковать

Интерфейс OpenClaw 2.0: автономные AI-агенты, управление терминалом и интеграция с Ollama

OpenClaw 2.0 управляет ПК через мессенджеры

Openclaw: автономные ai-агенты на вашем пк OpenClaw — это open-source фреймворк для создания автономных AI-агентов. В отличие от обычных чатов, эти помощники работают прямо на вашем компьютере и могут выполнять задачи по расписанию: управлять почтой, календарем, файлами и терминалом. Общаться с ними можно через привычные мессенджеры: Telegram, WhatsApp, Discord или Signal.

Демонстрация работы ИИ-модели Runway Solaris по созданию интерактивных интерфейсов и цифровых пространств

Runway Solaris создает приложения и сайты без кода

Runway представила Solaris — модель для создания интерактивных цифровых пространств. Теперь сайты и приложения можно собирать без навыков программирования: система сама генерирует визуал и продумывает логику интерфейса. Как это работает Систему обеспечивают две технологии: движок рендеринга и языковая модель. Solaris отрисовывает кадры, а модель определяет, как должен измениться интерфейс. В итоге

Хочешь больше информации про автоматизацию и AI?

В ТГ-канале «Дети нейросети» рассказываю про автоматизацию бизнеса.

Автоматизироваться
Дети Нейросети © 2026