19 мая 2026, 22:23
Вышла видеомодель Google Gemini Omni: «превратит что угодно во что угодно»

Google 19 мая на конференции I/O 2026 представила Gemini Omni Flash — первую модель нового семейства Omni, способную не просто генерировать видео, а переделывать уже снятый ролик по текстовым командам прямо в чате. Анонс делал глава Google DeepMind Демис Хассабис. Схема раскатывается сразу: всем подписчикам тарифов Google AI Plus, Pro и Ultra по всему миру через приложение Gemini и киноинструмент Flow, а в YouTube Shorts и приложении YouTube Create — бесплатно, в течение недели.
Главное отличие от прошлогодней Veo — направление работы. Veo превращала текст в видео с нуля, Omni берет любой ввод (текст, изображения, аудио или готовое видео) и меняет в нем то, что нужно: персонажей, объекты, происходящее в кадре. Редактирование идет цепочкой — каждая следующая команда опирается на предыдущую, одновременно персонажи остаются прежними, а сцена "помнит", что было до этого. Отдельно Google делает упор на физику: организация заявляет, что модель точнее обращается с гравитацией, динамикой жидкостей и кинетической энергией, поэтому из короткого промпта можно собрать, например, наглядный научный ролик — на презентации показывали пластилиновый ролик про сворачивание белка.
В Google подумали о безопасности. Каждое видео получает незаметный цифровой водяной знак SynthID, и его происхождение можно проверить через программа Gemini, через Gemini в браузере Chrome и в поиске Google. Вставить в ролик можно собственный аватар — внешность и голос самого пользователя, — но менять чужую речь и звук схема на старте не дает: эту способность придержали, пока не придумают, как раздать ее безопасно. Логика понятна — без таких рамок Omni превращается в готовую фабрику дипфейков.
Это только начало семейства. Google уже анонсировала старшую модель Omni Pro (детали обещают позже) и говорит, что со временем Omni научится выдавать не только видео, но и изображения со звуком. Ставка тут шире одной модели: Google пытается стать единой точкой генерации контента с готовой раздачей через YouTube, поиск и собственные приложения — особенно с учетом того, что OpenAI заморозила направление видеогенерации Sora..
P.S. Поддержать меня можно подпиской на канал "сбежавшая нейросеть", где я рассказываю про ИИ с творческой стороны.
Читают сейчас

11 часов назад
Sony добавила нейросетевое усовершенствование графики на обычную PS5
За нейросетевым улучшением картинки больше не обязательно идти покупать PS5 Pro. Sony представила QSSR — технологию масштабирования изображения для обычной PlayStation 5. Первыми поддержку получили Ma

12 часов назад
Неделя OCR для LLM — в Telegram-канале Smart Engines
Привет, ! Объявляем тематическую неделю, посвященную OCR для LLM и интеллектуальной обработки документов без галлюцинаций и «додумывания» данных. Расскажем, как устроено полнотекстовое распознавание S

12 часов назад
Metro 2033 и Last Light получат бесплатное апдейт с улучшенной графикой и поддержкой 120 FPS
Возвращаться в московское метро скоро станет приятнее, насколько это вообще возможно среди мутантов и радиации. 4A Games и Deep Silver анонсировали бесплатное обновление для Metro 2033 Redux и Metro:

12 часов назад
Perfscale news #13. Выжигание WASM модулей, http3 и начальный postmortem
Всех категорически приветствую, любители больших количеств девяток! Сегодня в выпуске у нас будет интересности, ну а начнем мы как всегда с истории прошлых выпусков Читать далее

13 часов назад
Мы прошли все стадии принятия ИИ: вышел свежий сезон подкаста «Свободный слот»
Помните, как в 2023 году все спорили, заменят ли нейросети инженеров? Тема дискуссионная, но сейчас, когда ИИ уже заложен в каждый процесс, вопрос ставится иначе: что создавать? Как с ним жить? Мы в А