1 апреля 2026, 11:32
Google выкатила Veo 3.1 Lite – дешёвую нейросеть для создания видео

31 марта организация Google DeepMind официально запустила Veo 3.1 Lite – свою самую доступную нейросеть для генерации видео. Новая схема уже открыта для разработчиков через Gemini программный интерфейс и Google AI Studio. Генерация контента теперь стоит свыше в два раза дешевле относительно версией Veo 3.1 Fast, при этом скорость работы осталась на прежнем высоком уровне. Подробная техническая спецификация уже выложена в документации для разработчиков.
Свежий анонс от поискового гиганта появился буквально сразу после того, как OpenAI на днях закрыла инициатива Sora. После ухода конкурента Google оказалась лицом к лицу главным образом с китайскими разработчиками – особенно с Seedance 2.0 от Alibaba. Азиатский аналог выдаёт картинку выдающегося качества, но тянет за собой целый шлейф проблем с авторскими правами.
Google чётко позиционирует новинку как оптимальное подход для массового продакшена и прототипирования. Авторы получают генерацию текста в видео (text-to-video) и картинки в видео (image-to-video) в разрешениях 720p и 1080p. Поддерживаются портретный (9:16) и ландшафтный (16:9) форматы, а длину роликов можно задать на 4, 6 или 8 секунд.
Под капотом у всего семейства Veo 3.1 трудится архитектура diffusion transformer (DiT). В отличие от традиционных диффузионных U-Net-моделей, которые часто теряются в длинных временных зависимостях, новинка оперирует пространственно-временными патчами. Иными словами, нейросеть воспринимает видео не как набор статичных 2D-картинок, а как непрерывную последовательность токенов в латентном пространстве.
Вычисления происходят в сжатом виде, минуя пиксельное пространство, что серьёзно экономит вычислительные ресурсы. Это обеспечивает лучшую временную согласованность: освещение, текстуры и геометрия объектов не плывут на протяжении всего сгенерированного клипа. Кроме того, Veo 3.1 Lite отлично понимает команды “кинематографического контроля” – нейросети можно скармливать технические директивы вроде “pan” (панорамирование) или “tilt” (наклон камеры).
В Google обещают новые апдейты для разработчиков скоро. К тому же, инструменты на базе Veo уже вовсю внедряются в экосистему компании, в том числе YouTube Shorts, Google Photos, Google Vids, приложение Gemini и специализированную утилиту Flow.
Читают сейчас

2 часа назад
Разработчик опубликовал Taiga‑S1 — компактную схема с 1,2 млн параметров для управления FreeCAD
Разработчик Шив Шанмугам (Shiv Shanmugam) представил Taiga‑S1 — компактную схема с 1,2 млн параметров, которая может разрабатывать 3D‑детали во FreeCAD. Нейросеть принимает решения приблизительно за 1

2 часа назад
Delta Intelligence представила Δ₀ — схема для человекоподобных роботов, которая управляет всем телом
Китайская организация Delta Intelligence представила Δ₀ (Delta-0) — базовую модель для человекоподобных роботов, которая одновременно управляет движением, балансом и манипуляциями с предметами. В демо

3 часа назад
Исследователи представили ткань, которая охлаждает на солнце и вырабатывает электричество от движений
Исследователи из Университета Иллинойса в Урбане‑Шампейне (США) представили 3D‑печатный статья для «умной» одежды, совмещающий пассивное охлаждение и генерацию электричества от движений человека. Чита

3 часа назад
Anthropic выкатила Claude Sonnet 5.5: на 30% быстрее и дешевле. Что изменилось?
Организация Anthropic анонсировала выпуск следующий модели в поколении 5.5 — Claude Sonnet 5.5. В то время как большие языковые модели часто наращивают параметры в ущерб скорости, Anthropic пошли по п

4 часа назад
Amazon планирует запустить доставку дронами в Австралии
Amazon готовится запустить доставку дронами в Австралии. Компания уже ищет представителя для переговоров с австралийскими регуляторами для получения соответствующих разрешений. Читать далее