Google обновила видеомодель Gemini Omni Flash — ролик можно продлить до 40 секунд

Google обновила Gemini Omni Flash — мультимодальную модель, которая принимает и выдаёт видео, звук и текст. Версия 1.1 умеет продлевать готовый ролик отрезками по 10 секунд, всего до 40 секунд, и учитывает при этом до 10 секунд предыдущего видео как контекст.
Добавились управляющие ручки, которые разработчики просили: задать первый и последний кадр сцены, подставить видео-референс для стиля, черновой рендер в 360p и апскейл до 1080p и 4K. Черновик на низком разрешении нужен, чтобы перебирать варианты дёшево, а платить за качество один раз.
Модель доступна разработчикам через API Google.
Logan Kilpatrick@OfficialLoganK
Excited to bring Gemini Omni Flash 1.1 to the world, this is an update to our anything in, anything out world model. It now supports: - 360p drafts, 4K up samplers - up to 10 seconds of video context when extending - video extensions in 10 second increments - video references https://t.co/G2xaeDfULA
2 46827 августа 2026
Что говорят
simonwHacker News
Любопытно, что OpenAI полностью забросила Sora, а Google продолжает вкладываться в генерацию видео. Возможно, они видят в ней ключ к созданию «моделей мира».
Gecko4072Hacker News
Seedance хорош во многом благодаря TikTok, а это — благодаря YouTube. Интересно, какая доля всего снятого видео лежит приватно на домашних дисках и в Apple Photos: может, следующий этап — это просто вопрос доступа к данным, а не масштабирования?
petcatHacker News
Недавно услышал рекламу на радио и не понял, живой это голос или ИИ. Мы тут много обсуждаем, как генеративный ИИ влияет на разработчиков, но почти никогда — что он делает с актёрами озвучки и кино.