Яндекс.Метрика
← Дайджест от 1 сентября 2026

Google научила Gemini разбирать длинные видео выборочно — дешевле и точнее

Google добавила в свои модели Gemini агентную обработку видео. Вместо того чтобы прогонять весь ролик в модель кадр за кадром, модель сама решает, что смотреть — читает расшифровку речи, меняет частоту кадров, обращается к нужным фрагментам. По данным компании, на длинных видео это экономит до 88% токенов и при этом повышает точность.

Режим включается в Gemini API отдельно для каждого видео и доступен на новых моделях, включая 3.7 Flash. Омар Сансевьеро из Google приводит порядок величин: вместо 200 тысяч токенов на длинный ролик модель тратит существенно меньше, попутно снижая задержку ответа.

Logan Kilpatrick@OfficialLoganK
Introducing Agentic Video in the Gemini API, a new way to process long videos which reduces token consumption by up to 88% while also increasing quality. This can be controlled easily in the API on a per video basis, available with our newest models like 3.7 Flash! https://t.co/JrIqn4bZic
1 сентября 2026