Google выпустила голосовые модели Gemini 3.8 Live с поддержкой 97 языков

Google выпустила Gemini 3.8 Live и версию Live Extended Thinking — голосовые модели, которые говорят и одновременно обрабатывают задачи в фоне. Модели поддерживают 97 языков с переключением посреди разговора, понимают картинку и видео с камеры и вызывают внешние инструменты, не обрывая реплику.
Вариант Extended Thinking рассуждает по ходу речи: пока идёт диалог, длинная задача считается в фоне. По собственным данным Google, версия заняла первое место в рейтинге Speech to Speech Quality Index с 82,6 балла.
Цена в API одинаковая у обеих: 3 доллара за миллион входных аудиотокенов и 12 за выходные. Текст — 0,75 и 4,5 доллара. Доступ через Gemini API и AI Studio.
Logan Kilpatrick@OfficialLoganK
Say hello (literally) to Gemini 3.8 Live and 3.8 Live Extended Thinking, our new SOTA live audio models, available with frontier price + performance. 3.8 Live supports 97 languages (can seamlessly switch), async tool calls, and more! https://t.co/z29J9kelr3
3 46715 сентября 2026
Что говорят
deviationHacker News
Не лучшее впечатление, когда в демо-видео одна из твоих «самых продвинутых» моделей проигрывает самому известному матовому паттерну во всех шахматах.
doodlesdevHacker News
По моему опыту Live-режим Gemini уже сильно лучше голосового GPT, даже когда сам был тупее: реально ощущение разговора с живым человеком. ChatGPT постоянно мычит в ответ на что угодно и голоса какие-то странные. Обидно только, что 3.8 до подписчиков Google AI Plus ещё не докатили.
rdtscHacker News
Интересно, обойдёт ли Gemini когда-нибудь Fable и Astra. Год назад я бы уверенно поставил на Google — у них данные, TPU и жирная рекламная труба, — и всё равно они позади.