Google представила голосовые ИИ-модели Gemini 3.8 Live с 97 языками

Google представила голосовые ИИ-модели Gemini 3.8 Live и Gemini 3.8 Live Extended Thinking для диалогов в реальном времени. Первая версия рассчитана на масштабное применение и экономичность, а Extended Thinking — на сложные задачи с многошаговыми рассуждениями. С обеими моделями можно голосом взаимодействовать в приложении Gemini, сервисах Google Workspace и поиске.
Как сообщает Google, Gemini 3.8 Live Extended Thinking заняла первое место в индексе качества Speech to Speech Quality Index от Artificial Analysis с результатом 82,6. Модель также получила 68,6% в тесте агентного выполнения задач τ-Voice, 35,1% в банковском бенчмарке Sierra τ-Voice и 97,7% в Big Bench Audio. Базовая Gemini 3.8 Live заняла второе место в пользовательском рейтинге Speech Agent Arena.

Доступность моделей
| Модель | Разработчики | Другие пользователи |
|---|---|---|
| Gemini 3.8 Live | Gemini API и Google AI Studio | Search Live; закрытое тестирование Gemini Enterprise |
| Gemini 3.8 Live Extended Thinking | Gemini API и Google AI Studio | Gemini Live, Gmail, Keep и Docs для подходящих подписчиков |
Обе модели начинают развёртываться сегодня. Gemini 3.8 Live Extended Thinking появится в Gemini Live, а также в Gmail и Keep для подходящих подписчиков Google AI. В Docs она станет доступна подписчикам Google AI Pro и Ultra в Workspace, а для корпоративных клиентов Gemini Enterprise обе версии находятся в закрытом предварительном доступе.
Google добавляет в каждую аудиозапись, созданную её ИИ-продуктами, незаметную водяную метку SynthID. Компания утверждает, что она позволяет распознавать сгенерированный звук и помогает бороться с дезинформацией.



