15 сентября 2026 г.
Gemini 3.8 Live и Gemini 3.8 Live Extended Thinking — это наши самые передовые модели живого диалога на сегодняшний день. Крупные обновления в области интеллекта и параллельного рассуждения делают их более интуитивными для совместной работы и решения сложных задач с помощью голоса.
Том Оуян (Tom Ouyang)
Главный инженер
Малини Джаганатан (Malini Jaganathan)
Сотрудник технического отдела от имени команды Gemini Audio
Ваш браузер не поддерживает аудиоэлемент.
Прослушать статью
[[duration]] мин.
Этот контент сгенерирован Google AI. Генеративный ИИ носит экспериментальный характер
Обновлено 17 сентября 2026 г.
Сегодня мы представляем две новые модели, которые привносят достижения в области рассуждений почти в реальном времени, чтобы более эффективно задействовать голосовых агентов и сделать общение с ИИ более интуитивным и интеллектуальным.
- Gemini 3.8 Live: создана для масштабируемости и экономической эффективности, сочетает в себе разговорный интеллект с плавным диалогом и визуальной привязкой.
- Gemini 3.8 Live Extended Thinking: создана для задач высокой сложности, обладает повышенным интеллектом и многошаговыми рассуждениями.
Для разработчиков и предприятий эти модели предоставляют основу для создания надежных голосовых агентов, готовых к внедрению в производство. Они также делают общение с Gemini в приложении Gemini, Google Workspace и Поиске более плавным и интерактивным, помогая вам решать сложные задачи с помощью одного лишь голоса.
Наслаждайтесь более плавным и интеллектуальным общением
Gemini 3.8 Live Extended Thinking обеспечивает выполнение задач и уровень интеллекта корпоративного уровня, занимая 1-е место в общем зачете по индексу качества речи Artificial Analysis (82.6), а также лидируя по выполнению агентских задач с показателем 68.6% в бенчмарке τ-Voice и 35.1% в бенчмарке τ-Voice-banking от Sierra. Она также обеспечивает мощные возможности рассуждения, набирая 97.7% в Big Bench Audio, сохраняя при этом крайне конкурентоспособную цену по сравнению с другими передовыми моделями.
Gemini 3.8 Live продемонстрировала высокую популярность среди пользователей, заняв второе место в Speech Agent Arena. Помимо такой производительности, она остается весьма экономичной, предоставляя разработчикам и предприятиям способную и эффективную модель, созданную для масштабирования.
В EVA-Bench от ServiceNow, бенчмарке для оценки голосовых агентов, наши модели сдвигают границы Парето для сложных рабочих процессов, успешно балансируя точность с качеством разговора.
Примечание: Тест запущен на Live API на платформе Gemini Enterprise Agent Platform.
Gemini 3.8 Live обрабатывает визуальные входы почти в реальном времени, обогащая беседы контекстом для более полезных ответов. Она автоматически определяет и переключается между 97 поддерживаемыми языками прямо во время разговора. Она выполняет инструменты и вызовы API в фоновом режиме, продолжая беседу, поэтому модель может подтверждать запросы и продолжать общение, пока задачи завершаются в фоне.
Для задач, требующих более глубоких рассуждений, 3.8 Live Extended Thinking рассуждает и говорит одновременно. Она обеспечивает повышенный интеллект для сложных рабочих процессов, сохраняя при этом беспрерывный ход беседы — используя ранние вербальные сигналы, такие как «Дайте мне проверить это…», чтобы естественно реагировать на запросы, и озвучивание прогресса в реальном времени, чтобы проводить пользователей через многоэтапные фоновые задачи по мере их выполнения.
В Google Workspace, Поиске и приложении Gemini наши модели Live обеспечивают более интуитивный и интерактивный опыт, особенно при решении самых сложных задач.
Расширение возможностей экосистемы голосовых технологий для разработчиков и предприятий
Используя Gemini Live API, такие платформы для разработчиков, как Agora, Fishjam, LangChain, LiveKit, Pipecat, Vercel и Vision Agents, позволяют разработчикам легко создавать и развертывать высокопроизводительные голосовые интерфейсы. Эти платформы управляют сложной инфраструктурой потоковой передачи мультимедиа в реальном времени за кулисами, позволяя разработчикам полностью сосредоточиться на создании пользовательского опыта.
Мы также сотрудничаем с такими компаниями, как Salesforce, Genspark и Lumeris, которые высоко оценивают 3.8 Live и 3.8 Live Extended Thinking, отмечая их впечатляющую задержку, плавность и возможности вызова инструментов.
Обеспечение прозрачности с помощью водяных знаков SynthID
Все аудиофайлы, сгенерированные нашими продуктами ИИ, помечены водяными знаками SynthID. Этот незаметный водяной знак встраивается непосредственно в аудиовыход, гарантируя, что контент, созданный ИИ, остается обнаруживаемым для предотвращения дезинформации. Подробную информацию о нашем подходе к безопасности и ответственности см. в карточке модели.
Начните использовать наши новейшие модели Gemini Audio:
3.8 Live внедряется начиная с сегодняшнего дня:
- Для разработчиков: в Gemini API и Google AI Studio
- Для предприятий: в частном предварительном просмотре в Gemini Enterprise и скоро в Gemini Enterprise для взаимодействия с клиентами
- Для всех: в Поиске Live
3.8 Live Extended Thinking внедряется начиная с сегодняшнего дня:
- Для разработчиков: в Gemini API и Google AI Studio
- Для предприятий: в частном предварительном просмотре в Gemini Enterprise и скоро в Gemini Enterprise для взаимодействия с клиентами и для бизнес-клиентов Google Workspace
- Для всех: в Gemini Live, а для подписчиков Google AI Pro и Ultra в Workspace в Документах, и для всех подписчиков Google AI в Gmail и Keep
Получайте последние новости от Google на свою электронную почту
Подпишитесь на наши рассылки с обновлениями продуктов, информацией о мероприятиях, специальными предложениями и многим другим.
Ваша информация будет использоваться в соответствии с политикой конфиденциальности Google. Вы можете отказаться от рассылки в любое время.








