Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%
← Към новините

Представяме Gemini 3.8 Live и 3.8 Live Extended Thinking

Представяме Gemini 3.8 Live и 3.8 Live Extended Thinking

15 септември 2026 г.

|

Gemini 3.8 Live и Gemini 3.8 Live Extended Thinking са най-усъвършенстваните ни модели за диалог в реално време досега. Значителните подобрения в интелигентността и паралелното разсъждение ги правят по-интуитивни за съвместна работа и използване за изпълнение на сложни задачи с гласа ви.


Том Оуянг

Главен инженер

Малини Джаганатан

Член на техническия екип, от името на екипа Gemini Audio


Текстът „Представяме Gemini 3.8 Live и 3.8 Live Extended Thinking“ със Spark на Gemini, всичко на светлосин фон

Днес представяме два нови модела, които предлагат напредък в разсъждението почти в реално време, за да осигурят по-ефективно гласови агенти и да направят разговорите с изкуствения интелект по-интуитивни и интелигентни.

  • Gemini 3.8 Live: Създаден за мащаб и ефективност на разходите, като съчетава разговорна интелигентност с плавен диалог и визуално заземяване.
  • Gemini 3.8 Live Extended Thinking: Създаден за задачи с висока сложност, с повишена интелигентност и многостъпково разсъждение.

За разработчиците и предприятията тези модели предоставят основата за надеждни, готови за продукционна среда гласови агенти. Те също така правят говоренето с Gemini в приложението Gemini, Google Workspace и Search по-плавно и съвместно — помагайки ви да се справяте със сложни задачи само с гласа си.

Изживейте по-плавни и интелигентни разговори

Gemini 3.8 Live Extended Thinking осигурява завършване на задачи и интелигентност от корпоративен клас, като заема първо място като цяло в Speech to Speech Quality Index на Artificial Analysis (82,6%) и води по завършване на агентни задачи с 68,6% в τ-Voice и 35,1% в бенчмарка τ-Voice-banking на Sierra. Той също така предлага силни способности за разсъждение, постигайки 97,7% в Big Bench Audio, като същевременно запазва изключително конкурентна цена спрямо други водещи модели.

Gemini 3.8 Live показва високо предпочитание от потребителите, като заема второ място в Speech Agent Arena. Освен тези резултати той остава изключително рентабилен — предоставяйки на разработчиците и предприятията способен и ефективен модел, създаден за мащаб.

Диаграма, показваща Speech to Speech Index на Artificial Analysis
Диаграма, показваща агентните резултати на Artificial Analysis
Диаграма, показваща Sierra
Диаграма, показваща разходите на Artificial Analysis за час входящо аудио

В EVA-Bench на ServiceNow — бенчмарк за оценяване на гласови агенти — нашите модели разширяват границата на Парето за сложни работни процеси, като успешно балансират точността с качеството на разговора.

Забележка: Тестът е проведен в Live API на Gemini Enterprise Agent Platform.

Диаграма, показваща EVA Bench Experience спрямо завършването на задачата

Gemini 3.8 Live обработва визуални входове почти в реално време, обогатявайки разговорите с контекст за по-полезни отговори. Той автоматично открива и преминава между 97 поддържани езика по време на разговора. Изпълнява инструменти и API извиквания във фонов режим, докато разговорът продължава, така че моделът може да потвърждава заявките и да продължава разговора, докато задачите приключат във фонов режим.

Gemini 3.8 Live насочва въвеждането на нов служител в реално време, като използва визуален контекст, за да отговаря на въпроси на живо.

Гледайте как Gemini 3.8 Live играе шах почти в реално време, използвайки визуален контекст, разсъждение и естествен разговорен поток.

За задачи, които изискват по-задълбочено разсъждение, 3.8 Live Extended Thinking разсъждава и говори едновременно. Той осигурява повишена интелигентност за сложни работни процеси, като същевременно поддържа непрекъснат разговорен поток — използвайки ранни словесни сигнали като „Нека проверя това…“, за да потвърждава естествено подканите, и разказ в реално време за напредъка, който превежда потребителите през многостъпкови фонови задачи, докато те се изпълняват.

Гледайте как Gemini 3.8 Live Extended Thinking превръща необработени скици и гласова обратна връзка почти в реално време във функционални React компоненти.

Вижте как Gemini 3.8 Live Extended Thinking координира многостъпкови резервации и асинхронни извиквания на функции — всичко това без прекъсване на естествения разговор на живо.

Гледайте как Gemini 3.8 Live създава цялостни бизнес планове и персонализирани маркетингови инструменти в движение чрез естествена реч.

В Google Workspace и Search нашите модели Live осигуряват по-интуитивни и съвместни изживявания — особено когато се справяте с най-сложните си задачи.

Изпробвайте Gemini 3.8 Live Extended Thinking в Google Workspace с Docs Live, Gmail Live и Keep Live.

Получавайте помощ за отстраняване на проблеми стъпка по стъпка в реално време, осигурена от Gemini 3.8 Live — директно в Search Live.

Подкрепяме екосистемата от гласови решения за разработчици и предприятия

Чрез използването на Gemini Live API платформи за разработчици като Agora, Fishjam, LiveKit, Pipecat, Vercel и Vision Agents позволяват на разработчиците лесно да създават и внедряват високопроизводителни интерфейси, управлявани с глас. Тези платформи управляват сложната инфраструктура за поточно предаване на медии в реално време във фонов режим, което позволява на разработчиците да се съсредоточат изцяло върху създаването на потребителското изживяване.

Също така си партнираме с компании като Salesforce, Genspark и Lumeris, които са развълнувани от 3.8 Live и 3.8 Live Extended Thinking и подчертават впечатляващата им латентност, плавност и способности за извикване на инструменти.

Цитат от Salesforce
Цитат от 11Sight
Цитат от Equal AI
Цитат от ServiceNow
Цитат от Genspark
Цитат от Lenskart
Цитат от Lumeris
Цитат от Agora
Цитат от Ambr AI
Цитат от LiveKit
Цитат от Casuu

Осигурете прозрачност с водни знаци SynthID

Всички аудио материали, генерирани от продуктите ни с изкуствен интелект, са маркирани с воден знак SynthID. Този незабележим воден знак е вплетен директно в аудиоизхода, като гарантира, че генерираното от изкуствен интелект съдържание остава откриваемо и помага за предотвратяване на дезинформацията. За подробности относно подхода ни към безопасността и отговорността прегледайте картата на модела.

Започнете да използвате най-новите ни аудио модели Gemini:

3.8 Live започва да се предоставя от днес:

3.8 Live Extended Thinking започва да се предоставя от днес:

  • За разработчици: В Gemini API и Google AI Studio
  • За предприятия: В частен преглед в Gemini Enterprise и скоро в Gemini Enterprise for Customer Experience и за бизнес клиентите на Google Workspace
  • За всички: В Gemini Live, както и за абонатите на Google AI Pro и Ultra в Workspace — в Docs, и за всички абонати на Google AI — в Gmail и Keep

Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.

Първоначално публикувано от DeepMind на

Прочетете оригинала в DeepMind ↗

Текстът и изображенията са собственост на DeepMind и са възпроизведени тук с посочване на авторството и връзка към оригиналната публикация.

← Към новините

Още новини

Всички последни новини