Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%
← До новин

Представляємо Gemini 3.8 Live і 3.8 Live Extended Thinking

Представляємо Gemini 3.8 Live і 3.8 Live Extended Thinking

15 вересня 2026 р.

|

Gemini 3.8 Live і Gemini 3.8 Live Extended Thinking — це наші найдосконаліші моделі для живого діалогу. Значні вдосконалення інтелекту та паралельного міркування роблять їх більш інтуїтивними для спільної роботи й використання голосу для виконання складних завдань.


Том Оуян

Головний інженер

Маліні Джаганатан

Технічна співробітниця, від імені команди Gemini Audio


Text "Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking" with the Gemini Spark, all on a light blue background

Сьогодні ми представляємо дві нові моделі, які забезпечують удосконалення міркування майже в реальному часі, щоб ефективніше підтримувати голосових агентів і зробити спілкування зі штучним інтелектом більш інтуїтивним та інтелектуальним.

  • Gemini 3.8 Live: створена для масштабування та економічної ефективності, поєднує інтелектуальність у діалозі з плавним спілкуванням і візуальним контекстом.
  • Gemini 3.8 Live Extended Thinking: створена для завдань високої складності, забезпечує підвищений рівень інтелекту та багатокрокове міркування.

Для розробників і підприємств ці моделі надають будівельні блоки для надійних, готових до використання у виробництві голосових агентів. Вони також роблять спілкування з Gemini у застосунку Gemini, Google Workspace і Пошуку більш плавним та спільним — допомагаючи виконувати складні завдання лише за допомогою голосу.

Більш плавні й інтелектуальні розмови

Gemini 3.8 Live Extended Thinking забезпечує виконання завдань і інтелект корпоративного рівня, посідаючи перше місце в загальному рейтингу Artificial Analysis Speech to Speech Quality Index (82,6), а також лідирує у виконанні агентних завдань із результатом 68,6% у τ-Voice і 35,1% у бенчмарку τ-Voice-banking від Sierra. Вона також має потужні можливості міркування, набираючи 97,7% у Big Bench Audio, водночас зберігаючи дуже конкурентоспроможну ціну порівняно з іншими передовими моделями.

Gemini 3.8 Live продемонструвала високий рівень уподобань користувачів, посівши друге місце в Speech Agent Arena. Окрім таких результатів, вона залишається дуже економічною — надаючи розробникам і підприємствам потужну та ефективну модель, створену для масштабування.

a chart showing Artificial Analysis Speech to Speech Index
A chart showing Artificial Analysis agentic performance
A chart showing Sierra
A chart showing Artificial Analysis cost per hour of input audio

У EVA-Bench від ServiceNow — бенчмарку для оцінювання голосових агентів — наші моделі розширюють фронт Парето для складних робочих процесів, успішно балансуючи точність і якість діалогу.

Примітка: тестування проводилося в Live API на Gemini Enterprise Agent Platform.

A chart showing EVA Bench Experience to Task Completion

Gemini 3.8 Live обробляє візуальні дані майже в реальному часі, доповнюючи розмови контекстом для корисніших відповідей. Вона автоматично виявляє та перемикається між 97 підтримуваними мовами просто під час розмови. Модель виконує інструменти й виклики API у фоновому режимі, продовжуючи розмову, тож може підтверджувати отримання запитів і спілкуватися, поки завдання завершуються у фоні.

Gemini 3.8 Live у реальному часі допомагає адаптувати нових працівників, використовуючи візуальний контекст для відповідей на запитання під час прямої взаємодії.

Дивіться, як Gemini 3.8 Live грає в шахи майже в реальному часі, використовуючи візуальний контекст, міркування та природний перебіг розмови.

Для завдань, що потребують глибшого міркування, 3.8 Live Extended Thinking міркує та говорить одночасно. Вона забезпечує підвищений рівень інтелекту для складних робочих процесів, зберігаючи безперервний перебіг розмови — використовуючи ранні словесні сигнали, як-от «Дайте я це перевірю…», щоб природно реагувати на запити, а також озвучування поточного прогресу, щоб супроводжувати користувачів під час виконання багатокрокових фонових завдань.

Дивіться, як Gemini 3.8 Live Extended Thinking перетворює ескізи та голосовий зворотний зв’язок майже в реальному часі на функціональні компоненти React.

Дізнайтеся, як Gemini 3.8 Live Extended Thinking координує багатокрокове бронювання та асинхронні виклики функцій — і все це без переривання природної розмови в реальному часі.

Дивіться, як Gemini 3.8 Live створює повні бізнес-плани та індивідуальні маркетингові набори інструментів на льоту за допомогою природного мовлення.

У Google Workspace і Пошуку наші моделі Live забезпечують більш інтуїтивний спільний досвід — особливо під час виконання найскладніших завдань.

Спробуйте Gemini 3.8 Live Extended Thinking у Google Workspace за допомогою Docs Live, Gmail Live і Keep Live.

Отримуйте покрокову допомогу з усунення несправностей у реальному часі на основі Gemini 3.8 Live — безпосередньо в Search Live.

Розвиток екосистеми голосових технологій для розробників і підприємств

Використовуючи Gemini Live API, платформи для розробників, як-от Agora, Fishjam, LiveKit, Pipecat, Vercel і Vision Agents, дають змогу розробникам легко створювати й розгортати високопродуктивні інтерфейси, керовані голосом. Ці платформи керують складною інфраструктурою потокової передачі медіаданих у реальному часі у фоновому режимі, даючи розробникам змогу повністю зосередитися на створенні користувацького досвіду.

Ми також співпрацюємо з такими компаніями, як Salesforce, Genspark і Lumeris, які зацікавлені в 3.8 Live і 3.8 Live Extended Thinking та відзначають їхню вражаючу затримку, плавність і можливості виклику інструментів.

Salesforce quote
11Sight Quote
Equal AI Quote
ServiceNow quote
Genspark quote
Lenskart quote
Lumeris quote
Agora quote
Ambr AI quote
LiveKit Quote
Casuu quote

Забезпечуйте прозорість за допомогою водяних знаків SynthID

Усі аудіоматеріали, створені нашими продуктами зі штучним інтелектом, мають водяний знак SynthID. Цей непомітний водяний знак безпосередньо вбудовується у вихідний аудіосигнал, забезпечуючи можливість виявлення контенту, створеного ШІ, і допомагаючи запобігати поширенню дезінформації. Докладніше про наш підхід до безпеки та відповідального використання читайте в картці моделі.

Почніть використовувати наші найновіші аудіомоделі Gemini:

Розгортання 3.8 Live розпочинається сьогодні:

Розгортання 3.8 Live Extended Thinking розпочинається сьогодні:

  • Для розробників: у Gemini API і Google AI Studio
  • Для підприємств: у режимі приватного попереднього перегляду в Gemini Enterprise, а незабаром — у Gemini Enterprise for Customer Experience і для корпоративних клієнтів Google Workspace
  • Для всіх: у Gemini Live, а також для підписників Google AI Pro і Ultra у Workspace в Docs та для всіх підписників Google AI у Gmail і Keep

Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.

Вперше опубліковано виданням DeepMind

Читати оригінал на DeepMind ↗

Текст і зображення належать DeepMind і наводяться тут із зазначенням авторства та посиланням на оригінальну публікацію.

← До новин

Ще новини

Усі останні новини