Представлены диалоговые системы Gemini 3.8 Live с функцией параллельного рассуждения

Компания Google представила диалоговые модели Gemini 3.8 Live и Gemini 3.8 Live Extended Thinking с поддержкой параллельного рассуждения. Анонсированные решения ориентированы на работу в режиме реального времени и предназначены для повышения эффективности голосовых ассистентов. Версия 3.8 Live разработана для масштабирования с упором на доступность и скорость, комбинируя обработку визуальных данных с диалоговыми возможностями. Вариант Extended Thinking создан для решения сложных задач, требующих многошагового анализа и повышенной точности.

​Представленные модели способны обрабатывать визуальные сигналы в реальном времени, придавая разговору дополнительный контекст. Системы поддерживают автоматическое определение и переключение между 97 языками непосредственно в процессе общения. Взаимодействие с внешними API и инструментами происходит в фоновом режиме, позволяя модели поддерживать диалог и озвучивать промежуточные этапы работы без паузы. Версия Extended Thinking может рассуждать и говорить одновременно, используя естественные речевые вводные фразы для подтверждения приема команды.

​Разработка внедряется в сервисы Google Workspace и Search, а также доступна разработчикам через Gemini Live API. Для защиты контента весь сгенерированный звук маркируется невидимым цифровым водяным знаком SynthID, интегрированным напрямую в аудиопоток для предотвращения распространения недостоверных сведений. Новые решения уже тестируются партнерами сферы корпоративных платформ и сторонних сервисов.

Источник: mobile-review.com

0 0 голоса
Рейтинг новости
1
0
Подписаться
Уведомить о
0 комментариев