Сегодня 02 июля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Google представила звуковую ИИ-модель Gemini 3.5 Live Translate для синхронного перевода с сохранением интонации

Компания Google представила новую модель Gemini 3.5 Live Translate, предназначенную для голосового перевода в режиме реального времени. Нейросеть автоматически распознает более 70 языков и генерирует перевод, сохраняя оригинальную интонацию, темп и высоту голоса спикера.

 Источник изображения: Google

Источник изображения: Google

В отличие от систем, ожидающих окончания фразы, новый алгоритм обрабатывает аудиопоток синхронно. Задержка между оригинальной репликой и переводом составляет несколько секунд и позволяет избежать неестественных пауз в диалоге. Модель адаптирована к работе в шумных условиях и не требует ручной настройки дополнительных параметров. В целях безопасности и борьбы с дезинформацией все сгенерированные аудиозаписи маркируются невидимым цифровым водяным знаком SynthID.

Инструмент уже доступен разработчикам в формате публичной предварительной версии через Gemini Live API и Google AI Studio, а интеграция с такими профильными платформами, как Agora, LiveKit и Vision Agents, позволяет создавать приложения без необходимости выстраивать собственную сложную инфраструктуру потоковой передачи медиа. В настоящее время технологию также тестирует азиатский сервис такси и доставки Grab, обрабатывающий более 10 миллионов звонков в месяц, для обеспечения коммуникации между водителями и клиентами.

В корпоративном сегменте внедрение алгоритма начнётся в текущем месяце в рамках закрытого тестирования для подписчиков Google Workspace в сервисе видеоконференций Google Meet. Обновление позволит переводить беседы, используя более 2000 языковых комбинаций в рамках одной встречи, тогда как предыдущая версия системы поддерживала только пять языков и требовала обязательное наличие английского. Широкий релиз для бизнеса запланирован на конец года.

Рядовые пользователи получат доступ к функции через глобальное обновление приложения Google Translate на платформах iOS и Android. При подключении любых наушников система будет транслировать переведённую речь напрямую собеседнику. Для владельцев устройств на базе Android также предусмотрен специальный «режим прослушивания» (listening mode), который позволяет услышать перевод прямо через динамик телефона. Как объясняет Google в свом блоге, эта функция может быть полезна в ситуациях, когда «нужно быстро услышать перевод, не привлекая внимания окружающих, и под рукой нет наушников».

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Epic Games Store устроил раздачу классической игры I Have No Mouth, and I Must Scream о последних людях на Земле, которых пытает безумный суперкомпьютер 5 мин.
Авторитетный инсайдер опроверг закрытие Obsidian Entertainment и работу студии над новой Fallout 2 ч.
Правительство США снова взломали: хакеры проникли в федеральную платформу для обмена разведданными 2 ч.
«Не можешь — научим, не хочешь — заставим»: Microsoft мобилизует 6000 сотрудников для помощи клиентам во внедрении ИИ 2 ч.
Браузер Opera получил продвинутую защиту от ввода вредоносных команд через буфер обмена 2 ч.
Google начала тестировать новую reCAPTCHA — пользователей просят показать руки в камеру, и не обязательно свои 2 ч.
ИИ оказался слишком дорогим: компании урезают сотрудникам доступ к ChatGPT и Claude 2 ч.
Студия создателя Deus Ex и System Shock перестанет делать игры — после провала Thick as Thieves в OtherSide осталось меньше десяти человек 3 ч.
Google не смогла отбиться от рекордного штрафа в €4,1 млрд в Европе 3 ч.
Кризис Xbox поставил под угрозу закрытия Obsidian — студию в ответе за Fallout: New Vegas, Pillars of Eternity и South Park: The Stick of Truth 4 ч.