Gemini 3.5 Live Translate: более 70 языков, но в Meet пока только шесть

Google выпустила Gemini 3.5 Live Translate как модель непрерывного перевода речи в речь. Анонс Google от 9 июня 2026 года указывает более 70 автоматически распознаваемых языков, задержку в несколько секунд и сохранение интонации, темпа и высоты голоса.
К 14 августа главное уточнение касается не самой модели, а различий между сервисами. Открытая справка Google Meet сейчас перечисляет шесть языков для перевода относительно английского — французский, немецкий, хинди, итальянский, португальский и испанский, допускает одну языковую пару на встречу и устанавливает предел в 90 минут.
Чем новый перевод отличается от прежнего режима разговора
Ключевое изменение заключается в потоковой обработке звука. Система не обязана ждать окончания каждой реплики: она получает речь последовательно, набирает необходимый контекст и начинает озвучивать перевод, пока человек продолжает говорить. Именно поэтому функцию можно считать близкой к синхронному переводу, хотя полностью одновременной она не является.
Небольшое отставание здесь неизбежно и полезно для смысла. Переводчику нужно понять, к чему относятся местоимения, какое значение имеет многозначное слово и где заканчивается смысловая конструкция. Если воспроизводить результат слишком рано, возрастает риск, что следующая часть фразы потребует исправить уже произнесённый перевод.
Модель также пытается передавать особенности исходного голоса. Речь идёт не о точной копии человека, а о сохранении общего темпа, выразительности и высоты звучания. Сгенерированное аудио помечается невоспринимаемым на слух водяным знаком SynthID, позволяющим выявлять происхождение такого звука.
Что доступно в Google Translate
Наиболее полный пользовательский сценарий реализован в приложении Google Translate. Инструкция Google Translate для Android содержит список из более чем 70 языков, включая русский, и описывает режимы прослушивания, разговора, текстового вывода и ручной настройки воспроизведения.
В режиме прослушивания перевод можно получать через наушники или разговорный динамик, поднеся телефон к уху. В режиме беседы звук выводится через основной динамик либо подключённые наушники, а микрофон определяет, когда один язык сменяется другим. Сеанс продолжает работать при переходе в другое приложение, сворачивании переводчика и блокировке экрана.
Для очного разговора предусмотрен разделённый экран. Каждый собеседник видит исходную расшифровку и перевод на своей половине дисплея, поэтому участникам не приходится передавать телефон после каждой фразы. Однако они всё равно должны говорить по очереди: одновременная речь нескольких людей затрудняет распознавание и разделение реплик.
Поддержка языка не означает одинаковую точность во всех обстоятельствах. Имена, числа, редкие термины, сильный акцент, шум и нестабильное соединение могут изменить результат. Для медицинских, юридических и других разговоров, где неточность влияет на решение, автоматический голосовой перевод нельзя считать безусловной заменой квалифицированному специалисту.
Почему возможности Google Meet пока уже
Перевод речи в Google Meet развивается отдельно от мобильного переводчика. Доступный набор строится вокруг английского: участник выбирает его и один из поддерживаемых языков, а организатор задаёт общую комбинацию для встречи. Чтобы сменить её, функцию необходимо остановить и запустить снова.
Доступ зависит от учётной записи организатора, тарифа, настроек организации, региона и устройства. Участник должен отдельно разрешить перевод своего голоса и может отозвать согласие. Подключившиеся через оборудование переговорной комнаты способны слушать результат, но их собственная речь не переводится.
Видеовстречи также сохраняют ограничения по способу использования. Переведённый звук недоступен в прямых трансляциях и записях, а небольшая задержка считается штатным поведением: дополнительное время помогает закончить смысловую часть фразы. Возможны грамматические ошибки, неразборчивые слова, неожиданный акцент и изменение манеры синтезированного голоса при смене говорящего.
Это означает, что заявленный языковой охват Gemini 3.5 Live Translate нельзя автоматически переносить на любую функцию с похожим названием. Модель уже обслуживает широкий мобильный сценарий, тогда как Meet использует собственный набор языков, правила допуска и ограничения сеанса. Анонсированное расширение видеовстреч остаётся отдельным этапом поэтапного запуска.
Что выпуск меняет для пользователя
Главное практическое отличие — исчезновение обязательной паузы после каждой законченной фразы. Пользователь может слушать экскурсию, выступление или беседу непрерывно, а перевод следует за речью с небольшим отставанием. При этом результат остаётся машинным: естественное звучание не гарантирует точной передачи каждого смысла.
Для русскоязычного пользователя наиболее доступный вариант сейчас связан с Google Translate на Android, поскольку русский включён в опубликованный перечень приложения. Наличие русского в одном сервисе не доказывает его доступность в Meet: продукты имеют разные языковые списки и условия запуска.
Таким образом, Gemini 3.5 Live Translate уже работает как потоковый голосовой перевод, а не только как показ технологии. Но единого запуска на всей платформе Google не произошло: мобильный переводчик предлагает широкий языковой охват, а видеовстречи пока сохраняют значительно более узкие границы.
Читайте также:
- Google представила Gemini Spark — личного ИИ-агента, который работает 24/7, пишет письма, следит за почтой и скоро будет тратить ваши деньги
- Бунт в Google: Более 500 сотрудников требуют расторгнуть контракты с Пентагоном
- Google сделала персонализированную генерацию изображений в Gemini бесплатной для пользователей из США
Подпишитесь на рассылку
Получайте свежие новости Web3, AI и криптовалют прямо на вашу почту.