Модели

Google описала три новые аудиомодели Gemini

По описанию видео на официальном канале Google for Developers, на мероприятии Gemini Audio at Night представили три новые модели для синтеза речи, перевода и мультимодальных приложений.

Иллюстрация AIFoxNews к материалу: Google описала три новые аудиомодели Gemini
Иллюстрация AIFoxNews

Google for Developers перечислила три запуска в области аудио. Gemini 3.8 TTS предназначена для синтеза речи с персонализацией голоса, включая настройку эмоций и резонанса. Gemini 3.5 Live Translate должна переводить аудио- и видеопотоки в реальном времени более чем на 100 языков. Gemini 3.8 Live получила мультимодальные возможности, в том числе вызов функций. По описанию, модели рассчитаны на разработчиков, которые создают приложения с аудио и видео.

Почему это важно

Разработчики получают заявленный набор моделей для голосовых интерфейсов, перевода медиапотоков и мультимодальных приложений.

Ответ строится только по опубликованным материалам сайта и может содержать ошибки — важное проверяйте по первоисточнику.