Инструменты

Hugging Face запустила открытый рейтинг моделей синтеза речи

Hugging Face представила Open TTS Leaderboard для сравнения открытых многоязычных моделей синтеза речи и систем клонирования голоса.

Иллюстрация AIFoxNews к материалу: Hugging Face запустила открытый рейтинг моделей синтеза речи
Иллюстрация AIFoxNews

30 сентября 2026 года Hugging Face опубликовала Open TTS Leaderboard — рейтинг для оценки открытых и многоязычных моделей text-to-speech. Авторы объясняют запуск тем, что выпуск новых моделей опережает развитие стандартизированной оценки, а пользовательские голосования не масштабируются достаточно быстро. Рейтинг сочетает объективные показатели разборчивости, скорости работы и сходства голоса. Для разборчивости используются ошибки распознавания текста, для скорости — показатели задержки и производительности инференса, а сходство голоса оценивается по эмбеддингам говорящего. Такой подход позволяет быстрее получать сопоставимые результаты между моделями. В интерфейсе можно переключаться между языками и режимом клонирования голоса. Отдельная вкладка позволяет прослушивать сгенерированные образцы и сравнивать их напрямую.

Почему это важно

Новый рейтинг даёт разработчикам единое место для сопоставления открытых TTS-моделей по нескольким практическим параметрам, а прослушивание результатов помогает дополнить числовые метрики.

Ответ строится только по опубликованным материалам сайта и может содержать ошибки — важное проверяйте по первоисточнику.