Hugging Face запустила открытый рейтинг моделей синтеза речи
Hugging Face представила Open TTS Leaderboard для сравнения открытых многоязычных моделей синтеза речи и систем клонирования голоса.

30 сентября 2026 года Hugging Face опубликовала Open TTS Leaderboard — рейтинг для оценки открытых и многоязычных моделей text-to-speech. Авторы объясняют запуск тем, что выпуск новых моделей опережает развитие стандартизированной оценки, а пользовательские голосования не масштабируются достаточно быстро. Рейтинг сочетает объективные показатели разборчивости, скорости работы и сходства голоса. Для разборчивости используются ошибки распознавания текста, для скорости — показатели задержки и производительности инференса, а сходство голоса оценивается по эмбеддингам говорящего. Такой подход позволяет быстрее получать сопоставимые результаты между моделями. В интерфейсе можно переключаться между языками и режимом клонирования голоса. Отдельная вкладка позволяет прослушивать сгенерированные образцы и сравнивать их напрямую.
Почему это важно
Новый рейтинг даёт разработчикам единое место для сопоставления открытых TTS-моделей по нескольким практическим параметрам, а прослушивание результатов помогает дополнить числовые метрики.