TII представил Falcon-ASR для арабской речи
Technology Innovation Institute выпустил модель распознавания речи Falcon-ASR с фокусом на эмиратском диалекте. Она поддерживает пять языков, временные метки слов и доступна для тестирования через демо Hugging Face.

Technology Innovation Institute представил Falcon-ASR 7 октября 2026 года. Модель с 1,6 млрд параметров создана прежде всего для арабской речи, включая эмиратский диалект, но также работает с английским, французским, испанским и португальским языками. Один набор весов используется для всех пяти языков, без необходимости заранее указывать язык записи.
По оценке TII, средний показатель word error rate Falcon-ASR на шести арабских тестовых наборах составил 20,92%. Для сравнения команда приводит 23,17% у лучшего опубликованного результата в использованном срезе таблицы. Во внутренней проверке эмиратской речи модель получила WER 22,73% и character error rate 10,19%; компания называет эти показатели лучшими среди сопоставленных систем.
При обучении учитывались шум, перекрывающаяся речь, музыка, реверберация помещения, телефонные эффекты, а также изменения скорости и высоты голоса. Это должно соответствовать записям из встреч, звонков и других повседневных сценариев. Falcon-ASR также связывает каждое слово с его положением в аудио с помощью временных меток.
Сейчас модель можно попробовать через демо Hugging Face на собственных записях. API и нативные приложения, по описанию команды, запланированы, но в текущем материале не объявлены доступными.
Почему это важно
Falcon-ASR расширяет выбор открытых инструментов для транскрибации арабской речи и отдельно учитывает эмиратский диалект, смешение языков и сложные условия записи.