Разработка модуля синтеза речи “Силеро”
Цели и задачи проекта - разработать программный модуль для качественного синтеза речи на языках народов России и СНГ, позволяющий генерировать аудиосигнал со скоростью, превышающей скорость воспроизведения в 10 раз, с автоматизированной расстановкой ударений и буквы ё для русского языка, с двумя возможными частотами дискретизации: 8 килогерц (телефония) или 16 килогерц (повышенное качество). Обоснование актуальности НИОКР: Проекты для синтеза речи, доступные публично, не предоставляют инструментов для качественного синтеза со скоростью, кратно превышающей скорость воспроизведения, и не требующих значительных вычислительных мощностей и как правило требуют наличие GPU для использования; Существующие модели для русского языка, помимо общих недостатков систем для синтеза речи, не предоставляют функционала для автоматической расстановки ударений и буквы ё; Насколько нам известно модели для синтеза речи языков малых народов России и СНГ недоступны публично; У публичных проектов четко не описаны требования по количеству требуемого аудио для получения качественного синтеза. У нас получалось добиться приемлемого звучания синтезированного голоса на количестве аудио вплоть до 5 - 15 минут записанной речи диктора для голосов, похожие на имеющиеся у нас голоса на имеющихся у нас языках. Возможные потребители результатов реализации проекта: Сервисы продажи аудиокниг; Колл-центры и поставщики телефонии и ПО для автоматизации колл-центров; Производители оборудования для людей с ограниченными возможностями.
Производитель: ОБЩЕСТВО С ОГРАНИЧЕННОЙ ОТВЕТСТВЕННОСТЬЮ "СИЛЕРО"
Ссылка
Направление
IT
