Российская компания разработала новую технологию синтеза речи для голосовых ИИ
Аудиоданные начинают передаваться через 120 миллисекунд© Ferra.ru
Платформа уже доступна для бизнеса. Синтез можно встраивать в сервисы через программный интерфейс. В потоковом режиме аудиоданные начинают передаваться через 120 миллисекунд после запроса, что позволяет воспроизводить речь до завершения генерации.
Технология опирается на опыт компании в автоматизации контакт-центров. Голосовой искусственный интеллект должен распознать речь клиента, определить намерение, сформировать ответ и озвучить его естественно.
Глава группы компаний Александр Цепелев отметил, что развитие искусственного интеллекта в России не должно быть территорией нескольких корпораций. Независимые компании тоже должны задавать темп рынку. Он подчеркнул, что Neuro.net годами развивает собственные технологии разговорного искусственного интеллекта и готова создавать конкуренцию.