В России представлено новое поколение технологии синтеза речи
Российская компания Neuro.net разработала новое поколение технологии синтеза речи, в которой большие языковые и диффузионные модели совместно генерируют голос с учетом его акустических особенностей и контекста.

«Новый Neuro TTS построен на современной архитектуре. Бизнес может задавать характер звучания AI-агентов и встраивать синтез в свои сервисы через API», – сообщили в пресс-службе компании, уточнив, что разработка предназначена для использования в голосовых AI-решениях.
Платформа уже доступна в рабочих сервисах. В потоковом режиме Neuro TTS начинает передавать аудиоданные через 120 миллисекунд после запроса, что позволяет запускать воспроизведение до завершения генерации всей реплики.
Разработка опирается на опыт компании в автоматизации контакт-центров, где синтез речи – часть полноценного диалога с клиентом.
«Я не считаю, что развитие искусственного интеллекта в России должно быть территорией всего лишь нескольких корпораций. У независимых технологических компаний тоже должны быть амбиции задавать темп рынку. В Neuro.net мы годами развиваем собственные технологии разговорного ИИ. Для нас это и технологическая независимость, и возможность самим определять, на что способны наши продукты, которые должны выдерживать сравнение с лучшими мировыми решениями», – заявил глава группы компаний, в которую входит Neuro.net, Александр Цепелев.








































