Кратко
Представлена модель LuxTTS, способная клонировать голос по короткому аудиофайлу. Она позволяет синтезировать речь студийного качества, значительно ускоряя процесс и снижая требования к ресурсам. Это открывает новые возможности для создателей контента, разработчиков и бизнеса.
- Модель LuxTTS клонирует голос на основе аудиозаписи продолжительностью всего несколько секунд.
- Качество звука достигает 48 кГц, что обеспечивает чистое звучание без «металлического» призвука.
- Скорость синтеза в 150 раз превышает реальное время, позволяя озвучивать часовую лекцию за считанные минуты.
- Для работы LuxTTS требуется менее 1 ГБ видеопамяти, что позволяет запускать ее на обычных компьютерах.
- Обработка данных происходит локально, обеспечивая конфиденциальность информации пользователя.