| Version 1 (modified by , 2 weeks ago) ( diff ) |
|---|
Развој на конверзија на говорен глас
Втората фаза се фокусираше на имплементација на процесот на конверзија на гласот користејќи го моделот на говорен глас развиен во F1. Обучениот модел ConVoxAI-speech со RVC беше користен за конвертирање на надворешни говорни снимки во целниот глас, додека се одржуваше оригиналната говорна содржина и вокалниот тајминг.
Конверзијата беше извршена преку функционалноста за инференција на Applio. Обучениот .pth модел и соодветната .index датотека беа вчитани во системот, по што надворешни говорни снимки беа обезбедени како влез. Различни параметри за инференција беа тестирани за да се постигне природна конверзија, а воедно да се зачува висината, изговорот и карактеристиките на оригиналната изведба.
Завршениот процес на конверзија успешно произведе говор конвертиран кон целниот глас. Резултатите од оваа фаза потоа беа искористени како дел од тестирањето и евалуацијата извршени во F4.
Конверзија на говорен глас
Attachments (4)
- conversion1.png (64.1 KB ) - added by 2 weeks ago.
- conversion2.png (91.5 KB ) - added by 2 weeks ago.
- conversion3.png (106.4 KB ) - added by 2 weeks ago.
- conversion4.png (122.1 KB ) - added by 2 weeks ago.
Download all attachments as: .zip




