wiki:VoiceConversionDevelopment

Version 1 (modified by 226140, 2 weeks ago) ( diff )

--

Развој на конверзија на говорен глас

Втората фаза се фокусираше на имплементација на процесот на конверзија на гласот користејќи го моделот на говорен глас развиен во F1. Обучениот модел ConVoxAI-speech со RVC беше користен за конвертирање на надворешни говорни снимки во целниот глас, додека се одржуваше оригиналната говорна содржина и вокалниот тајминг.

Конверзијата беше извршена преку функционалноста за инференција на Applio. Обучениот .pth модел и соодветната .index датотека беа вчитани во системот, по што надворешни говорни снимки беа обезбедени како влез. Различни параметри за инференција беа тестирани за да се постигне природна конверзија, а воедно да се зачува висината, изговорот и карактеристиките на оригиналната изведба.

Завршениот процес на конверзија успешно произведе говор конвертиран кон целниот глас. Резултатите од оваа фаза потоа беа искористени како дел од тестирањето и евалуацијата извршени во F4.

Конверзија на говорен глас

Attachments (4)

Download all attachments as: .zip

Note: See TracWiki for help on using the wiki.