| | 1 | |
| | 2 | = Развој на модел и конверзија на глас при пеење |
| | 3 | |
| | 4 | Третата фаза се фокусираше на развивање на посебен гласовен модел за конверзија на пеечкиот глас. За обука беше подготвен наменски збир на податоци што се состоеше од приближно 17 минути од снимките на корисникот за пеење и акапела. Снимките вклучуваа различни вокални стилови, вклучувајќи мелодично пеење, рап и јамајкански патоис изведби, обезбедувајќи варијација во вокалните карактеристики присутни во податоците за обука. |
| | 5 | |
| | 6 | Збирот на податоци беше обработен и потребните карактеристики на висината и звучникот беа извлечени со помош на Applio. Обуката беше извршена со помош на Tesla T4 GPU преку Google Colab и беше успешно завршена по 30 епохи. Обучениот модел на пеење ConVoxAI и неговата соодветна индексна датотека беа генерирани и подготвени за инференција. |
| | 7 | |
| | 8 | Конечниот модел беше тестиран на надворешен вокален материјал за да се процени неговата способност да ги конвертира изведбите и во пеење и во рап стил во целниот глас. Конвертираниот вокал беше исто така тестиран заедно со оригиналниот инструментал за да се процени колку добро генерираниот глас ги зачувал тонот, мелодијата и изведбата на оригиналната песна. |
| | 9 | |
| | 10 | == Тренирање на глас при пеење |
| | 11 | |
| | 12 | [[Image(singing-training1.png)]] |
| | 13 | [[Image(singing-training2.png)]] |
| | 14 | [[Image(singing-training3.png)]] |
| | 15 | [[Image(singing-training4.png)]] |
| | 16 | [[Image(singing-training5.png)]] |
| | 17 | |
| | 18 | == Алатка за извлеквање на вокалната акапела од оригиналните песни |
| | 19 | |
| | 20 | [[Image(vocal-remover-tool.png)]] |
| | 21 | [[Image(setting-used-for-removing-vocals.png)]] |
| | 22 | |
| | 23 | == Конверзија на глас при пеење |
| | 24 | |
| | 25 | [[Image(singing-conversion1.png)]] |
| | 26 | [[Image(singing-conversion2.png)]] |
| | 27 | [[Image(singing-conversion3.png)]] |
| | 28 | [[Image(singing-conversion4.png)]] |
| | 29 | |
| | 30 | |
| | 31 | |
| | 32 | |