Побољшање модела

#1
by mllearner123 - opened

Хвала за модел.

Видим да имаш хардверске ресурсе за тренирање модела. Имам предлог за finetune-овање још бољег модела
искористи ParlaSpeech скупове података са хрватског за претренирање модела (ћирилизуј њихове текстове да би излазни текст токени остали исти)
затим тренирај на српском ParlaSpeech скупу и на крају на скупу Јужне вести
а имаш и CommonVoice датасет за српски,
https://huggingface.co/datasets/shunyalabs/serbian-speech-dataset
такође имаш NVIDIA модел и њихов генерисани датасет за хрватски који такође може да се искористи у фази претренирања
https://huggingface.co/nvidia/parakeet-tdt-0.6b-v3
https://huggingface.co/datasets/nvidia/Granary

Sign up or log in to comment