An objective evaluation of the effects of recording conditions and speaker characteristics in multi-speaker deep neural speech synthesis
Audio Samples
Beáta Lőrincz1,2, Adriana Stan1, Mircea Giurgiu1
1Communications Department, Technical University of Cluj-Napoca, Romania 2Department of Computer Science, ”Babeş-Bolyai” University, Cluj-Napoca, Romania
Texts:
Autoritățile lasă criminalii liberi pe stradă cu bună știință.
În Polonia, cota este de șapte zero procent.
Am tras de mine în ultima perioadă, însă trebuie să mă las.
Speaker
Natural
GR
PH
EXT
EME
MAR
SAM
RMS
SGS
TSS
Home recording
Texts:
Sunt foarte bune fetele.
În octombrie, angajații acestei secții ar urma să-și piardă locul de muncă.
În această perioadă au început însă să crească solicitările.