Sounds familiar: A speaker identity-controllable framework for machine speech translation
Researchers propose a deep learning-based model for mimicking and continuously modifying speaker voice identity during speech translationCredit: Masato Akagi Ishikawa, ...




















