Authors
Loading...
This evaluation captures responsiveness and latency in 13 open-source text-to-speech models, highlighting reproducibility.
Dinh et al. (2025) studied this question.