반응형
LPCNet: Improving Neural Speech Synthesis Through Linear Prediction음성 합성 모델은 실시간 동작을 위해 많은 GPU를 필요로 함LPCNet음성 합성 효율성 향상을 위해 linear prediction을 활용한 WaveRNN의 변형 모델동일한 네트워크 크기에 대해 WaveRNN 보다 더 높은 품질과 낮은 복잡도를 달성논문 (ICASSP 2019) : Paper Link1. IntroductionNeural network 기반의 음성 합성 모델은 고품질의 음성 합성을 가능하게 함WaveNet과 같은 1세대 모델들은 수백억 개의 GFLOPS를 제공하는 high-end GPU를 기반으로 구성됨따라서 GPU가 없고 배터리가 제한된 모바일 환경에서 활용할 수 있..
Paper/Vocoder
2023. 12. 15. 11:17
반응형