Generative source separation methods such as non-negative matrix factorization (NMF) or auto-encoders, rely on the assumption of an output probability density. Generative Adversarial Networks (GANs) can learn data distributions without needing a parametric assumption on the output density. We show on a speech source separation experiment that, a multilayer perceptron trained with a Wasserstein-GAN formulation outperforms NMF, auto-encoders trained with maximum likelihood, and variational auto-encoders in terms of source to distortion ratio.
Paper
References (14)
02Wasserstein GANMartín Arjovsky, Soumith Chintala, L. Bottou2017 · arXiv.org · 5.2k citations In Library
03NIPS 2016 Tutorial: Generative Adversarial NetworksI. Goodfellow2016 · arXiv.org · 1.8k citations In Library
Scroll for more · 2 remaining