Asaad, I., Jacquelin, M., Perrotin, O., Girin, L., & Hueber, T. (2024). Fill in the Gap! Combining Self-supervised Representation Learning with Neural Audio Synthesis for Speech Inpainting. arXiv preprint arXiv:2405.20101. https://arxiv.org/abs/2405.20101