Confidence-based Filtering for Speech Dataset Curation with Generative Speech Enhancement Using Discrete Tokens
Exploring Pre-training Benefits on Phoneme Addition through Fine-tuning in Speech Synthesis
Eigenvoice Synthesis based on Model Editing for Speaker Generation
Speaker-agnostic Emotion Vector for Cross-speaker Emotion Intensity Control
Exploring the Capability of Mamba in Speech Applications
An Attribute Interpolation Method in Speech Synthesis by Model Merging
Structured State Space Decoder for Speech Recognition and Synthesis