OpenMOSS/MOSS-TTSD
stableA multilingual model for long-form, multi-speaker dialogue synthesis with flexible speaker control and zero-shot voice cloning
finetunelarge-language-modelsmultilingualpodcastsglangspeech-dialogue-generationspeech-synthesisstreaming