MOSS-TTSD

A multilingual model for long-form, multi-speaker dialogue synthesis with flexible speaker control and zero-shot voice cloning

What is MOSS-TTSD?

A multilingual model for long-form, multi-speaker dialogue synthesis with flexible speaker control and zero-shot voice cloning