An open-source on-device text-to-speech model family supporting instant voice cloning and real-time multilingual synthesis for developers building low-latency voice applications locally with efficient deployment.