Entity
Zero-shot Voice Cloning
A capability that allows a model to mimic a speaker's voice using only a short audio sample without requiring prior training on that specific voice.
术语属性
- sampleRequirement:3 seconds minimum
- trainingRequired:false
Entity
A capability that allows a model to mimic a speaker's voice using only a short audio sample without requiring prior training on that specific voice.