Hugging Face · 每日论文·· 5 天前AI 评分45
DEFINE:用于零样本 TTS 的示例引导口音控制框架
DEFINE: Exemplar-Guided Accent Control for Zero-Shot TTS
AI 导读
DEFINE 框架通过独立的音频示例分别控制说话人身份和目标口音,在单次推理中实现口音强度的连续调节。该框架基于 F5-TTS 构建,使用参数高效的 LoRA 进行适配,无需推理时的口音标签或后合成波形转换。在训练集内口音上,口音引导可将口音探测准确率从 6.5% 提升至 19.6%,并能将口音控制泛化到训练集外的部分口音上。
来源:Hugging Face · 每日论文 · huggingface.co