Hugging Face · 每日论文·· 1 天前AI 评分38
HiPLEX: 分层策略分解用于全双工语音语言模型
HiPLEX: Hierarchical Policy Factorization for Full Duplex Speech Language Models
AI 导读
HiPLEX 是一种强化学习框架,将预训练的全双工文本策略分解为控制策略和条件内容策略,分别决定何时输出内容和输出什么内容。该框架在 Full-Duplex-Bench v1 上通过三个 Moshi 种子测试,相比 GRPO 显著降低自然用户停顿和反馈机会的接管率,并缩短中断后的响应延迟。HiPLEX 在 Moshi 和 PersonaPlex 上更贴近人类对话的轮次定时和反馈频率分布。
来源:Hugging Face · 每日论文 · huggingface.co