跳到正文
Microsoft 新模型·· 2026-09-02AI 评分39

Microsoft 推出 VibeVoice-ASR-Streaming-1.5B 流式语音识别模型

microsoft/VibeVoice-ASR-Streaming-1.5B

AI 导读

Microsoft 推出 VibeVoice-ASR-Streaming-1.5B,支持流式语音识别并标注说话人身份,可自定义热词和10种语言。模型基于 microsoft/VibeVoice 项目,提供持续转录功能,适用于多语言场景。该项目采用 MIT 许可证,由微软研究院团队开发,欢迎用户反馈与合作。

来源:Microsoft 新模型 · huggingface.co