跳到正文
MiniMax 新模型·· 2026-07-28精选AI 评分78

MiniMax 发布新一代开源多模态视频模型 H3

MiniMaxAI/MiniMax-H3

AI 导读

MiniMax 发布开源多模态视频生成模型 H3,支持文本、图像、视频、音频的统一理解与生成,可输出最高 2K 分辨率、15 秒时长的视频并带有立体声。模型包含 H3-Context-IR、H3-Base 和 H3-Regenerate-2K 三个模块,支持多种输入模式如文本到视频(T2VA)、首尾帧到视频(FL2VA)和参考多模态到视频(Ref2VA)。

推荐理由

原文提供了模型架构、输入输出规范和部署方式,读者可以据此判断其在多模态视频生成中的实际应用潜力。

来源:MiniMax 新模型 · huggingface.co