8.0
热点
AI SCORE
开源项目2026-08-03 21:52
开源视频模型首次登顶排行
The Decoder#开源#视频生成#MiniMax
Editor brief · 编辑速览
MiniMax H3 开源模型在视频生成排名中首度登顶,标志开源模型与闭源模型的竞争力突破性提升。
MiniMax 发布 H3 视频模型权重,首次让开源模型登上视频模型排行榜榜首。Artificial Analysis 将 H3 排在视频编辑(Video Editing)第一名、文生视频(Text-to-Video)第二名,以及图生视频(Image-to-Video)第三名。这款拥有 330 亿参数的模型能够统一处理文本、图像、视频和音频,并生成带有立体声的 4 至 15 秒视频片段。根据 model card,单个 prompt 最多可以包含 9 张参考图像、3 个视频片段和 3 个音频片段。
不过,仍有两个部分没有开放。此次发布并未包含 2K 分辨率模块和 H3-Context-IR,后者负责将 prompt 和参考素材转换为结构化的中间格式。在 ComfyUI 中本地运行 H3 时,最高只能输出 768p,用户还需要根据 MiniMax 已发布的 prompting 指南自行完成上下文准备。开放的模型权重则允许用户使用自定义影像、角色或特定视觉风格进行 fine-tuning。许可证方面还有一项限制:只有年营收低于 2,000 万美元的公司才可以将其用于商业用途。
ByteDance 在同一天发布了闭源模型 Seedance 2.5,它可以生成自带音频的 30 秒视频片段。
无需炒作的 AI 新闻——由真人精心筛选
订阅 THE DECODER,即可享受无广告阅读、每周 AI 新闻通讯、每年六期独家前沿报告「AI Radar」、完整历史文章访问权限,以及评论区使用权限。