通用视频模型 MiniMax H3 正式开源

2026-08-03 38 次阅读 RSS订阅
主要内容:MiniMax 推出了开源的 MiniMax H3,一款新的多模态视频模型。它能够理解文本、图像、视频和音频的上下文,并能生成最高 2K 分辨率、15 秒的视频,配有原生立体声音频。

📰 来源:https://www.okx.com/zh-hans/feed/post/83618661804320

💬 引用锚点
MiniMax H3作为开源多模态视频模型,支持2K分辨率与15秒视频生成,显著降低了高质量视频创作的技术门槛。
该模型原生支持文本、图像、视频、音频的多模态理解,并在生成视频时同步输出立体声音频,实现视听一体化的内容创作能力。
通过开源策略,MiniMax H3赋能开发者基于模型进行定制化开发,推动视频生成技术的普及与生态创新。

常见问题

MiniMax H3 是什么类型的模型?
MiniMax H3 支持生成多高分辨率的视频?
MiniMax H3 生成的视频最长多久?
MiniMax H3 生成的视频是否包含音频?
MiniMax H3 是否开源?