据悉,MiniMax发布新一代多模态生成模型MiniMax H3,并宣布将于近期开源。
H3是MiniMax从“特化任务模型”迈向“通用多模态智能”的重要探索,其不再以单一任务为边界,而是在多模态上下文中统一理解创作意图,完成更加自然、连贯的生成与表达。
MiniMax H3支持文本、图片、音频和视频等多种输入形式,支持2K分辨率直出,可生成最长15秒的音画内容,进一步降低高质量视频内容的创作和使用门槛。
在模型效果方面,MiniMax H3具备商用级的多场景内容生成能力,在指令遵循、文字与品牌信息呈现、视频到视频动作迁移等方面表现出色,适用于广告、品牌、电商等商业场景。
在Artificial Analysis视频模型榜单中,MiniMax H3在视频编辑能力项排名全球第一。








