MiniMax发布全模态生成模型H3:支持15秒2K视频,价格不到主流1/3
科技
科技 > 人工智能 > 正文

MiniMax发布全模态生成模型H3:支持15秒2K视频,价格不到主流1/3

凤凰网科技讯 7月31日,MiniMax正式发布通用全模态生成模型H3。该模型支持对文本、图像、视频、声音的统一理解,可输出原生双声道音视频,最高支持15秒2K分辨率视频生成。

H3主打商用级多场景内容生成能力,在指令遵循、文字与品牌信息呈现、视频到视频动作迁移等方面表现突出,可应用于广告、电商、品牌、游戏等商业场景。定价方面,2K分辨率下每秒价格不到主流模型的1/3,768P分辨率下不到1/2。核心技术包括Contextual Omni Representation、H3-VAE及H3-Omni Transformer等,通过理解与生成异构训练架构提升训练吞吐近30%。

MiniMax发布全模态生成模型H3:支持15秒2K视频,价格不到主流1/3

MiniMax表示,将在未来几天内开放模型权重,以推动开源社区发展并加速国产芯片适配。此前两代模型(Hailuo 01、02)分别在系统构建与架构效率上完成迭代,H3则进一步实现任务与模态的统一。公司称后续版本将推动与M系列模型能力的融合,并持续提升画面精细度。

亲爱的凤凰网用户:

您当前使用的浏览器版本过低,导致网站不能正常访问,建议升级浏览器

第三方浏览器推荐:

谷歌(Chrome)浏览器 下载

360安全浏览器 下载