ithome
其他
采集 2026-07-31T04:37:20+00:00
MiniMax H3全模态生成模型正式发布
原始标题:MiniMax H3 全模态生成模型正式发布:最高支持 15 秒 2K 分辨率,超分方案革新
来源
ithome
发布时间
2026-07-31T02:00:53
采集批次
2026-07-31-04
字数
473
URL 指纹
aef847bd7c68ce55
📌 AI 总结(208 字)
稀宇科技推出MiniMax H3全模态生成模型,支持文本、图像、视频、声音多模态统一理解,可输出原生双声道音视频,最高支持15秒2K分辨率。该模型具备商用级多场景内容生成能力,在指令遵循、品牌信息呈现、视频到视频动作迁移等方面表现突出,适用于广告、电商、游戏等场景。其2K视频输出未使用常规超分方案,而是由基础模型对低分辨率结果进行in-context重新生成,能保留传统超分无法还原的信息。模型权重将在数日内开放。
📄 正文(473 字)
IT之家7月31日消息,稀宇科技今天宣布推出MiniMax H3全模态生成模型,支持对文本、图像、视频、声音组成的多模态上下文的统一理解能力,能够输出具备原生双声道的音视频,最高可支持15秒2K分辨率。 据前期邀测反馈,MiniMax H3具备商用级多场景内容生成能力,在指令遵循、文字与品牌信息呈现、V2V Motion Transfer(视频到视频动作迁移)等方面表现出色,号称可精准、可控实现多模态内容编辑与生成,适用于广告、电商、品牌、产品设计、UI/UX和游戏等场景。 核心技术方面,MiniMax H3增加了Caption能力,定制了专属模型和全模态理解管线,大部分素材需要消耗100K Token的推理,最终得到平均约4K的Token。 同时,MiniMax H3的2K视频输出能力并没有使用常规超分模块,而是使用H3基础模型对自己的低分辨率结果进行in-context的重新生成,可最大程度地复用H3基模已经具备的生成能力,还拥有传统超分方案无法靠「猜」还原的信息。 此外,MiniMax H3将在未来几天内开放模型权重。