MiniMax H3全模态生成模型正式发布,最高支持15秒2K分辨率

大模型之家讯 7月31日,稀宇科技正式发布MiniMax H3全模态生成模型,支持对文本、图像、视频、声音的多模态上下文统一理解,可输出原生双声道音视频,最高支持15秒2K分辨率。据前期邀测反馈,该模型在指令遵循、文字与品牌信息呈现、V2V视频到视频动作迁移等能力上表现出色,适用于广告、电商、品牌、产品设计及UI/UX等场景。技术层面,MiniMax H3新增Caption能力并定制全模态理解管线,大部分素材消耗100K Token推理,最终输出平均约4K Token。其2K视频输出未使用常规超分模块,而是由基础模型对低分辨率结果进行in-context重新生成,可还原传统超分方案无法复原的信息。模型权重将在未来几天开放。受此消息影响,港股MiniMax当日开盘涨近15%。

上一篇:

下一篇:

发表回复

登录后才能评论