大模型之家讯 8月3日,MiniMax 正式开源新一代通用视频模型 MiniMax H3,这是该公司首款开源的多模态生成模型。H3 能够统一理解文本、图像、视频和音频构成的多模态上下文,可生成最高 2K 分辨率、最长 15 秒、带原生立体声音频的视频,稳定支持 11 种语言。模型权重已在 Hugging Face 开放,支持 SGLang、vLLM、diffusers 与 ComfyUI 等框架本地部署;其中的 H3-Context-IR 与 H3-Regenerate-2K 模块以 API 形式提供。据公开信息,H3 视频生成价格约为 0.8 元/秒。