MiniMax 正式发布全模态生成模型 H3,支持统一理解文本、图像、视频和声音上下文,最高输出 15s 2K 原生双声道音视频。MiniMax 称模型默认提供 2K 分辨率,其每秒价格不到主流模型的 1/3,768P 分辨率下价格为主流模型720P的1/2,并基于前期邀测反馈称其可用于广告、电商等商业内容生成与编辑。
阅读原文