把视频模型价格砍到三分之一:MiniMax 的 H3 想做"通用"那一个

7 月 31 日,MiniMax 发布通用全模态生成模型 H3,并宣布将于近期开源。

H3 支持文本、图像、音频、视频多模态输入,可生成原生双声道音视频,最长 15 秒、2K 分辨率。在 Artificial Analysis 视频模型榜单中,H3 的视频编辑能力位列全球第一。

价格是其另一卖点。2K 分辨率下,H3 每秒收费 0.8 元,约为同类旗舰视频模型的三分之一。在指令遵循、文字与品牌信息呈现、视频到视频的动作迁移等方面表现稳定,适用于广告、品牌、电商、产品设计与游戏等场景。

与此前聚焦特化任务的模型不同,H3 是 MiniMax 向"通用多模态智能"迈出的关键一步。从特化到通用,考验的是模型对复杂指令的理解与稳定产出可用素材的能力。其开源后的开发者接受度,将是检验"好用"能否转化为"常用"的关键指标。

上一篇 2000美元算力的"数学奇迹"?OpenAI 代号 Astra 的多智能体模型闯进监管视野
下一篇 首钢园里 200 支队伍"比武":人形机器人热到什么程度了