主要来源IT之家
查看原文事件专题 · 多源确认
MiniMax H3 全模态模型发布:支持 15 秒 2K 视频,超分方案革新
MiniMax 推出 H3 全模态生成模型,支持文本、图像、视频、声音的统一理解,并可输出原生双声道音视频。该模型最高支持 15 秒 2K 分辨率输出,在指令遵循、文字呈现和 V2V Motion Transfer 等任务上表现突出。MiniMax H3 新增 Caption 能力,大部分素材消耗约 100K Token 推理,最终平均输出约 4K Token。其 2K 视频不依赖常规超分模块,而是由 H3 基础模型对低分辨率结果进行 in-context 重新生成。模型权重将在未来几天内开放。
当前结论
MiniMax 发了新模型 H3,可生成带双声道音效的 2K 视频,超分用模型自己重画而非传统模块,过几天开源权重。
6 个信源52° AI 热度最后更新 2026/7/31 02:00:53
证据链
相关来源 1Hailuo AI
查看原文相关来源 2marktechpost
查看原文相关来源 3Pika Labs
查看原文相关来源 4Guillermo Rauch
查看原文相关来源 5歸藏(guizang.ai)
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。