事件专题 · 多源确认

MiniMax H3 全模态模型发布:支持 15 秒 2K 视频,超分方案革新

MiniMax 推出 H3 全模态生成模型,支持文本、图像、视频、声音的统一理解,并可输出原生双声道音视频。该模型最高支持 15 秒 2K 分辨率输出,在指令遵循、文字呈现和 V2V Motion Transfer 等任务上表现突出。MiniMax H3 新增 Caption 能力,大部分素材消耗约 100K Token 推理,最终平均输出约 4K Token。其 2K 视频不依赖常规超分模块,而是由 H3 基础模型对低分辨率结果进行 in-context 重新生成。模型权重将在未来几天内开放。

当前结论

MiniMax 发了新模型 H3,可生成带双声道音效的 2K 视频,超分用模型自己重画而非传统模块,过几天开源权重。

6 个信源52° AI 热度最后更新 2026/7/31 02:00:53

证据链

相关来源 5歸藏(guizang.ai)
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情