# MiniMax H3 全模态生成模型正式发布：最高支持 15 秒 2K 分辨率，超分方案革新

- 来源：IT之家（RSS）
- 发布时间：2026-07-31 10:00
- AIHOT 分数：64
- AIHOT 链接：https://aihot.virxact.com/items/cms8avxii05vprot0tb9p4ssi
- 原文链接：https://www.ithome.com/0/983/957.htm

## AI 摘要

稀宇科技今日发布 MiniMax H3 全模态生成模型，支持对文本、图像、视频、声音组成的多模态上下文统一理解，可输出原生双声道音视频，最高支持 15s 2K 分辨率。

## 正文

IT之家 7 月 31 日消息，稀宇科技今天宣布推出 MiniMax H3 全模态生成模型，支持对文本、图像、视频、声音组成的多模态上下文的统一理解能力、能够输出具备原生双声道的音视频，最高可支持 15s 2K 分辨率。

据前期邀测反馈，MiniMax H3 具备商用级多场景内容生成能力，在指令遵循、文字与品牌信息呈现、V2V Motion Transfer（视频到视频动作迁移）等方面表现出色，号称可精准、可控实现多模态内容编辑与生成，适用于广告、电商、品牌、产品设计、UI / UX 和游戏等场景。

核心技术方面，MiniMax H3 增加了 Caption 能力，定制了专属模型和全模态理解管线，大部分素材需要消耗 100K Token 的推理，最终得到平均约 4K 的 Token。

同时，MiniMax H3 的 2K 视频输出能力并没有使用常规超分模块，而是使用 H3 基础模型对自己的低分辨率结果进行 in-context 的重新生成，可最大程度地复用 H3 基模已经具备的生成能力，还拥有传统超分方案无法靠“猜”还原的信息。

此外，MiniMax H3 将在未来几天内开放模型权重。IT之家将持续关注，第一时间带来最新消息。
