MiniMax H3
MiniMax 通用全模态生成模型 H3
MiniMax H3 是 MiniMax 发布的通用全模态生成模型,可对文本、图像、视频、声音组成的多模态上下文进行统一理解,并输出具备原生双声道音视频,最高支持 15 秒 2K 分辨率。模型通过 /v2/video_generation 接口以多模态 content[] 结构调用,支持 t2va 文生视频、i2va 图生视频、首尾帧生视频及多模态参考四种模式。MiniMax 宣布将在未来数日内依法开放模型权重
22
2026-09-09
未收录
—
工具功能
这个工具能做什么、适合谁用,以及目前已识别的核心能力。
工具简介
MiniMax H3 是 MiniMax 发布的通用全模态生成模型,可对文本、图像、视频、声音组成的多模态上下文进行统一理解,并输出具备原生双声道音视频,最高支持 15 秒 2K 分辨率。模型通过 /v2/video_generation 接口以多模态 content[] 结构调用,支持 t2va 文生视频、i2va 图生视频、首尾帧生视频及多模态参考四种模式。MiniMax 宣布将在未来数日内依法开放模型权重
核心功能
价格信息
暂无可验证价格信息暂无足够准确的价格信息。
基础信息
- 更新频率
- 近 7 天 2 条收录动态
- 最近更新
- 2026-09-09
- 覆盖行业
- 内容创作、设计师、程序员、电商运营、游戏、市场营销、影视传媒
更新日志
按时间记录功能更新、版本发布、新工具入库等重要变化。
- 2026-09-09功能更新
MiniMax H3 新增第三方平台接入路径:SkyProduction(天工工作台)上线自部署 H3 768P 版本,支持文生视频及当前开放的参考生成方式,可理解图片、视频、音频等多模态参考素材并联合生成视频与原生立体声。9月9日该平台会员可无限免积分使用H3 768P,9月10—14日新开会员或积分充值按档位加赠限免天数。
- 2026-09-07功能更新
NVIDIA Sol 团队发布 Sol-H3 端到端推理加速栈,为 MiniMax-H3 新增一条快于播放速度的视频生成路径:在 8× NVIDIA B300 Blackwell 上生成 5 秒 1344×768 立体声视频仅需 1.653 秒,较 50 步 Base H3 最高提速 15.54×,并在 1×、4×、8× B300 上可扩展;方案完全开源,同时可通过 Reactor API 先行试用。
- 2026-08-30价格调整
MiniMax H3 与 H3 Max 上线 Vercel AI Gateway,并与 MiniMax 官方合作在 8 月 30 日至 9 月 13 日期间享五折优惠,覆盖通过 AI Gateway 计费的所有时长和分辨率请求,模型 ID 不变无须改码即可享受折扣。
- 2026-08-28功能更新
MiniMax 官方与 Hao AI Lab、NVIDIA FastGen 合作推出开源权重视频加速模型 Fast H3 v1:基于 MiniMax H3,可在 13 秒内生成 15 秒 768p 视频,在 NVIDIA Blackwell GPU 上实现最高 14 倍加速,模型完全开源,社区可运行并改进加速方案,为 H3 视频生成新增一条推理加速路径。
- 2026-08-27功能更新
工具 MiniMax H3 迎来生态后训练事件:MiniMax 祝贺 fal 团队基于其开源 H3 基础模型后训练的 H3 Max 视频模型登顶多项评测,在整体质量、提示词理解和美学上均排名第一,可生成 5 秒 720p 视频且耗时低于 3 秒,本周价格五折;官方同时指出 SGLang 训练管线与 Sol-Attention 引擎带来 3.95 倍端到端加速,为依赖 H3 进行视频生成与本地/托管推理的用户新增一条社区后训练模型及价格优惠参考。
- 2026-08-21功能更新
MiniMax H3 上线视频创作平台 Viggle,用户每天可在 Viggle 免费使用 H3 生成视频,新增一条第三方平台调用路径
- 2026-08-11功能更新
MiniMax 官方确认开源视频模型 MiniMax H3 发布首日即获 Sol Video Inference Engine 加速:4.5 小时内实现端到端推理速度较 Diffusers 提升 3.95 倍、较 SGLang 提升 2.80 倍(测试配置 8× NVIDIA GB200、1344×768、24FPS、124 帧);方案结合内核融合、跨步缓存与 Sol-Attn 免训练稀疏注意力,无需蒸馏或微调,为 H3 本地与自部署新增一条推理加速路径。
- 2026-08-11功能更新
MiniMax 官方确认 MiniMax H3 的 LoRA 训练器已在 fal 平台上线,使用户可在托管平台用自有素材训练 H3 的 LoRA,而不必自建微调环境;官方同时训练并开源了示范 LoRA「Realism People」,使 H3 在皮肤、眼睛和动态上得到更逼真的真人效果,并表示后续将推出更多 LoRA。
- 2026-08-06功能更新
MiniMax H3 上线第三方创意平台 Luma Agents:继 HailuoAI、MiniMax API、fal 与开源自部署之后,H3 新增一条无需自己调 API 即可在智能体创意工作流中使用的接入路径,官方口径确认在 Luma 中可生成 15 秒 2K 带原生立体声视频、并支持文本/图像/视频/音频四类参考引导。
- 2026-08-04功能更新
MiniMax 官方确认,开源视频模型 MiniMax H3 权重发布一天内已能在 Mac 本地运行:第三方应用 Phosphene 3.4.0 基于 Apple MLX 框构新增对 H3 的支持,用户可在 Apple Silicon 设备上本地调用 H3 生成视频,为 H3 除云端 API、ComfyUI 和多家 GPU 适配之外,新增一条无需独立显卡的 Mac 本地视频生成工作流路径。
- 2026-08-04功能更新
MiniMax H3 开源 24 小时内生态落地:华为昇腾、AMD、Intel 等 9 家国内外芯片厂商完成 Day 0 适配,Hugging Face、魔搭、ComfyUI、vLLM-Omni、SGLang、腾讯云等超百家合作伙伴 Day 0 上线,为 H3 自部署与托管调用新增大量硬件与推理框架接入路径;官方同时称 H3 在 Artificial Analysis 所有视频榜单均进入全球前三。
- 2026-08-03开源
MiniMax H3 开源权重的具体边界公开:33B 参数模型可统一处理文本、图像、视频与音频,生成 4-15 秒带立体声片段,单次提示最多可含 9 张参考图、3 段视频和 3 段音频;开源权重允许在自定义素材、角色或视觉风格上微调。但 2K 分辨率模块与 H3-Context-IR 未开源,ComfyUI 本地运行上限 768p,上下文预处理需自行完成;商用许可仅限营收低于 2000 万美元的公司。Artificial Analysis 榜单中 H3 视频编辑第一、文生视频第二、图生视频第三。
- 2026-08-03功能更新
沐曦股份宣布曦云 C 系列 GPU 完成对 MiniMax H3 的 Day 0 适配:依托全栈自研 MXMACA 软件栈(覆盖底层驱动、用户态接口、MXCC 编译器、算子适配与训练/推理框架对接,兼容 PyTorch、TensorFlow、vLLM、SGLang 等 40 余种框架),用户可在该国产 GPU 上快速部署 H3 并调用其多模态生成能力,为 H3 自部署新增一条国产算力硬件路径。
- 2026-08-03功能更新
英特尔宣布为开源视频模型 MiniMax H3 提供 Day 0 首发支持:锐炫 Pro B70 完成适配,并给出多卡 GPU 部署方案(Encoder 8 卡张量并行、DiT 8 卡 USP 结合 Layer-wise Offloading、VAE 部署于 B70)实现视频生成全流程 GPU 加速;另开发 2TP×4USP 混合并行方案降低通信开销,并结合 llm-scaler-omni 项目 XPU Kernel 优化矩阵乘法与注意力算子,降低端到端推理时延,为 H3 自部署新增英特尔 GPU 硬件路径。
- 2026-08-03开源
MiniMax H3 模型权重已正式开源,并在 fal 平台 Day 0 同步上线。开发者现在可下载 MiniMax H3 权重自行研究、定制和部署,也可直接在 fal 的生产级推理基础设施上调用该视频生成模型,使自部署与托管 API 两条接入路径同时可用,兑现了此前「数日内开放权重」的计划。
- 2026-07-31价格调整
MiniMax H3 已同时上线消费级产品 HailuoAI 与 MiniMax API,支持文本、图像、音频、视频多模态输入生成视频并具备精准编辑控制;首次公开按秒单价:2K 视频 $0.081/秒,并宣布 768p 版本即将推出、定价 $0.047/秒,可用于视频生成工具成本对比。
- 2026-07-31开源
MiniMax H3 通用多模态视频模型宣布将于北京时间 8 月 3 日 0 点在魔搭社区正式开源,比此前「数日内开放权重」首次明确开源时间与托管平台,使自部署视频生成工作流成为可预期选项;官方同时公布 2K 为默认分辨率,2K 每秒价格不到主流模型 1/3、768P 为主流 720P 的 1/2,供成本对比参考。
- 2026-07-31版本发布
MiniMax H3 在 Artificial Analysis 视频编辑榜登顶,被官方定位为「首个开源视频模型」;技术报告披露其使用 H3-Omni Transformer 原生 Omni 架构与多模态 Caption 模型,把剪辑逻辑、字体排版、转场、节奏、背景音乐与视觉特效端到端集成进视频生成,默认 2K 分辨率。
- 2026-07-31价格调整
MiniMax H3 在官方 X 帖中公开成本对比:声称单次渲染成本约为 Seedance 2.0 的三分之一,同时保持 2K 分辨率、24fps、5-15 秒时长和每次渲染均为原生立体声;为同档位视频生成工具的成本/能力对比提供新的定价锚点。
- 2026-07-31功能更新
MiniMax H3 正式登陆 Vercel AI Gateway:开发者可通过 AI SDK 的 generateVideo() 以 model: 'MiniMax/MiniMax-h3' 单次调用 H3 视频生成,模型代码示例已在 Vercel 文档中 Day 0 展示。MiniMax 在原帖再次重申 H3 模型权重将在后续依法开放。
- 2026-07-31功能更新
MiniMax H3 在第三方调用通道中以 model "Hailuo-3.0" 上线 POST videos/create,2K 默认 24 fps,多模态参考模式支持最多 9 张图、3 段视频、3 段音频、合计不超过 12 个文件并通过 @-tag 引用;useapi.net 公开 12 credits/秒 2K 的计费规则。
- 2026-07-31版本发布
MiniMax 正式发布全模态生成模型 MiniMax H3:该模型可对文本、图像、视频、声音多模态上下文进行统一理解,并直接输出原生双声道音视频,最高支持 15 秒 2K 分辨率;同步上线 /v2/video_generation API,提供 t2va 文生视频、图生视频、首尾帧生视频与多模态参考四种生成模式,供开发者在视频生成和音视频工作流中接入或替换使用。MiniMax 同时宣布将在未来数日内依法开放模型权重。
MiniMax H3 常见问题
关于 MiniMax H3 的定位、核心功能、价格与最近更新。
MiniMax H3 是什么?
MiniMax H3 是 MiniMax 发布的通用全模态生成模型,可对文本、图像、视频、声音组成的多模态上下文进行统一理解,并输出具备原生双声道音视频,最高支持 15 秒 2K 分辨率。模型通过 /v2/video_generation 接口以多模态 content[] 结构调用,支持 t2va 文生视频、i2va 图生视频、首尾帧生视频及多模态参考四种模式。MiniMax 宣布将在未来数日内依法开放模型权重。
MiniMax H3 有哪些核心功能?
MiniMax H3 当前已核验的核心功能包括:图像理解、模型训练学习、视频处理、视频理解、视频生成、音频生成。
MiniMax H3 如何收费?
AI Equal 当前没有收录 MiniMax H3 的可验证价格信息。
MiniMax H3 最近有什么更新?
2026-09-09:MiniMax H3 新增第三方平台接入路径:SkyProduction(天工工作台)上线自部署 H3 768P 版本,支持文生视频及当前开放的参考生成方式,可理解图片、视频、音频等多模态参考素材并联合生成视频与原生立体声。9月9日该平台会员可无限免积分使用H3 768P,9月10—14日新开会员或积分充值按档位加赠限免天数。