MiniMax H3

MiniMax 通用全模态生成模型 H3

MiniMax H3 是 MiniMax 发布的通用全模态生成模型,可对文本、图像、视频、声音组成的多模态上下文进行统一理解,并输出具备原生双声道音视频,最高支持 15 秒 2K 分辨率。模型通过 /v2/video_generation 接口以多模态 content[] 结构调用,支持 t2va 文生视频、i2va 图生视频、首尾帧生视频及多模态参考四种模式。MiniMax 宣布将在未来数日内依法开放模型权重

视频处理视频生成图像理解音频生成
访问官网
收录动态

1

最近更新

2026-07-31

评价样本

未收录

社区规模

工具功能

这个工具能做什么、适合谁用,以及目前已识别的核心能力。

工具简介

MiniMax H3 是 MiniMax 发布的通用全模态生成模型,可对文本、图像、视频、声音组成的多模态上下文进行统一理解,并输出具备原生双声道音视频,最高支持 15 秒 2K 分辨率。模型通过 /v2/video_generation 接口以多模态 content[] 结构调用,支持 t2va 文生视频、i2va 图生视频、首尾帧生视频及多模态参考四种模式。MiniMax 宣布将在未来数日内依法开放模型权重

核心功能

4 项已整理
视频处理
视频生成
图像理解
音频生成

价格信息

暂无可验证价格信息

暂无足够准确的价格信息。

基础信息

更新频率
近 7 天 1 条收录动态
最近更新
2026-07-31
覆盖行业

更新日志

按时间记录功能更新、版本发布、新工具入库等重要变化。

  1. 2026-07-31版本发布

    MiniMax 正式发布全模态生成模型 MiniMax H3:该模型可对文本、图像、视频、声音多模态上下文进行统一理解,并直接输出原生双声道音视频,最高支持 15 秒 2K 分辨率;同步上线 /v2/video_generation API,提供 t2va 文生视频、图生视频、首尾帧生视频与多模态参考四种生成模式,供开发者在视频生成和音视频工作流中接入或替换使用。MiniMax 同时宣布将在未来数日内依法开放模型权重。

MiniMax H3 常见问题

关于 MiniMax H3 的定位、核心功能、价格与最近更新。

MiniMax H3 是什么?

MiniMax H3 是 MiniMax 发布的通用全模态生成模型,可对文本、图像、视频、声音组成的多模态上下文进行统一理解,并输出具备原生双声道音视频,最高支持 15 秒 2K 分辨率。模型通过 /v2/video_generation 接口以多模态 content[] 结构调用,支持 t2va 文生视频、i2va 图生视频、首尾帧生视频及多模态参考四种模式。MiniMax 宣布将在未来数日内依法开放模型权重。

MiniMax H3 有哪些核心功能?

MiniMax H3 当前已核验的核心功能包括:视频处理、视频生成、图像理解、音频生成。

MiniMax H3 如何收费?

AI Equal 当前没有收录 MiniMax H3 的可验证价格信息。

MiniMax H3 最近有什么更新?

2026-07-31:MiniMax 正式发布全模态生成模型 MiniMax H3:该模型可对文本、图像、视频、声音多模态上下文进行统一理解,并直接输出原生双声道音视频,最高支持 15 秒 2K 分辨率;同步上线 /v2/video_generation API,提供 t2va 文生视频、图生视频、首尾帧生视频与多模态参考四种生成模式,供开发者在视频生成和音视频工作流中接入或替换使用。MiniMax 同时宣布将在未来数日内依法开放模型权重。