MiniMax H3
MiniMax 通用全模态生成模型 H3
MiniMax H3 是 MiniMax 发布的通用全模态生成模型,可对文本、图像、视频、声音组成的多模态上下文进行统一理解,并输出具备原生双声道音视频,最高支持 15 秒 2K 分辨率。模型通过 /v2/video_generation 接口以多模态 content[] 结构调用,支持 t2va 文生视频、i2va 图生视频、首尾帧生视频及多模态参考四种模式。MiniMax 宣布将在未来数日内依法开放模型权重
1
2026-07-31
未收录
—
工具功能
这个工具能做什么、适合谁用,以及目前已识别的核心能力。
工具简介
MiniMax H3 是 MiniMax 发布的通用全模态生成模型,可对文本、图像、视频、声音组成的多模态上下文进行统一理解,并输出具备原生双声道音视频,最高支持 15 秒 2K 分辨率。模型通过 /v2/video_generation 接口以多模态 content[] 结构调用,支持 t2va 文生视频、i2va 图生视频、首尾帧生视频及多模态参考四种模式。MiniMax 宣布将在未来数日内依法开放模型权重
核心功能
价格信息
暂无可验证价格信息暂无足够准确的价格信息。
基础信息
- 更新频率
- 近 7 天 1 条收录动态
- 最近更新
- 2026-07-31
- 覆盖行业
更新日志
按时间记录功能更新、版本发布、新工具入库等重要变化。
- 2026-07-31版本发布
MiniMax 正式发布全模态生成模型 MiniMax H3:该模型可对文本、图像、视频、声音多模态上下文进行统一理解,并直接输出原生双声道音视频,最高支持 15 秒 2K 分辨率;同步上线 /v2/video_generation API,提供 t2va 文生视频、图生视频、首尾帧生视频与多模态参考四种生成模式,供开发者在视频生成和音视频工作流中接入或替换使用。MiniMax 同时宣布将在未来数日内依法开放模型权重。
MiniMax H3 常见问题
关于 MiniMax H3 的定位、核心功能、价格与最近更新。
MiniMax H3 是什么?
MiniMax H3 是 MiniMax 发布的通用全模态生成模型,可对文本、图像、视频、声音组成的多模态上下文进行统一理解,并输出具备原生双声道音视频,最高支持 15 秒 2K 分辨率。模型通过 /v2/video_generation 接口以多模态 content[] 结构调用,支持 t2va 文生视频、i2va 图生视频、首尾帧生视频及多模态参考四种模式。MiniMax 宣布将在未来数日内依法开放模型权重。
MiniMax H3 有哪些核心功能?
MiniMax H3 当前已核验的核心功能包括:视频处理、视频生成、图像理解、音频生成。
MiniMax H3 如何收费?
AI Equal 当前没有收录 MiniMax H3 的可验证价格信息。
MiniMax H3 最近有什么更新?
2026-07-31:MiniMax 正式发布全模态生成模型 MiniMax H3:该模型可对文本、图像、视频、声音多模态上下文进行统一理解,并直接输出原生双声道音视频,最高支持 15 秒 2K 分辨率;同步上线 /v2/video_generation API,提供 t2va 文生视频、图生视频、首尾帧生视频与多模态参考四种生成模式,供开发者在视频生成和音视频工作流中接入或替换使用。MiniMax 同时宣布将在未来数日内依法开放模型权重。