MiniMax H3 Text-to-Video API

minimax/h3/text-to-video
2K · 5–15 sec

MiniMax H3 Text-to-Video 可根据提示词生成固定 2K 视频。描述主体、动作、镜头移动、光线和画面风格,再选择 5–15 秒时长及画面比例。

输入

109/2000

输出

已就绪
5 秒 × $0.105/秒 = $0.525

继续使用

MiniMax H3 Text-to-Video API

MiniMax H3 Text-to-Video API 接受 1–2,000 个字符的提示词,并返回固定 2K 视频的异步任务。时长可设置为 5–15 秒的整数,并可选择六种固定画面比例之一;请求不接受源图片、源视频或源音频字段。

为什么选择 MiniMax H3 Text-to-Video API?

  • 直接从提示词生成视频。没有源素材时,也能用自然语言定义完整场景。

  • 同时控制场景与镜头。在一条提示词中说明主体、动作、景别、镜头运动、光线和氛围。

  • 六种可选画面比例。生成视频可选择 21:9、16:9、4:3、1:1、3:4 或 9:16。

  • 视频时长可选择。可根据动作需要选择 5–15 秒之间的任意整数时长。

  • 固定 2K 分辨率并按秒计费。所有受支持的时长和画面比例均固定输出 2K,每生成 1 秒消耗 21 积分。

参数说明

参数要求说明
prompt必填

描述主体、环境、动作、镜头和视觉方向。去除首尾空格后长度为 1–2,000 个字符。

duration可选

取值为 5–15 的整数秒。

默认值55–15
resolution固定

不接受其他分辨率。

默认值2K
aspect_ratio可选

选择一种固定比例,不支持 adaptive。

21:916:94:31:13:49:16

使用方法

  1. 定义场景写明主体和环境,再指出视频中需要出现的主要动作。

  2. 编写一个主要动作使用具体动词,让短视频聚焦在一个容易理解的事件上。

  3. 指导镜头补充景别、镜头运动、节奏、光线和氛围。

  4. 设置格式和时长选择一种固定比例,并设置 5–15 秒的整数时长。

  5. 提交并跟踪运行请求,然后轮询返回的 task ID,或使用回调 URL 接收结果。

计费

费用仅取决于生成时长,每生成 1 秒视频消耗 21 积分。固定 2K 分辨率不会改变费率。

计费项目费率详情
生成视频每秒 21 积分5 秒视频消耗 105 积分,10 秒消耗 210 积分,15 秒消耗 315 积分。

适用场景

  • 营销概念验证将创意简报转化为短视频概念,用于评审和快速测试不同方案。

  • 社交媒体视频通过一套提示词工作流制作横屏、方形和竖屏短视频。

  • 游戏与影视预演在正式制作前探索调度、镜头语言、氛围和动作设计。

  • 运动与氛围测试在正式制作前测试单个动作、镜头运动、布光方案或视觉氛围。

实用技巧

  • 按主体与环境、主要动作、镜头方向、光线与氛围的顺序编写提示词。
  • 使用具体的运动动词,并将主体运动与镜头运动分开描述。
  • 短视频只围绕一个主要动作展开,不要串联多个无关事件。
  • 当节奏或结尾动作很重要时,说明动作应如何随时间发展。
  • 先确定交付比例,再描述取景,让构图匹配最终发布位置。
  • 删除与主要主体、镜头方向或目标视觉风格相互冲突的指令。

注意事项

  • MiniMax H3 Text-to-Video API 会拒绝源图片、源视频和源音频字段。
  • 成功提交后返回任务 ID,而不是已完成的视频。
  • status 为 not_started 或 running 时继续轮询,变为 finished 或 failed 后停止。
  • 可在请求顶层提供 callback_url,以回调方式接收终态结果。

MiniMax H3 文生视频 API 常见问题

什么是 MiniMax H3 Text-to-Video API?

MiniMax H3 Text-to-Video 是 MiniMax 推出的文字驱动视频生成模型。你只需在提示词中描述场景、动作和镜头运动,即可得到 5–15 秒整数时长的固定 2K 视频,适合无需源素材的概念镜头、广告与社交短片。

如何调用 MiniMax H3 Text-to-Video API?

使用 Bearer API Key 向 /api/generate/submit 发送 POST 请求,将 model 设为 minimax/h3/text-to-video,并把生成参数放入 input。接口会立即返回 task_id;API 页签提供可运行的 cURL、JavaScript 和 Python 示例,完整字段定义见 https://docs.vidgo.ai/api-manual/video-series/minimax-h3-text-to-video。

MiniMax H3 Text-to-Video 如何计费?

API 按生成时长计费,每秒消耗 21 积分。生成 5 秒、10 秒和 15 秒视频分别消耗 105、210 和 315 积分。提交前,运行按钮会显示按当前时长计算的美元价格。

MiniMax H3 Text-to-Video 接受哪些输入?

核心输入包括 prompt、duration、resolution 和 aspect_ratio。prompt 长度为 1–2,000 个字符,duration 可选 5–15 秒整数,resolution 固定为 2K,且 MiniMax H3 Text-to-Video API 不接受源媒体。上方参数表列出了字段要求、默认值和六种可用画面比例。

如何获取生成的视频?

使用返回的 task_id 轮询 GET /api/generate/status/{task_id},直到状态变为 finished 或 failed。任务完成后从 data.files[].file_url 读取视频地址;也可以在提交请求中加入 callback_url,异步接收最终结果。

应该选择哪个 MiniMax H3 API 模式?

场景完全由提示词定义时选择 Text-to-Video;需要首帧和可选尾帧时选择 Image-to-Video;需要多张图片、视频或音频共同引导时选择 Reference-to-Video。