MiniMax H3 Image-to-Video API

minimax/h3/image-to-video
2K · 5–15 sec

MiniMax H3 Image-to-Video API 接受首帧、提示词和可选尾帧,并返回 5–15 秒的固定 2K 视频任务。首帧必须放在 image_urls 第一位,可选尾帧放在第二位;请求中不要发送 aspect_ratio。

输入

103/2000
首帧 preview
尾帧 preview

输出

已就绪
5 秒 × $0.105/秒 = $0.525

继续使用

MiniMax H3 Image-to-Video API

MiniMax H3 Image-to-Video API 接受一至两个按顺序排列的公开 HTTP(S) 图片 URL,以及 1–2,000 个字符的提示词。第一张图片是必填首帧,第二张是可选尾帧;成功提交后返回固定 2K 视频的异步任务。

为什么选择 MiniMax H3 Image-to-Video API?

  • 直接从图片生成视频。对现有图片进行动态化,无需用文本重新构建主体和视觉方向。

  • 使用已确定的图片作为首帧。将用于定义开场主体和构图的图片放在 image_urls 第一位。

  • 按需引导结束状态。当最终画面需要更明确的控制时,添加一张兼容的尾帧。

  • 描述主体运动和镜头运动。用提示词控制主体运动、镜头行为、节奏和画面过渡。

  • 固定 2K 分辨率并按秒计费。生成 5–15 秒的固定 2K 视频,每生成 1 秒消耗 21 积分。

参数说明

参数要求说明
prompt必填

描述主体运动、镜头运动、节奏和场景发展。去除首尾空格后长度为 1–2,000 个字符。

image_urls必填

按顺序提供 1 或 2 个公开 HTTP(S) 图片 URL:必填首帧在前,可选尾帧在后。

duration可选

取值为 5–15 的整数秒。

默认值55–15
resolution固定

不接受其他分辨率。

默认值2K
aspect_ratio不接受

请勿发送此字段;MiniMax H3 Image-to-Video API 的参数校验会拒绝 aspect_ratio。

使用方法

  1. 确定起始画面选择需要作为视频第一帧的图片,并将其放在 image_urls 第一位。

  2. 按需添加尾帧当结束状态需要引导时,在首帧后添加一张内容和构图兼容的图片。

  3. 描述主体运动说明哪些内容需要移动、怎样移动,以及动作应如何发展。

  4. 指导镜头和场景补充镜头运动、节奏、场景发展、光线和氛围。

  5. 设置时长并提交选择 5–15 秒,运行请求,然后轮询 task ID,或使用回调 URL。

计费

费用仅取决于生成时长,每生成 1 秒视频消耗 21 积分。首帧和尾帧不会产生额外费用。

计费项目费率详情
生成视频每秒 21 积分5 秒视频消耗 105 积分,10 秒消耗 210 积分,15 秒消耗 315 积分。

适用场景

  • 产品图片动态化将已审核的产品图片作为首帧,并在提示词中描述产品或镜头需要发生的运动。

  • 营销素材变体将主视觉转化为适用于发布、社交媒体和展示广告的简洁动态素材。

  • 首尾帧过渡通过按顺序提供的源画面,引导两个兼容视觉状态之间的过渡。

  • 故事板运动测试在制作完整镜头前,将选定的故事板画面发展为简短的运动测试。

实用技巧

  • 使用主体清晰、画质锐利且构图已匹配交付格式的首帧。
  • 重点描述应该发生的运动,不要重复图片中已经清楚可见的外观细节。
  • 将主体运动、镜头运动和节奏写成相互独立的指令。
  • 一个简单动作使用较短时长;场景需要清晰过渡时再增加时间。
  • 使用尾帧时,让它与首帧的主体身份、取景和视觉方向保持兼容。
  • 避免首尾帧在视角、光线或主体大小上出现突兀变化。

注意事项

  • 可选尾帧只能跟在必填首帧之后,并且必须位于 image_urls 第二位。
  • MiniMax H3 Image-to-Video API 会拒绝 aspect_ratio,不接受用户指定画面比例。
  • 成功提交后返回任务 ID,而不是已完成的视频。
  • status 为 not_started 或 running 时继续轮询,也可提供 callback_url 接收终态结果。

MiniMax H3 图生视频 API 常见问题

什么是 MiniMax H3 Image-to-Video API?

MiniMax H3 Image-to-Video 是 MiniMax 推出的静态图片转视频模型。你需要提供一张首帧图片,用文字描述运动,并可加入尾帧引导;模型会生成固定 2K 视频,适合产品动画、角色运动和可控画面转场。

如何调用 MiniMax H3 Image-to-Video API?

使用 Bearer API Key 向 /api/generate/submit 发送 POST 请求,将 model 设为 minimax/h3/image-to-video,并把生成参数放入 input。接口会立即返回 task_id;API 页签提供可运行的 cURL、JavaScript 和 Python 示例,完整字段定义见 https://docs.vidgo.ai/api-manual/video-series/minimax-h3-image-to-video。

MiniMax H3 Image-to-Video 如何计费?

API 按生成时长计费,每秒消耗 21 积分,首帧和尾帧不单独收费。生成 5 秒、10 秒和 15 秒视频分别消耗 105、210 和 315 积分。提交前,运行按钮会显示按当前时长计算的美元价格。

MiniMax H3 Image-to-Video 接受哪些输入?

核心输入包括 prompt、image_urls、duration 和 resolution。需要提供 1–2,000 个字符的 prompt,以及一到两个按顺序排列的图片:必填首帧在前,可选尾帧在后;duration 可选 5–15 秒整数,resolution 固定为 2K,且不接受 aspect_ratio。上方参数表列出了字段要求和默认值。

如何获取生成的视频?

使用返回的 task_id 轮询 GET /api/generate/status/{task_id},直到状态变为 finished 或 failed。任务完成后从 data.files[].file_url 读取视频地址;也可以在提交请求中加入 callback_url,异步接收最终结果。

应该选择哪个 MiniMax H3 接口?

首帧需要确定构图、可选尾帧需要引导结束状态时选择 Image-to-Video;没有源素材时选择 Text-to-Video;需要多项媒体参考控制外观、运动或声音时选择 Reference-to-Video。