A restrained cinematic comedy shot of ONE muscular adult amateur boxer reclining in a dental examination chair, wearing a plain dark charcoal T-shirt. Tight close-up of his face, neck and upper chest; his arms and all hands remain OUTSIDE the frame throughout. A single small dental inspection mirror on a thin metal stem enters slowly from the far left edge, held by an unseen dentist. It stays near the image edge and never touches the man. He notices it with only his eyes, swallows once with a visible small throat movement, then tightens his lips and furrows his brow while trying to seem brave. His head remains nearly still. Natural skin texture and subtle coherent facial muscle movement, consistent face, softly blurred clinical room background, fixed camera and soft light. One continuous six-second take, no cuts. No gloves, hands or extra people in frame, no mouth interior, no treatment, no blood, no writing, no logos, no watermark.
Hailuo 2.3 Pro Text to Video API
minimax/hailuo-2.3/pro/text-to-videoHailuo 2.3 Pro Text to Video 将文字提示词转化为电影级原生 1080p 高清视频,具备逼真的物理规律模拟、高动态范围光影呈现与精细的动态表现力。它能精准执行复杂多主体调度、平滑电影运镜与自然运动惯性,在单次固定 6 秒成片中呈现影院级视觉质感与画面细节。
示例
REST API 规格
快速开始
提交端点请求并查询任务状态。请将示例素材 URL 替换为可访问的真实文件。
第一步:配置 API 鉴权
在控制台申请 API Key,并在每个 HTTP 请求头中携带 Authorization: Bearer <API_KEY> 进行身份验证。
- 任务提交端点
- POST
https://api.vidgo.ai/api/generate/submit - 鉴权请求头
- Authorization: Bearer VIDGO_API_KEY
第 2 步:提交生成任务
POST /api/generate/submit。model 和可选 callback_url 位于根级,生成参数位于 input 内。
REQUEST_BODY=$(cat <<'JSON'
{
"model": "minimax/hailuo-2.3/pro/text-to-video",
"input": {
"prompt": "A quiet forest in morning light, with a slow camera pan.",
"duration": 6,
"resolution": "1080p",
"prompt_optimizer": false
}
}
JSON
)
RESPONSE=$(curl --silent --show-error --fail-with-body \
--request POST \
--url "https://api.vidgo.ai/api/generate/submit" \
--header "Authorization: Bearer $VIDGO_API_KEY" \
--header "Content-Type: application/json" \
--data "$REQUEST_BODY")
CODE=$(printf '%s' "$RESPONSE" | jq -r '.code // empty')
if [ "$CODE" != "0" ] && [ "$CODE" != "200" ]; then
printf 'API error: %s
' "$RESPONSE" >&2
exit 1
fi
printf '%s
' "$RESPONSE"第三步:轮询任务执行结果
使用 task_id 查询进度;not_started 或 running 时继续轮询,finished 或 failed 时停止。成功后读取 data.files[].file_url,失败时读取 data.error_message。
状态查询端点
GET https://api.vidgo.ai/api/generate/status/{task_id}使用 task_id 查询进度;not_started 或 running 时继续轮询,finished 或 failed 时停止。成功后读取 data.files[].file_url,失败时读取 data.error_message。
not_startedrunningfinishedfailed{
"code": 200,
"data": {
"task_id": "task-example",
"status": "not_started",
"created_time": "2026-09-23T08:00:00"
}
}{
"code": 200,
"data": {
"task_id": "task-unified-...",
"status": "finished",
"files": [
{
"file_url": "https://storage.vidgo.ai/generated/video.mp4",
"file_type": "video"
}
],
"created_time": "2026-08-22T10:00:00Z",
"progress": 100,
"error_message": null
}
}端到端完整脚本示例
展开查看在生产环境中具备轮询重试、异常保护和超时处理的完整自动化脚本。
set -euo pipefail
: "${VIDGO_API_KEY:?Set VIDGO_API_KEY in your environment}"
REQUEST_BODY=$(cat <<'JSON'
{
"model": "minimax/hailuo-2.3/pro/text-to-video",
"input": {
"prompt": "A quiet forest in morning light, with a slow camera pan.",
"duration": 6,
"resolution": "1080p",
"prompt_optimizer": false
}
}
JSON
)
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
--request POST \
--url "https://api.vidgo.ai/api/generate/submit" \
--header "Authorization: Bearer $VIDGO_API_KEY" \
--header "Content-Type: application/json" \
--data "$REQUEST_BODY")
TASK_ID=$(printf '%s' "$SUBMIT_RESPONSE" | jq -r '.data.task_id // .task_id // empty')
BUSINESS_CODE=$(printf '%s' "$SUBMIT_RESPONSE" | jq -r '.code // empty')
if [ "$BUSINESS_CODE" != "0" ] && [ "$BUSINESS_CODE" != "200" ]; then
printf 'Submit failed:
%s
' "$SUBMIT_RESPONSE" >&2
exit 1
fi
if [ -z "$TASK_ID" ]; then
printf 'Submit response did not include task_id:
%s
' "$SUBMIT_RESPONSE" >&2
exit 1
fi
START_TIME=$(date +%s)
POLL_DELAY=2
while true; do
if [ $(( $(date +%s) - START_TIME )) -ge 600 ]; then
printf 'Timed out after 600 seconds
' >&2
exit 1
fi
STATUS_RESPONSE=$(curl --silent --show-error --fail-with-body \
--url "https://api.vidgo.ai/api/generate/status/$TASK_ID" \
--header "Authorization: Bearer $VIDGO_API_KEY")
STATUS=$(printf '%s' "$STATUS_RESPONSE" | jq -r '.data.status // .status // empty')
BUSINESS_CODE=$(printf '%s' "$STATUS_RESPONSE" | jq -r '.code // empty')
if [ "$BUSINESS_CODE" != "0" ] && [ "$BUSINESS_CODE" != "200" ]; then
printf 'Status request failed:
%s
' "$STATUS_RESPONSE" >&2
exit 1
fi
case "$STATUS" in
finished)
printf '%s' "$STATUS_RESPONSE" | jq -r '(.data.files // .files // [])[]?.file_url'
break
;;
failed)
printf '%s' "$STATUS_RESPONSE" | jq -r '.data.error_message // .error_message // "Generation failed"' >&2
exit 1
;;
not_started|running)
sleep "$POLL_DELAY"
if [ "$POLL_DELAY" -lt 10 ]; then POLL_DELAY=$((POLL_DELAY + 1)); fi
;;
*)
printf 'Unexpected task status: %s
' "$STATUS" >&2
exit 1
;;
esac
done请求参数(input 对象)
向 /api/generate/submit 提交 POST 请求时,input 内部所支持的生成参数配置:
| 字段 | 类型 | 必填 | 默认值 | 描述 |
|---|---|---|---|---|
| prompt | string | 是 | — | 必填字符串,去除首尾空白后不能为空,最多 5,000 个 Unicode 字符。 |
| duration | integer | 否 | 6 | 仅支持 6 秒,默认 6 秒。 |
| resolution | string | 否 | 1080p | 此端点固定为 1080p;省略时使用该值。 |
| prompt_optimizer | boolean | 否 | — | 可选布尔值;省略时由上游处理,API 不设置默认值。体验区默认关闭,不增加费用。 |
响应字段(查询结果)
通过 GET /api/generate/status/{task_id} 轮询获取的任务详情:
| 字段 | 类型 | 描述 |
|---|---|---|
| code | integer | 业务响应状态码,200 表示成功。 |
| data.task_id | string | 异步任务全局唯一流水号。 |
| data.status | string | 任务执行阶段:not_started(排队中)、running(生成中)、finished(已完成)、failed(失败)。 |
| data.files | array | 生成成功时包含的成片文件列表,每项含 file_url 与 file_type。 |
| data.error_message | string | null | 任务执行异常时的具体错误描述。 |
任务生命周期
客户端应根据 status 字段判断任务进度,达到 finished 或 failed 终态时立即终止轮询:
not_started任务已接收,等待执行。
running正在生成。
finished生成完成,从 data.files 获取视频 URL。
failed生成失败,请查看 data.error_message,已扣积分按现有流程返还。
轮询与异常处理
- 轮询频次推荐建议初始轮询间隔设为 2–3 秒,随着任务持续可递增至 5 秒一次,避免过密请求。
- 网络波动与重试若查询网络出现 5xx 或连接超时,不代表任务失败,可稍作休眠后继续重试查询。
- 异步 Webhook 回调支持在提交请求体根层级传递 callback_url,在任务终态时系统将通过 POST 自动推送完整任务结果。
接口规格
| 规格项 | 取值 | 说明 |
|---|---|---|
| Model ID | minimax/hailuo-2.3/pro/text-to-video | 请求根级 model 字段。 |
| Resolution | 1080p | 此端点固定为 1080p;省略时使用该值。 |
| Duration | 6s | 仅支持 6 秒,默认 6 秒。 |
Hailuo 2.3 Pro Text to Video
Hailuo 2.3 Pro Text to Video 是 MiniMax 旗下的旗舰级文生视频模型,专为高端商业创意与电影级视觉呈现打造。模型输出固定为原生 1080p 全高清分辨率与 6 秒成片时长,呈现出卓越的画质细腻度、严谨的重力流体物理反馈以及敏锐的摄影机运镜调度。支持最长 5,000 字符的丰富提示词输入,内置免费提示词优化器,并以单次 60 积分的透明标准提供稳定高效的生成能力。
为什么选择此模式?
原生 1080p 全高清画质直接渲染输出原生 1080p 分辨率,杜绝后期超分辨率放大引入的模糊与伪影,完美还原皮肤肌理与服饰材质。
高阶物理规律仿真模拟精准解算复杂的运动惯性、水流飞溅、布料飘动与重力相互作用,确保每一帧运动趋势自然可信。
电影级环境光影与材质反光真实呈现体积光散射、镜面高光、柔和阴影过渡以及空气透视效果,展现出色的胶片级视觉质感。
5,000 字符超长提示词解析全面支持多层次复杂场景描写,支持精确指定布光方案、镜头推进轨迹、动作节奏与主体交互细节。
清晰可控的商业级制作计费单次 6 秒 1080p 视频固定消耗 60 积分($0.300),计费简单透明,方便商业项目进行精确的成本预算与核算。
参数说明
| 参数 | 要求 | 说明 |
|---|---|---|
| prompt | 必填 | 必填字符串,去除首尾空白后不能为空,最多 5,000 个 Unicode 字符。 |
| duration | 可选 | 仅支持 6 秒,默认 6 秒。 默认值 6 |
| resolution | 可选 | 此端点固定为 1080p;省略时使用该值。 默认值 1080p |
| prompt_optimizer | 可选 | 可选布尔值;省略时由上游处理,API 不设置默认值。体验区默认关闭,不增加费用。 |
使用方法
构思并撰写丰富分镜提示词在 prompt 中详细描写主体外貌、动作演化时序、布光风格与摄影机走位,最多可输入 5,000 个字符。
确认分辨率与成片时长规格模型固定采用原生 1080p 分辨率与 6 秒成片时长,确保在单次生成中集中释放高密度的画质与动态渲染算力。
灵活启用提示词优化器若提示词较为凝练,可开启 prompt_optimizer 让模型自动补齐专业电影布光与构图细节,不收取任何额外费用。
提交异步生成请求向 /api/generate/submit 端点发起 POST 请求并携带 API Key,提交任务后立即获取对应的 task_id。
轮询状态并获取成品视频通过状态查询端点轮询任务进展,待状态变更为 finished 后从 data.files 读取并下载高清 MP4 视频。
计费说明
1 credit = $0.005。按视频计费,提示词优化不增加费用。
| 计费项 | 费率 | 说明 |
|---|---|---|
| 1080p / 6s | 60 credits ($0.300) | 每个视频 |
适用场景
高端商业广告与品牌大片以原生 1080p 超清画质与电影级光影,打造极具视觉冲击力的商品特写、特效镜头与品牌宣传片。
影视剧集前期动态预演将剧本文本与导演分镜构思快速转化为动态连续画面,在实拍前直观检验运镜构图与动作表演张力。
游戏概念片与动态过场动画呈现高动态打斗、角色绝招释放与宏大世界观场景,展现强烈的物理动感与环境粒子交互。
高端社交媒体品牌营销为时尚服饰、奢品腕表、高端汽车与前沿科技产品量身定制质感卓越的短视频推广物料。
创作技巧
- 明确指定专业电影运镜指令:使用'缓慢推近'、'低角度仰拍横移'、'手持跟拍'等专业术语,赋予画面强烈的视听节奏感。
- 细致描写多光源布光结构:指明'逆光勾勒金色发丝轮廓,侧面柔光补足面部阴影'等布光安排,能深度激发 1080p 的细节表现力。
- 按照时间先后描写动作演进:在 6 秒时长内按'角色先凝视、随后转身奔跑'的顺序描写动作,使时序逻辑更加严谨平滑。
- 善用提示词优化器快速激发灵感:在灵感构思初期可开启 prompt_optimizer,让算法自动丰富色彩、镜头与光影质感。
- 融入具体的材质与微观物理细节:加入'雨水在湿润柏油路面上泛起涟漪'等具象描写,能充分激活高阶物理仿真引擎。
注意事项
- 固定 6 秒时长设计机制:Hailuo 2.3 Pro Text to Video 专为高密度 6 秒超清镜头设计,传入非 6 的时长参数会被接口直接报错拒绝。
- 原生 1080p 纯净画质标准:成片直接由生成模型以 1080p 原生分辨率渲染,不经过二次插值放大,画质纯正细腻。
- 异步任务机制与积分保障:任务采用 task_id 异步轮询获取;提交校验通过时扣除积分,若因异常生成失败将自动全额退还。
Hailuo 2.3 Pro Text to Video API 常见问题
Hailuo 2.3 Pro Text to Video API 是什么?
Hailuo 2.3 Pro Text to Video 是 MiniMax 旗下的旗舰级文本生成视频模型,专为电影级高品质视觉呈现与商业视听创作打造。它能将长达 5,000 字符的自然语言提示词转化为原生 1080p 全高清视频,在固定 6 秒的时长内展现出色的物理动态仿真、体积光影渲染与精准镜头运动。依托 MiniMax 先进的大规模多模态视频生成底座,它精准呈现复杂流体、布料重力与人物动作惯性,同时保持画面高清晰度与帧间连贯性。开发者可以通过 Vidgo REST API 轻松集成,也可以直接在上方体验区进行在线调试。
Hailuo 2.3 Pro Text to Video 的成片是原生 1080p 分辨率吗?
是的,Hailuo 2.3 Pro Text to Video 直接以原生 1080p 全高清规格渲染视频画面,而非通过低分辨率后期算法插值放大,因而具备锐利的边缘细节、真实的景深过渡与丰富的胶片级质感。
为什么 Hailuo 2.3 Pro Text to Video 仅支持 6 秒时长?
Pro 档位模型旨在单次生成中集中释放算力,确保每一帧都达到电影级的物理拟真度与画面精细度,因此专门针对 6 秒高密度镜头进行了针对性架构优化。端点严格限制 duration=6,传入其他数值将导致参数校验失败。
Hailuo 2.3 Pro Text to Video 如何计费?
该端点按视频单次生成固定计费,每个 6 秒 1080p 视频固定消耗 60 积分(约 $0.300,1 积分 = $0.005)。开启提示词优化器(prompt_optimizer)不会产生额外扣费。
Hailuo 2.3 Pro Text to Video 的物理模拟表现如何?
模型融入了强大的真实物理先验知识,能够准确模拟重力加速度、人体运动惯性、液体飞溅与布料风阻褶皱,在剧烈动作或多物体碰撞场景中能够有效避免画面撕裂与不自然的形态坍塌。
在 Hailuo 2.3 Pro Text to Video 中可以使用多长的提示词?
提示词最多支持 5,000 个 Unicode 字符。你可以全面描写画面主体、复杂时序动作、镜头运动路线、灯光色温以及微观环境氛围,模型具备强大的语义拆解与长文本指令遵循能力。
什么时候该选择 Hailuo 2.3 Pro Text to Video 而不是 Standard 模式?
当你需要交付商业广告、影视预演、游戏大片等对原生 1080p 超高清画质与复杂光影有严苛要求的成品镜头时,强烈推荐使用 Pro 模式。若你的项目处于创意验证阶段、需要 10 秒长镜头或注重单片生成成本(6 秒仅需 35 积分),则 Standard 模式更为经济灵活。