One continuous ten-second side-view 2D cel animation, clean dark outlines and flat painted violet crystal-cave background. Exactly ONE small amber jelly creature with exactly two black eyes and no limbs moves from left to right. Its body is a single cohesive blob throughout. It meets a gap between two stationary crystal pillars that is only slightly narrower than its body. It gently squashes sideways to squeeze through the short gap, rounds out again on the other side, then makes two small hops to the right and settles. The same single face stays attached to the front of its body. Keep the entire creature visible. Moderate elastic deformation only: never stretch into a long string, never break apart, divide, duplicate or leave another blob behind. Slow sideways camera follows one character in one shot. No cuts, no text, no logo, no watermark.
Hailuo 2.3 Standard Text to Video API
minimax/hailuo-2.3/standard/text-to-videoHailuo 2.3 Standard Text to Video 将文本提示词转化为细腻流畅的 768p 动态视频,支持 6 秒或 10 秒单次生成、写实物理规律模拟与多样风格呈现。它能够遵循长达 5000 字符的文字指令呈现连贯自然的肢体动态与运镜走势,同时稳定保持空间连贯性与光影质感。
示例
REST API 规格
快速开始
提交端点请求并查询任务状态。请将示例素材 URL 替换为可访问的真实文件。
第一步:配置 API 鉴权
在控制台申请 API Key,并在每个 HTTP 请求头中携带 Authorization: Bearer <API_KEY> 进行身份验证。
- 任务提交端点
- POST
https://api.vidgo.ai/api/generate/submit - 鉴权请求头
- Authorization: Bearer VIDGO_API_KEY
第 2 步:提交生成任务
POST /api/generate/submit。model 和可选 callback_url 位于根级,生成参数位于 input 内。
REQUEST_BODY=$(cat <<'JSON'
{
"model": "minimax/hailuo-2.3/standard/text-to-video",
"input": {
"prompt": "A quiet forest in morning light, with a slow camera pan.",
"duration": 6,
"resolution": "768p",
"prompt_optimizer": false
}
}
JSON
)
RESPONSE=$(curl --silent --show-error --fail-with-body \
--request POST \
--url "https://api.vidgo.ai/api/generate/submit" \
--header "Authorization: Bearer $VIDGO_API_KEY" \
--header "Content-Type: application/json" \
--data "$REQUEST_BODY")
CODE=$(printf '%s' "$RESPONSE" | jq -r '.code // empty')
if [ "$CODE" != "0" ] && [ "$CODE" != "200" ]; then
printf 'API error: %s
' "$RESPONSE" >&2
exit 1
fi
printf '%s
' "$RESPONSE"第三步:轮询任务执行结果
使用 task_id 查询进度;not_started 或 running 时继续轮询,finished 或 failed 时停止。成功后读取 data.files[].file_url,失败时读取 data.error_message。
状态查询端点
GET https://api.vidgo.ai/api/generate/status/{task_id}使用 task_id 查询进度;not_started 或 running 时继续轮询,finished 或 failed 时停止。成功后读取 data.files[].file_url,失败时读取 data.error_message。
not_startedrunningfinishedfailed{
"code": 200,
"data": {
"task_id": "task-example",
"status": "not_started",
"created_time": "2026-09-23T08:00:00"
}
}{
"code": 200,
"data": {
"task_id": "task-unified-...",
"status": "finished",
"files": [
{
"file_url": "https://storage.vidgo.ai/generated/video.mp4",
"file_type": "video"
}
],
"created_time": "2026-08-22T10:00:00Z",
"progress": 100,
"error_message": null
}
}端到端完整脚本示例
展开查看在生产环境中具备轮询重试、异常保护和超时处理的完整自动化脚本。
set -euo pipefail
: "${VIDGO_API_KEY:?Set VIDGO_API_KEY in your environment}"
REQUEST_BODY=$(cat <<'JSON'
{
"model": "minimax/hailuo-2.3/standard/text-to-video",
"input": {
"prompt": "A quiet forest in morning light, with a slow camera pan.",
"duration": 6,
"resolution": "768p",
"prompt_optimizer": false
}
}
JSON
)
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
--request POST \
--url "https://api.vidgo.ai/api/generate/submit" \
--header "Authorization: Bearer $VIDGO_API_KEY" \
--header "Content-Type: application/json" \
--data "$REQUEST_BODY")
TASK_ID=$(printf '%s' "$SUBMIT_RESPONSE" | jq -r '.data.task_id // .task_id // empty')
BUSINESS_CODE=$(printf '%s' "$SUBMIT_RESPONSE" | jq -r '.code // empty')
if [ "$BUSINESS_CODE" != "0" ] && [ "$BUSINESS_CODE" != "200" ]; then
printf 'Submit failed:
%s
' "$SUBMIT_RESPONSE" >&2
exit 1
fi
if [ -z "$TASK_ID" ]; then
printf 'Submit response did not include task_id:
%s
' "$SUBMIT_RESPONSE" >&2
exit 1
fi
START_TIME=$(date +%s)
POLL_DELAY=2
while true; do
if [ $(( $(date +%s) - START_TIME )) -ge 600 ]; then
printf 'Timed out after 600 seconds
' >&2
exit 1
fi
STATUS_RESPONSE=$(curl --silent --show-error --fail-with-body \
--url "https://api.vidgo.ai/api/generate/status/$TASK_ID" \
--header "Authorization: Bearer $VIDGO_API_KEY")
STATUS=$(printf '%s' "$STATUS_RESPONSE" | jq -r '.data.status // .status // empty')
BUSINESS_CODE=$(printf '%s' "$STATUS_RESPONSE" | jq -r '.code // empty')
if [ "$BUSINESS_CODE" != "0" ] && [ "$BUSINESS_CODE" != "200" ]; then
printf 'Status request failed:
%s
' "$STATUS_RESPONSE" >&2
exit 1
fi
case "$STATUS" in
finished)
printf '%s' "$STATUS_RESPONSE" | jq -r '(.data.files // .files // [])[]?.file_url'
break
;;
failed)
printf '%s' "$STATUS_RESPONSE" | jq -r '.data.error_message // .error_message // "Generation failed"' >&2
exit 1
;;
not_started|running)
sleep "$POLL_DELAY"
if [ "$POLL_DELAY" -lt 10 ]; then POLL_DELAY=$((POLL_DELAY + 1)); fi
;;
*)
printf 'Unexpected task status: %s
' "$STATUS" >&2
exit 1
;;
esac
done请求参数(input 对象)
向 /api/generate/submit 提交 POST 请求时,input 内部所支持的生成参数配置:
| 字段 | 类型 | 必填 | 默认值 | 描述 |
|---|---|---|---|---|
| prompt | string | 是 | — | 必填字符串,去除首尾空白后不能为空,最多 5,000 个 Unicode 字符。 |
| duration | integer | 否 | 6 | 支持 6 或 10 秒,默认 6 秒。 |
| resolution | string | 否 | 768p | 此端点固定为 768p;省略时使用该值。 |
| prompt_optimizer | boolean | 否 | — | 可选布尔值;省略时由上游处理,API 不设置默认值。体验区默认关闭,不增加费用。 |
响应字段(查询结果)
通过 GET /api/generate/status/{task_id} 轮询获取的任务详情:
| 字段 | 类型 | 描述 |
|---|---|---|
| code | integer | 业务响应状态码,200 表示成功。 |
| data.task_id | string | 异步任务全局唯一流水号。 |
| data.status | string | 任务执行阶段:not_started(排队中)、running(生成中)、finished(已完成)、failed(失败)。 |
| data.files | array | 生成成功时包含的成片文件列表,每项含 file_url 与 file_type。 |
| data.error_message | string | null | 任务执行异常时的具体错误描述。 |
任务生命周期
客户端应根据 status 字段判断任务进度,达到 finished 或 failed 终态时立即终止轮询:
not_started任务已接收,等待执行。
running正在生成。
finished生成完成,从 data.files 获取视频 URL。
failed生成失败,请查看 data.error_message,已扣积分按现有流程返还。
轮询与异常处理
- 轮询频次推荐建议初始轮询间隔设为 2–3 秒,随着任务持续可递增至 5 秒一次,避免过密请求。
- 网络波动与重试若查询网络出现 5xx 或连接超时,不代表任务失败,可稍作休眠后继续重试查询。
- 异步 Webhook 回调支持在提交请求体根层级传递 callback_url,在任务终态时系统将通过 POST 自动推送完整任务结果。
接口规格
| 规格项 | 取值 | 说明 |
|---|---|---|
| Model ID | minimax/hailuo-2.3/standard/text-to-video | 请求根级 model 字段。 |
| Resolution | 768p | 此端点固定为 768p;省略时使用该值。 |
| Duration | 6 / 10s | 支持 6 或 10 秒,默认 6 秒。 |
Hailuo 2.3 Standard Text to Video
Hailuo 2.3 Standard Text to Video 由 MiniMax 研发,专为高质量文生视频创作设计。用户可输入长达 5000 字符的自然语言提示词,细致编排多阶段角色动作、光影氛围与镜头运镜轨迹。模型在 768p 分辨率下生成连续的 6 秒或 10 秒视频片段,兼顾写实、动漫与游戏 CG 等多种美术风格,并支持以透明的每视频积分费率灵活调用。
为什么选择此模式?
纯文本驱动生动场景无需预设任何参考图像,仅凭文字描述直接构筑角色形象、宏观场景与丰富动作。
5000 字符超长文本容量支持极其详尽的分镜剧本输入,容纳精细的打光角度、肢体交互与长时序动作引导。
真实物理世界运动模拟精准模拟重力加速度、流体运动与碰撞惯性,使人物动作与环境反应更加符合真实直觉。
写实与艺术风格多样兼容除高质量写实视觉外,对动漫二次元、插画手绘以及游戏 CG 风格提供出色的连贯呈现。
透明固定的阶梯计费6 秒单次仅需 35 积分,10 秒单次 70 积分,计费公开透明且任务异常自动退还积分。
参数说明
| 参数 | 要求 | 说明 |
|---|---|---|
| prompt | 必填 | 必填字符串,去除首尾空白后不能为空,最多 5,000 个 Unicode 字符。 |
| duration | 可选 | 支持 6 或 10 秒,默认 6 秒。 默认值 6 |
| resolution | 可选 | 此端点固定为 768p;省略时使用该值。 默认值 768p |
| prompt_optimizer | 可选 | 可选布尔值;省略时由上游处理,API 不设置默认值。体验区默认关闭,不增加费用。 |
使用方法
构思主体与场景在提示词开头明确人物外观、视觉主体与环境布景,建立清晰的空间基底。
编排动作时序与摄影机运镜按时间先后描写具体动作过程,并使用推拉摇移等运镜词汇引导视觉焦点移动。
选取生成时长根据情节需要选择 6 秒快速镜头或 10 秒长叙事片段,分辨率固定为清晰的 768p 规格。
按需开启提示词优化当输入文本较为简短时,可开启 prompt_optimizer 自动增补电影级光影与质感细节,且不产生额外扣费。
提交任务并查收成片点击运行或通过 REST API 发起异步生成任务,利用 task_id 轮询并在任务完成后获取 MP4 视频链接。
计费说明
1 credit = $0.005。按视频计费,提示词优化不增加费用。
| 计费项 | 费率 | 说明 |
|---|---|---|
| 768p / 6s | 35 credits ($0.175) | 每个视频 |
| 768p / 10s | 70 credits ($0.350) | 每个视频 |
适用场景
影视与短剧概念预演将剧本文本快速具象化为动态分镜样片,在前期策划中高效验证镜头节奏与戏剧氛围。
动漫与多风格二创创作基于文本直接生成画面风格稳定、线条动作流畅的动漫与插画动态片段。
社媒高曝光短视频制作面向主流短视频与内容平台,批量产出具有高吸引力与真实物理质感的创意动态内容。
商业广告动态视觉设计根据文案创意生成产品概念展示与场景动态走势,大幅降低商业营销视频制作门槛。
创作技巧
- 主体动作与镜头运动分句描写:将角色自身的肢体运动与摄影机的推移轨迹写在不同句子中,有助于画面动态更清晰。
- 充分利用 5000 字符容量:支持最多 5000 个字符输入,可详尽刻画天气光线、材质反光、景深变化与动作节奏。
- 灵活选择提示词优化器:初次构思简短概念时开启优化器润色;若已有非常严密的专业分镜脚本,建议关闭以严格遵循原意。
- 根据场景复杂度选时长:单一动作或快速转场推荐使用 6 秒(35 积分),多阶段复合演化推荐使用 10 秒(70 积分)。
- 用具体物理线索替代抽象形容词:使用'雨水顺着反光地面流淌'代替'震撼的场景',能让模型更准确地还原细节。
注意事项
- 纯文本输入接口契约:本端点专用于文字生成视频,仅接收 prompt 字符串,不支持附加图像文件。
- 固定 768p 输出规格:输出分辨率固定为 768p,时长仅支持 6 秒或 10 秒整数配置。
- 异步任务与积分保障:任务通过唯一 task_id 异步执行并追踪进度;积分在任务提交校验时扣除,若生成失败将自动退款。
Hailuo 2.3 Standard Text to Video API 常见问题
Hailuo 2.3 Standard Text to Video API 是什么?
Hailuo 2.3 Standard Text to Video 是 MiniMax 研发的文本生成视频模型。它根据纯文本提示词直接生成 768p 分辨率的连续动态视频,支持 6 秒与 10 秒单次输出、写实物理规律模拟与可选智能提示词优化。基于 MiniMax 先进的视频生成架构,它在严格遵循文本时序动作与镜头运镜的同时,稳定保持环境空间连贯性与光影细节,并广泛兼容写实、动漫与 CG 等多样美术风格。你可以通过 API 进行程序化调用,也可以在上方体验区直接在线试用。
Hailuo 2.3 Standard Text to Video 支持生成 10 秒长视频吗?
支持。模型提供 6 秒与 10 秒两种整秒时长选项(默认时长为 6 秒)。选择 10 秒时长能够在单次任务中展现更完整的情节推进、多阶段主体动作以及平滑的镜头景别转换。
Hailuo 2.3 Standard Text to Video 的提示词优化器有什么作用?
提示词优化器(prompt_optimizer)能够对输入的简短文本进行智能润色与视觉扩充,自动补全光影层次、质感纹理与摄影机运动细节。该功能为可选布尔值,在体验区默认关闭,开启后不会产生额外扣费。
Hailuo 2.3 Standard Text to Video 支持多长的文本提示词?
提示词在校验前会去除首尾多余空白,有效字符长度支持 1 到 5000 个 Unicode 字符。你可以充分利用该容量详尽描述人物外观、多时段动作变化以及景深光线要求。
Hailuo 2.3 Standard Text to Video 如何计费?
该端点按视频单次生成固定计费(1 积分 = $0.005)。6 秒 768p 视频消耗 35 积分(约 $0.175),10 秒 768p 视频消耗 70 积分(约 $0.350)。开启提示词优化不收取额外费用。
Hailuo 2.3 Standard Text to Video 支持渲染动漫与 CG 等多样艺术风格吗?
支持。除写实自然场景外,该模型对动漫二次元、数字插画、水墨手绘以及游戏 CG 风格具有良好的理解与表现力,能稳定保持全片艺术风格的一致连贯。
什么时候该选择 Hailuo 2.3 Standard 而不是 Pro 模式?
Standard 模式适合注重成本控制、需要 6 秒或 10 秒灵活时长、或在创意构思阶段大批量低成本迭代的场景(单次 35 积分起);若项目要求原生 1080p 超高清分辨率或更具张力的极致电影级视觉呈现,可选择 Pro 模式。