Steam rises gently from the hot coffee, swirling in the morning light, subtle camera drift
Kling 3.0 Turbo Standard Image to Video API
kwaivgi/kling-v3-turbo-std/image-to-videoKling 3.0 Turbo Standard Image to Video 将单张首帧图片动化为 3–15 秒 720p 视频,支持构图与主体精确保留、原生音画口型同步以及最多 6 镜头分镜延续。它在注入运镜与动作时保持原图主体身份与画面布局,并让对白口型与画面事件自然同步。使用 multi_prompt 并省略顶层 duration 时,也支持镜头合计 1–2 秒。
请上传所需图片。
生成的视频会显示在这里
填写提示词并添加所需素材,确认设置后点击“运行”。
示例
REST API
快速开始
使用 API 鉴权,提交参数,再用任务 ID 取回视频。
连接到 Vidgo API
创建 API key,仅保存在服务端,并发送 Authorization: Bearer VIDGO_API_KEY。
- 端点
- POST
https://api.vidgo.ai/api/generate/submit - 鉴权
- Authorization: Bearer VIDGO_API_KEY
提交一次生成任务
按请求示例填写本端点参数,保存返回的 task_id 用于查询进度和结果。
REQUEST_BODY=$(cat <<'JSON'
{
"model": "kwaivgi/kling-v3-turbo-std/image-to-video",
"input": {
"image_urls": [
"https://cdn.vidgo.ai/apis/models/kwaivgi/kling-v3-turbo-std/image-to-video/v1/01/input-01.png"
],
"prompt": "Steam rises gently from the hot coffee, swirling in the morning light, subtle camera drift",
"duration": 5
}
}
JSON
)
RESPONSE=$(curl --silent --show-error --fail-with-body \
--request POST \
--url "https://api.vidgo.ai/api/generate/submit" \
--header "Authorization: Bearer $VIDGO_API_KEY" \
--header "Content-Type: application/json" \
--data "$REQUEST_BODY")
CODE=$(printf '%s' "$RESPONSE" | jq -r '.code // empty')
if [ "$CODE" != "0" ] && [ "$CODE" != "200" ]; then
printf 'API error: %s
' "$RESPONSE" >&2
exit 1
fi
printf '%s
' "$RESPONSE"等待结果
用 task_id 查询,not_started/running 继续,finished/failed 停止。成功后读取 data.files[].file_url。
查询状态
GET https://api.vidgo.ai/api/generate/status/{task_id}以 2 秒为基准轮询状态,较长任务加大间隔。仅在 not_started 或 running 时继续,finished 或 failed 立即停止。也可在请求中指定 callback_url 接收 webhook。
not_startedrunningfinishedfailed{
"code": 200,
"data": {
"task_id": "task-unified-...",
"status": "running",
"created_time": "2026-09-16T10:00:00Z"
}
}{
"code": 200,
"data": {
"task_id": "task-unified-...",
"status": "finished",
"files": [
{
"file_url": "https://storage.vidgo.ai/generated/video.mp4",
"file_type": "video"
}
],
"created_time": "2026-08-22T10:00:00Z",
"progress": 100,
"error_message": null
}
}完整可运行示例
展开查看含 HTTP 与业务码检查、task_id 校验、轮询、终态处理和超时边界的完整脚本。
set -euo pipefail
: "${VIDGO_API_KEY:?Set VIDGO_API_KEY in your environment}"
REQUEST_BODY=$(cat <<'JSON'
{
"model": "kwaivgi/kling-v3-turbo-std/image-to-video",
"input": {
"image_urls": [
"https://cdn.vidgo.ai/apis/models/kwaivgi/kling-v3-turbo-std/image-to-video/v1/01/input-01.png"
],
"prompt": "Steam rises gently from the hot coffee, swirling in the morning light, subtle camera drift",
"duration": 5
}
}
JSON
)
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
--request POST \
--url "https://api.vidgo.ai/api/generate/submit" \
--header "Authorization: Bearer $VIDGO_API_KEY" \
--header "Content-Type: application/json" \
--data "$REQUEST_BODY")
TASK_ID=$(printf '%s' "$SUBMIT_RESPONSE" | jq -r '.data.task_id // .task_id // empty')
BUSINESS_CODE=$(printf '%s' "$SUBMIT_RESPONSE" | jq -r '.code // empty')
if [ "$BUSINESS_CODE" != "0" ] && [ "$BUSINESS_CODE" != "200" ]; then
printf 'Submit failed:
%s
' "$SUBMIT_RESPONSE" >&2
exit 1
fi
if [ -z "$TASK_ID" ]; then
printf 'Submit response did not include task_id:
%s
' "$SUBMIT_RESPONSE" >&2
exit 1
fi
START_TIME=$(date +%s)
POLL_DELAY=2
while true; do
if [ $(( $(date +%s) - START_TIME )) -ge 600 ]; then
printf 'Timed out after 600 seconds
' >&2
exit 1
fi
STATUS_RESPONSE=$(curl --silent --show-error --fail-with-body \
--url "https://api.vidgo.ai/api/generate/status/$TASK_ID" \
--header "Authorization: Bearer $VIDGO_API_KEY")
STATUS=$(printf '%s' "$STATUS_RESPONSE" | jq -r '.data.status // .status // empty')
BUSINESS_CODE=$(printf '%s' "$STATUS_RESPONSE" | jq -r '.code // empty')
if [ "$BUSINESS_CODE" != "0" ] && [ "$BUSINESS_CODE" != "200" ]; then
printf 'Status request failed:
%s
' "$STATUS_RESPONSE" >&2
exit 1
fi
case "$STATUS" in
finished)
printf '%s' "$STATUS_RESPONSE" | jq -r '(.data.files // .files // [])[]?.file_url'
break
;;
failed)
printf '%s' "$STATUS_RESPONSE" | jq -r '.data.error_message // .error_message // "Generation failed"' >&2
exit 1
;;
not_started|running)
sleep "$POLL_DELAY"
if [ "$POLL_DELAY" -lt 10 ]; then POLL_DELAY=$((POLL_DELAY + 1)); fi
;;
*)
printf 'Unexpected task status: %s
' "$STATUS" >&2
exit 1
;;
esac
done输入参数
下表列出可用输入参数、类型和默认值。请求示例还包含必填的顶层 model 字段。
| 字段 | 类型 | 必填 | 默认值 | 说明 |
|---|---|---|---|---|
| image_urls | array | 是 | — | 恰好 1 个公网图片 URL,作为首帧。 |
| prompt | string | 否 | — | 1–2500 字符。与 multi_prompt 互斥。 |
| duration | integer | 否 | 镜头总时长 / 5 | 显式 duration 必须为 3–15 秒;多镜头时须等于镜头总时长。省略时使用镜头总时长(允许 1–15 秒),无多镜头时默认为 5 秒。 |
| multi_prompt | array | 否 | — | 1–6 个镜头;每个镜头必须有非空 prompt,duration 可选,范围 1–15 秒,默认 5 秒。总时长不超过 15 秒。与非空 prompt 互斥。 |
| multi_prompt[].prompt | string | 是(若提供 multi_prompt) | — | 该镜头提示词,最多 2500 字符。 |
| multi_prompt[].duration | integer | 否 | 5 | 该镜头时长 1–15 秒。 |
| aspect_ratio | string | 否 | — | 输出比例跟随输入图片;本端点的 aspect_ratio 字段不影响输出。 |
响应字段
成功提交会返回任务 ID。状态查询提供进度、输出文件和失败详情。
| 字段 | 类型 | 说明 |
|---|---|---|
| code | integer | 应用结果码;成功响应为 0 或 200。 |
| message | string | 可读消息;失败时给出错误详情。 |
| data.task_id | string | 用于状态查询路径的任务 ID。 |
| data.status | string | not_started, running, finished, or failed. |
| data.created_time | string | 任务创建时间,date-time 格式。 |
| data.progress | integer | 任务进度,范围为 0–100;仅在响应包含此字段时提供。 |
| data.files[] | array | 成功任务的全部输出文件,按响应顺序。 |
| data.files[].file_url | string | 生成视频的公网 URL。 |
| data.files[].file_type | string | 文件类型,例如 video。 |
| data.error_message | string | null | status 为 failed 时的失败详情。 |
任务生命周期
status 为 not_started 或 running 时继续查询;到 finished 或 failed 后停止,再处理输出或错误。
not_started任务已接受,等待开始。
running正在生成。继续用同一 task_id 轮询。
finished生成成功。从 data.files[].file_url 读取视频 URL。
failed生成失败。读取 data.error_message 并停止轮询。
轮询与错误
- 鉴权遇到 401 时,检查 Authorization 中的 Bearer API key,更新凭证后重试。
- 参数校验遇到 400 时,根据响应检查必填字段、取值范围和可用积分,调整后重新提交。
- 网络与超时状态查询遇到网络错误或超时,保留原 task_id 重试查询,再按返回状态处理。
- 轮询间隔以 2 秒为基准轮询状态,较长任务逐步加大间隔。
- 终态仅在 not_started 或 running 时继续。finished 或 failed 立即停止。
- 回调选项可在请求顶层提供 callback_url 接收最终任务对象;投递失败时仍可轮询。
模型规格
| 规格 | 取值 | 说明 |
|---|---|---|
| 输入模式 | 首帧图片,可选文本提示词 | image_urls 恰好 1 张图;prompt 可选。 |
| 输出 | 视频 | 提交后返回异步任务 ID。 |
| 时长 | 3–15 秒 | 整数取值,默认 5 秒。 |
| 分辨率 | 720p | 由 Standard 档位固定,不是请求字段。 |
| 计费依据 | 输出秒数 × 17 credits/秒 | 默认 5 秒为 85 credits($0.425)。 |
Kling 3.0 Turbo Standard Image to Video
Kling 3.0 Turbo Standard Image to Video 将单张静态首帧图动化为 3–15 秒 720p 动态视频。依托构图与主体精确保留、原生音画口型同步以及最多 6 镜头分镜延续,适合产品展示、角色表演与短视频广告的快速迭代生产。使用 multi_prompt 并省略顶层 duration 时,也支持镜头合计 1–2 秒。
为什么选择它?
首帧构图与主体精确保留以上传的静态图作为首帧,动化过程中锁定主体外观、服饰纹理与原始构图,让成片从第一帧起就延续你的视觉设计。
原生音画与高保真口型同步在生成画面的同时合成匹配音频,人物对白口型与发音紧密对齐,无需额外后期配音即可交付带声短片。
最多 6 镜头分镜延续通过 multi_prompt 在单次请求中编排 1–6 个镜头的景别、运镜与动作,并在切镜间延续角色与场景特征。
画幅比例跟随首帧图片输出比例自动继承首帧图片的纵横比,竖版海报、横版产品图或方图均可直接落到对应画幅,减少二次裁切。
3–15 秒灵活整数时长可在 3 至 15 秒范围内指定整数时长,默认 5 秒,覆盖开屏钩子、产品特写与短广告叙事等多种节奏。
高性价比 720p Standard 费率以每秒 17 积分($0.085/秒)提供清晰 720p 输出,适合大批量打样与短视频内容的高吞吐生产。
参数
| 参数 | 要求 | 说明 |
|---|---|---|
| image_urls | 必填 | 字符串数组,恰好 1 个公网图片 URL,作为首帧。 |
| prompt | 可选 | 字符串,1–2500 字符。与 multi_prompt 互斥。 |
| duration | 可选 | 显式 duration 必须为 3–15 秒;多镜头时须等于镜头总时长。省略时使用镜头总时长(允许 1–15 秒),无多镜头时默认为 5 秒。 默认值 镜头总时长 / 5 |
| multi_prompt | 可选 | 1–6 个镜头;每个镜头必须有非空 prompt,duration 可选,范围 1–15 秒,默认 5 秒。总时长不超过 15 秒。与非空 prompt 互斥。 |
| aspect_ratio | 可选 | 输出比例跟随输入图片;本端点的 aspect_ratio 字段不影响输出。 |
使用方法
提供首帧图片在 image_urls 中填入恰好 1 个公网可访问的图片 URL,作为成片起始画面与构图锚点。
编写动作提示词可选填写 prompt,写清希望注入的运镜、主体动作与声音线索;需要分镜时改用 multi_prompt,二者互斥。
配置多镜头分镜使用 multi_prompt 配置 1–6 个镜头,每项 prompt 必填,duration 可省略,默认为 5 秒。总时长不超过 15 秒;顶层 duration 可省略,提供时须等于镜头总和且为 3–15 秒。
设定输出时长在 3–15 秒整数范围内选择成片时长,体验区默认预选 5 秒;比例将自动跟随首帧图片。
确认费用并运行查看运行按钮显示的当前配置费用,确认首帧与提示词后点击“运行”。
预览并下载视频任务完成后,在输出面板预览画面与声音,点击“下载视频”保存 720p 结果。
价格
按输出视频秒数计费。1 credit = $0.005。Standard 档固定 720p。
| 用量 | 费率 | 说明 |
|---|---|---|
| 720p | 17 credits/sec ($0.085/sec) | 默认 5s 为 85 credits($0.425)。官方对比价 $0.106/sec。 |
适用场景
电商产品静帧动化将商品主图或场景静帧转为带运镜与环境声的短展示片,快速覆盖详情页与信息流投放素材。
角色对白与口型表演以角色立绘或写真为首帧,生成带自然口型同步的说话或反应镜头,适合短剧钩子与虚拟主播片段。
概念图多镜头广告用一张关键视觉作起点,通过 multi_prompt 编排特写到全景的分镜序列,一次产出完整短广告节奏。
竖屏社交内容打样上传 9:16 首帧图,直接继承竖屏比例生成 Reels、Shorts 与抖音风格短片,加速批量试版。
720p 创意快速迭代在 Standard 档以较低费率反复验证动作与分镜方案,确认方向后再切换更高清档位做成片。
Pro Tips
- 选择主体清晰、构图干净的首帧图,并在提示词中写明面容、服饰与材质,为主体延续提供明确视觉锚点。
- 描述动作时从首帧已有姿态出发,例如“沿车身缓慢前推后拉远驶入雨夜街道”,避免与原图构图冲突的突变指令。
- 使用 multi_prompt 时为每镜标注时长与景别,并保持角色与场景描述一致,便于跨镜头延续。
- 需要口型对白时,在提示词中写清说话内容与语气;原生音频会随画面一并生成。
- 竖屏投放请直接上传竖构图首帧,比例会跟随图片;单镜节奏可用 3–5 秒,多节拍叙事再拉长到 8–15 秒。
使用说明
- Kling 3.0 Turbo Standard Image to Video 要求 image_urls 恰好提供 1 张公网图片作为首帧;prompt 与 multi_prompt 互斥,任选其一指导动作。
- 输出固定为 720p,画幅比例跟随首帧图片;时长可选 3–15 秒,默认 5 秒。
- 按输出视频秒数计费,费率为 17 credits/秒($0.085/秒);默认 5 秒为 85 credits($0.425)。
- 通过 API 提交后保存返回的 task_id,用于查询进度并获取最终视频链接。
Kling 3.0 Turbo Standard Image to Video API 常见问题
Kling 3.0 Turbo Standard Image to Video API 是什么?
Kling 3.0 Turbo Standard Image to Video 是快手(Kling AI)用于将单张首帧图片动化为短视频的模型。它根据恰好 1 张首帧图与可选提示词通常生成 3–15 秒 720p 视频,具备构图与主体精确保留、原生音画口型同步以及最多 6 镜头分镜延续。依托 Kling 3.0 Turbo 的高速生成与多镜头一致性能力,它在注入运镜与动作时保持原图主体身份与画面布局,并让对白口型与画面事件自然同步。你可以通过 API 进行程序化调用,也可以在上方体验区直接在线试用。 使用 multi_prompt 并省略顶层 duration 时,也允许镜头合计 1 或 2 秒。
Kling 3.0 Turbo Standard Image to Video 如何使用首帧图片?
在 image_urls 中提供恰好 1 个公网图片 URL,该图将作为成片起始画面与构图锚点。可再配合可选 prompt 描述运镜、动作与声音,或改用 multi_prompt 做分镜;完整字段说明见本页参数表。
Kling 3.0 Turbo Standard Image to Video 如何保持人物一致性?
模型以首帧图锁定人物面容、服饰与构图,并在多镜头切换中延续角色与场景特征。上传主体清晰的参考图,并在提示词中写明外观与服饰细节,可进一步稳定跨镜头表现。
Kling 3.0 Turbo Standard Image to Video 怎样配置 multi_prompt?
multi_prompt 支持 1–6 个镜头,每个镜头必须有非空 prompt;镜头 duration 可选,须为 1–15 秒的整数,默认 5 秒。镜头总时长不能超过 15 秒。省略顶层 duration 时使用镜头时长之和,也允许合计 1 或 2 秒;显式传入时须为 3–15 秒的整数,且等于镜头时长之和。multi_prompt 不能与非空的顶层 prompt 同时使用。分镜请在 JSON 模式编辑;尝试切换表单时会保留 JSON 模式及全部镜头配置。
Kling 3.0 Turbo Standard Image to Video 的比例继承怎么工作?
输出比例跟随输入图片;本端点的 aspect_ratio 字段不影响输出。
Kling 3.0 Turbo Standard Image to Video 是否包含原生音频?
是的,生成结果随画面一并包含原生音画,并对白口型与发音紧密对齐。在提示词中写清说话内容、语气或环境声线索,可进一步引导声轨表现。
Kling 3.0 Turbo Standard Image to Video 该如何选型?
需要从已有静帧快速打样、控制成本时,优先选本页 Standard 档(固定 720p,17 credits/秒)。若同一首帧流程需要更高清交付,可改用 Kling 3.0 Turbo Pro Image to Video(固定 1080p);若没有首帧图、只靠文案起片,则选择对应的 Text to Video 变体。


