Animate this exact underwater observation cabin in one continuous five-second shot. Preserve the researcher's identity, orange shirt, cabin and round window. She turns her face slightly toward the camera, smiles with quiet surprise and says clearly in English, 'We have company.' Natural synchronized lips, eyes and subtle expression; finish the sentence by the fourth second. Outside the window, the single manta ray continues gliding forward toward the right edge of the window, gently moving its broad fins. Faint moving blue caustics play on the cabin wall. Fixed camera, believable human movement and stable facial features. Native audio: her warm close voice, low enclosed cabin ventilation and a distant muted watery rumble. No music, subtitles, text, added characters or cuts.
Kling 2.6 Pro Image to Video API
kwaivgi/kling-v2.6-pro/image-to-videoKling 2.6 Pro Image to Video 将静态图像转化为 1080p 高清动态视频,支持单图首帧驱动、首尾双关键帧控制与原生同步音频生成。它能够在赋予画面自然生动运动轨迹的同时,高保真保留源图中的主体面容、服装纹理与环境构图透视。
784/1,000

示例
REST API 规格
快速上手
提交任务并查询状态。example.com 和 your-domain.com 地址仅为占位示例;图片和回调地址请替换为你自己的公开可访问地址,输出文件地址仅作展示。
第一步:配置身份鉴权
在控制台申请 API Key,并在发起请求时通过请求头携带 Authorization: Bearer <API_KEY>。
- 任务提交端点
- POST
https://api.vidgo.ai/api/generate/submit - 鉴权请求头
- Authorization: Bearer VIDGO_API_KEY
第二步:提交生成任务
POST /api/generate/submit: kwaivgi/kling-v2.6-pro/image-to-video
REQUEST_BODY=$(cat <<'JSON'
{
"model": "kwaivgi/kling-v2.6-pro/image-to-video",
"input": {
"prompt": "A slow camera pan across a sunlit garden.",
"duration": 5,
"sound": false,
"aspect_ratio": "16:9",
"image_urls": [
"https://example.com/start-frame.png"
]
}
}
JSON
)
RESPONSE=$(curl --silent --show-error --fail-with-body \
--request POST \
--url "https://api.vidgo.ai/api/generate/submit" \
--header "Authorization: Bearer $VIDGO_API_KEY" \
--header "Content-Type: application/json" \
--data "$REQUEST_BODY")
CODE=$(printf '%s' "$RESPONSE" | jq -r '.code // empty')
if [ "$CODE" != "0" ] && [ "$CODE" != "200" ]; then
printf 'API error: %s
' "$RESPONSE" >&2
exit 1
fi
printf '%s
' "$RESPONSE"第三步:轮询任务执行结果
使用 task_id 查询进度;not_started 或 running 时继续轮询,finished 或 failed 时停止。成功后读取 data.files[].file_url,失败时读取 data.error_message。
状态查询端点
GET https://api.vidgo.ai/api/generate/status/{task_id}使用 task_id 查询进度;not_started 或 running 时继续轮询,finished 或 failed 时停止。成功后读取 data.files[].file_url,失败时读取 data.error_message。
not_startedrunningfinishedfailed{
"code": 200,
"data": {
"task_id": "task-example",
"status": "running",
"created_time": "2026-09-23T00:00:00Z"
}
}{
"code": 200,
"data": {
"task_id": "task-example",
"status": "finished",
"files": [
{
"file_type": "video",
"file_url": "https://example.com/output.mp4"
}
],
"created_time": "2026-09-23T00:00:00Z"
}
}端到端完整脚本示例
展开查看在生产环境中具备轮询重试、异常保护和超时处理的完整自动化脚本。
set -euo pipefail
: "${VIDGO_API_KEY:?Set VIDGO_API_KEY in your environment}"
REQUEST_BODY=$(cat <<'JSON'
{
"model": "kwaivgi/kling-v2.6-pro/image-to-video",
"input": {
"prompt": "A slow camera pan across a sunlit garden.",
"duration": 5,
"sound": false,
"aspect_ratio": "16:9",
"image_urls": [
"https://example.com/start-frame.png"
]
}
}
JSON
)
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
--request POST \
--url "https://api.vidgo.ai/api/generate/submit" \
--header "Authorization: Bearer $VIDGO_API_KEY" \
--header "Content-Type: application/json" \
--data "$REQUEST_BODY")
TASK_ID=$(printf '%s' "$SUBMIT_RESPONSE" | jq -r '.data.task_id // .task_id // empty')
BUSINESS_CODE=$(printf '%s' "$SUBMIT_RESPONSE" | jq -r '.code // empty')
if [ "$BUSINESS_CODE" != "0" ] && [ "$BUSINESS_CODE" != "200" ]; then
printf 'Submit failed:
%s
' "$SUBMIT_RESPONSE" >&2
exit 1
fi
if [ -z "$TASK_ID" ]; then
printf 'Submit response did not include task_id:
%s
' "$SUBMIT_RESPONSE" >&2
exit 1
fi
START_TIME=$(date +%s)
POLL_DELAY=2
while true; do
if [ $(( $(date +%s) - START_TIME )) -ge 600 ]; then
printf 'Timed out after 600 seconds
' >&2
exit 1
fi
STATUS_RESPONSE=$(curl --silent --show-error --fail-with-body \
--url "https://api.vidgo.ai/api/generate/status/$TASK_ID" \
--header "Authorization: Bearer $VIDGO_API_KEY")
STATUS=$(printf '%s' "$STATUS_RESPONSE" | jq -r '.data.status // .status // empty')
BUSINESS_CODE=$(printf '%s' "$STATUS_RESPONSE" | jq -r '.code // empty')
if [ "$BUSINESS_CODE" != "0" ] && [ "$BUSINESS_CODE" != "200" ]; then
printf 'Status request failed:
%s
' "$STATUS_RESPONSE" >&2
exit 1
fi
case "$STATUS" in
finished)
printf '%s' "$STATUS_RESPONSE" | jq -r '(.data.files // .files // [])[]?.file_url'
break
;;
failed)
printf '%s' "$STATUS_RESPONSE" | jq -r '.data.error_message // .error_message // "Generation failed"' >&2
exit 1
;;
not_started|running)
sleep "$POLL_DELAY"
if [ "$POLL_DELAY" -lt 10 ]; then POLL_DELAY=$((POLL_DELAY + 1)); fi
;;
*)
printf 'Unexpected task status: %s
' "$STATUS" >&2
exit 1
;;
esac
done请求参数(input 对象)
生成参数放在 input 中,model 和可选 callback_url 放在请求根级。使用标准 JSON 类型;不支持的 input 字段会被拒绝。
| 字段 | 类型 | 必填 | 默认值 | 描述 |
|---|---|---|---|---|
| prompt | string | 是 | - | 必填字符串,去除首尾空白后为 1–1,000 个字符,不能为空。 |
| image_urls | array | 是 | - | 必填数组,至少包含一个公开可访问的 HTTP(S) 图片地址。地址不能包含用户名、密码或空白字符。 |
| end_image_url | string | 否 | - | 可选的公开 HTTP(S) 尾帧图片地址,不能包含用户名、密码或空白字符。不使用尾帧时请省略此字段,不接受空字符串或 null;提供时 sound 必须为 false。 |
| duration | integer | 是 | - | 必填整数,仅支持 5 或 10 秒;不接受字符串或小数时长。 |
| aspect_ratio | string | 是 | - | 必填:16:9、9:16 或 1:1。图生视频仍须提交此字段,但该字段不控制输出视频的宽高比。 |
| sound | boolean | 是 | - | 必填布尔值。true 为有声,false 为无声。提供 end_image_url 时必须为 false。 |
响应字段(查询状态接口)
GET /api/generate/status/{task_id} 接口返回的详细参数说明:
| 字段 | 类型 | 描述 |
|---|---|---|
| code | integer | 接口响应状态码(200 表示成功)。 |
| data.task_id | string | 全局唯一的生成任务标识符。 |
| data.status | string | 任务执行阶段:not_started(排队)、running(处理中)、finished(已完成)或 failed(失败)。 |
| data.files | array | 生成成功时返回的媒体资产列表,包含 file_url 与 file_type。 |
| data.error_message | string | null | 当任务失败时返回的具体诊断错误信息。 |
任务生命周期
客户端应持续轮询任务状态,直至进入 finished 或 failed 终态:
not_started排队中
running生成中
finished已就绪
failed失败
轮询与异常处理
- 轮询频率建议建议提交任务后前 10 秒每隔 2-3 秒轮询一次,之后可适度放缓至 5 秒一次。
- 网络容错设计遇到临时网络抖动或网关 5xx 错误时不要重新提交任务,应使用原 task_id 继续轮询重试。
- 回调机制(Webhook)在提交任务时传入 callback_url,可在任务完成时自动接收系统推送的最终结果。
接口规格
| 规格项 | 取值 | 说明 |
|---|---|---|
| 模型 | kwaivgi/kling-v2.6-pro/image-to-video | |
| 时长 | 5 / 10 s | 必填整数,仅支持 5 或 10 秒;不接受字符串或小数时长。 |
Kling 2.6 Pro Image to Video 概览
Kling 2.6 Pro Image to Video 是快手科技打造的高阶图像生成视频模型。它能够接收 1 张静态首帧图片或通过尾帧图片精准锁定终态画面,结合文本运动指令生成 5 秒或 10 秒的 1080p 高保真动态视频,并支持原生多模态音频同步合成。
选择 Kling 2.6 Pro Image to Video 的理由
首尾关键帧精准控制支持传入起始首帧与可选结束尾帧,模型根据物理运动学自主规划过渡动作,精准掌控视频始末状态。
出色的视觉特征继承深度锚定源图中的面部五官轮廓、材质纹理与环境透视,在复杂运动过程中不漂移、不畸变。
原生动作音效合成结合图像画面语义与动态轨迹,原生合成伴随动作发生的环境音响与碰撞音效,音随画动。
1080p 影视级清晰度输出 1080p 全高清动态成片,满足专业影视制作、高阶商业广告与精品内容发布标准。
清晰透明的阶梯定价区分 5 秒与 10 秒时长以及有声与无声配置,配合失败全额退还机制,保障开发与创作成本安全。
参数
| 参数 | 要求 | 说明 |
|---|---|---|
| prompt | 是 | 必填字符串,去除首尾空白后为 1–1,000 个字符,不能为空。 默认值 - |
| image_urls | 是 | 必填数组,至少包含一个公开可访问的 HTTP(S) 图片地址。地址不能包含用户名、密码或空白字符。 默认值 - |
| end_image_url | 否 | 可选的公开 HTTP(S) 尾帧图片地址,不能包含用户名、密码或空白字符。不使用尾帧时请省略此字段,不接受空字符串或 null;提供时 sound 必须为 false。 默认值 - |
| duration | 是 | 必填整数,仅支持 5 或 10 秒;不接受字符串或小数时长。 默认值 - |
| aspect_ratio | 是 | 必填:16:9、9:16 或 1:1。图生视频仍须提交此字段,但该字段不控制输出视频的宽高比。 默认值 - |
| sound | 是 | 必填布尔值。true 为有声,false 为无声。提供 end_image_url 时必须为 false。 默认值 - |
使用步骤
上传源参考图像提供至少 1 张公开可访问的 HTTP(S) 图片作为起始首帧;如需精确引导结束构图,可同时上传 1 张结束尾帧图片。
描述动态意图撰写运动提示词,交代主体运动动作、相机运镜方向以及场景环境中的动态演化过程。
设定时长与音频选择 5 秒或 10 秒成片时长;注意使用尾帧时选择无声模式,单首帧模式下可按需开启原生同步音频。
提交生成任务发起 API 调用或在体验区点击运行,系统根据首尾关键帧约束与提示词指导开始物理时空推理。
预览与导出视频轮询任务状态至就绪阶段,获取生成的 1080p MP4 视频链接进行播放与下载。
价格
按每次生成的视频计费,1 积分 = $0.005。
| 计费项 | 费率 | 说明 |
|---|---|---|
| 5 秒 · 无声 | 65 积分/视频 | $0.325/视频 |
| 10 秒 · 无声 | 130 积分/视频 | $0.650/视频 |
| 5 秒 · 有声 | 120 积分/视频 | $0.600/视频 |
| 10 秒 · 有声 | 240 积分/视频 | $1.20/视频 |
推荐应用场景
经典静帧摄影动态活化将人像摄影或风光静帧转化为 1080p 高清动态短片,生动还原发丝微风拂动与光影流动。
电商产品动态展示升级上传服装商品图或精致单品,生成面料自然飘动或光影流转的专业级展示短片。
首尾帧精准过渡运镜传入场景全景图与特写图作为首尾帧,由模型自动插值生成平滑流畅的变焦推拉运镜。
数字艺术插画动态演绎激活概念设定图与原创插画,在保持原有画风与线条精度的同时增添生动的呼吸感与动作演绎。
使用技巧
- 提供尾帧图片时,两张图片的构图比例与主体物理状态尽量保持合理的运动演化空间,避免幅度过大的突兀形变。
- 提示词重点描述“从首帧状态演化至最终画面的动作路径”,例如“人物目光缓缓由远方移向镜头并露出微笑”。
- 使用尾帧进行首尾连贯控制时,配置无声模式生成动作过渡轨迹;移除尾帧后可以随时开启原生音频。
- 输入图像建议使用主体清晰、光影分明的标准比例画面,以便模型充分提取空间深度信息。
注意事项
- 图生视频端点要求 image_urls 为非空的公开 HTTP(S) 图片链接数组。
- 可选尾帧参数 end_image_url 必须搭配 sound=false 使用,未配置尾帧时可自由开启 sound=true。
- 任务执行以异步方式进行,提交成功后立即返回 task_id,建议通过轮询或设置 callback_url 获取结果。
Kling 2.6 Pro Image to Video API 常见问题
Kling 2.6 Pro Image to Video API 是什么?
Kling 2.6 Pro Image to Video 是快手科技研发的高阶图像生成视频模型。它接收 1 张静态首帧图片或通过尾帧图片约束最终画面,生成 5 秒或 10 秒的 1080p 影视级动态视频,并支持原生多模态音频同步合成。基于深度时空注意力与特征锁定机制,它在赋予图像自然运动的同时,高度保留原始图像的主体身份、服装细节与场景构图。你可以通过 API 进行程序化调用,也可以在上方体验区直接在线试用。
Kling 2.6 Pro Image to Video 如何使用尾帧控制结束画面?
在请求体中传入可选的 end_image_url 参数指定结束画面图片,模型将自主规划从首帧到尾帧的过渡运动轨迹。使用尾帧进行首尾连贯控制时,配置无声模式即可完成生成。
Kling 2.6 Pro Image to Video 如何保持人物面部一致性?
模型内置深度特征锁定机制,能够持续提取首帧中的面部特征、发型与服饰纹理作为全局参考锚点,在动态演进与大幅度运镜中保持主体身份高度稳定。
Kling 2.6 Pro Image to Video 支持哪些图片格式?
支持公开可访问的 HTTP(S) 图片链接(如标准 JPEG、PNG 等网络常见格式)。建议上传主体轮廓清晰、画面中心突出的高分辨率源图以获得最佳动态质感。
Kling 2.6 Pro Image to Video 开启声音后能生成什么音频?
在单首帧生成模式下开启声音后,模型会结合画面动作与场景语义,原生合成匹配的环境音效、运动碰撞声与氛围伴音,实现无需二次配音的音画同步体验。
Kling 2.6 Pro Image to Video 的调用费用是多少?
费用根据成片时长与音频开关计算:5 秒无声为 65 积分($0.325),10 秒无声为 130 积分($0.650);5 秒有声为 120 积分($0.600),10 秒有声为 240 积分($1.200)。若任务异常失败,系统全额自动返还扣除积分。
Kling 2.6 Pro Image to Video 支持用提示词控制运镜吗?
支持。通过在提示词中加入“平滑前推(push in)”、“水平慢摇(pan right)”或“围绕主体顺时针环绕(orbit around subject)”等具体镜头语言,可以精准引导摄影机运动轨迹。