A continuous five-second vertical cinematic shot of one small unbranded red alpine cable-car cabin suspended from a taut overhead cable. The camera follows slowly alongside the cabin as it emerges from a thin bank of white cloud; distant rugged snow peaks gradually appear behind it. The cabin maintains its rigid shape, hangs upright and advances steadily along the cable, with subtle realistic sway. Cold blue shadows and warm early sun. Spacious mountain atmosphere, coherent depth and restrained camera movement, no cuts, no lettering or logos.
Kling 1.6 Standard Text to Video API
kwaivgi/kling-video/v1.6/standard/text-to-videoKling 1.6 Standard Text to Video 将文本提示词转化为连贯自然的 720p 动态视频,支持 5 秒与 10 秒时长、精准物理动力学模拟以及灵活的运镜调度。它能够严格遵循提示词中的分镜描述呈现逼真的光影质感与人物动态,同时在不同景别转换中稳定保持空间环境与构图一致性。
示例
REST API 规格
快速开始
提交端点请求并查询任务状态。请将示例素材 URL 替换为可访问的真实文件。
第一步:配置 API 鉴权
在控制台申请 API Key,并在每个 HTTP 请求头中携带 Authorization: Bearer <API_KEY> 进行身份验证。
- 任务提交端点
- POST
https://api.vidgo.ai/api/generate/submit - 鉴权请求头
- Authorization: Bearer VIDGO_API_KEY
第 2 步:提交生成任务
POST /api/generate/submit。model 和可选 callback_url 位于根级,生成参数位于 input 内。
REQUEST_BODY=$(cat <<'JSON'
{
"model": "kwaivgi/kling-video/v1.6/standard/text-to-video",
"input": {
"prompt": "A quiet forest in morning light, with a slow camera pan.",
"duration": 5
}
}
JSON
)
RESPONSE=$(curl --silent --show-error --fail-with-body \
--request POST \
--url "https://api.vidgo.ai/api/generate/submit" \
--header "Authorization: Bearer $VIDGO_API_KEY" \
--header "Content-Type: application/json" \
--data "$REQUEST_BODY")
CODE=$(printf '%s' "$RESPONSE" | jq -r '.code // empty')
if [ "$CODE" != "0" ] && [ "$CODE" != "200" ]; then
printf 'API error: %s
' "$RESPONSE" >&2
exit 1
fi
printf '%s
' "$RESPONSE"第三步:轮询任务执行结果
使用 task_id 查询进度;not_started 或 running 时继续轮询,finished 或 failed 时停止。成功后读取 data.files[].file_url,失败时读取 data.error_message。
状态查询端点
GET https://api.vidgo.ai/api/generate/status/{task_id}使用 task_id 查询进度;not_started 或 running 时继续轮询,finished 或 failed 时停止。成功后读取 data.files[].file_url,失败时读取 data.error_message。
not_startedrunningfinishedfailed{
"code": 200,
"data": {
"task_id": "task-example",
"status": "not_started",
"created_time": "2026-09-23T08:00:00"
}
}{
"code": 200,
"data": {
"task_id": "task-unified-...",
"status": "finished",
"files": [
{
"file_url": "https://storage.vidgo.ai/generated/video.mp4",
"file_type": "video"
}
],
"created_time": "2026-08-22T10:00:00Z",
"progress": 100,
"error_message": null
}
}端到端完整脚本示例
展开查看在生产环境中具备轮询重试、异常保护和超时处理的完整自动化脚本。
set -euo pipefail
: "${VIDGO_API_KEY:?Set VIDGO_API_KEY in your environment}"
REQUEST_BODY=$(cat <<'JSON'
{
"model": "kwaivgi/kling-video/v1.6/standard/text-to-video",
"input": {
"prompt": "A quiet forest in morning light, with a slow camera pan.",
"duration": 5
}
}
JSON
)
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
--request POST \
--url "https://api.vidgo.ai/api/generate/submit" \
--header "Authorization: Bearer $VIDGO_API_KEY" \
--header "Content-Type: application/json" \
--data "$REQUEST_BODY")
TASK_ID=$(printf '%s' "$SUBMIT_RESPONSE" | jq -r '.data.task_id // .task_id // empty')
BUSINESS_CODE=$(printf '%s' "$SUBMIT_RESPONSE" | jq -r '.code // empty')
if [ "$BUSINESS_CODE" != "0" ] && [ "$BUSINESS_CODE" != "200" ]; then
printf 'Submit failed:
%s
' "$SUBMIT_RESPONSE" >&2
exit 1
fi
if [ -z "$TASK_ID" ]; then
printf 'Submit response did not include task_id:
%s
' "$SUBMIT_RESPONSE" >&2
exit 1
fi
START_TIME=$(date +%s)
POLL_DELAY=2
while true; do
if [ $(( $(date +%s) - START_TIME )) -ge 600 ]; then
printf 'Timed out after 600 seconds
' >&2
exit 1
fi
STATUS_RESPONSE=$(curl --silent --show-error --fail-with-body \
--url "https://api.vidgo.ai/api/generate/status/$TASK_ID" \
--header "Authorization: Bearer $VIDGO_API_KEY")
STATUS=$(printf '%s' "$STATUS_RESPONSE" | jq -r '.data.status // .status // empty')
BUSINESS_CODE=$(printf '%s' "$STATUS_RESPONSE" | jq -r '.code // empty')
if [ "$BUSINESS_CODE" != "0" ] && [ "$BUSINESS_CODE" != "200" ]; then
printf 'Status request failed:
%s
' "$STATUS_RESPONSE" >&2
exit 1
fi
case "$STATUS" in
finished)
printf '%s' "$STATUS_RESPONSE" | jq -r '(.data.files // .files // [])[]?.file_url'
break
;;
failed)
printf '%s' "$STATUS_RESPONSE" | jq -r '.data.error_message // .error_message // "Generation failed"' >&2
exit 1
;;
not_started|running)
sleep "$POLL_DELAY"
if [ "$POLL_DELAY" -lt 10 ]; then POLL_DELAY=$((POLL_DELAY + 1)); fi
;;
*)
printf 'Unexpected task status: %s
' "$STATUS" >&2
exit 1
;;
esac
done请求参数(input 对象)
向 /api/generate/submit 提交 POST 请求时,input 内部所支持的生成参数配置:
| 字段 | 类型 | 必填 | 默认值 | 描述 |
|---|---|---|---|---|
| prompt | string | 必填 | — | 必填非空字符串,去除首尾空白后最多 2,500 个 Unicode 字符。 |
| duration | integer | 必填 | — | 必填数值 5 或 10 秒;不接受字符串、布尔值或小数时长。API 无默认值,体验表单初始选择 5 秒。 |
| aspect_ratio | string | 可选 | — | 可选 1:1、16:9、9:16,无默认值。 |
| negative_prompt | string | 可选 | — | 可选字符串,最多 2,500 个 Unicode 字符。 |
| cfg_scale | number | 可选 | — | 可选有限数值 0–1,无默认值;Elements 工作流不支持。 |
响应字段(查询结果)
通过 GET /api/generate/status/{task_id} 轮询获取的任务详情:
| 字段 | 类型 | 描述 |
|---|---|---|
| code | integer | 业务响应状态码,200 表示成功。 |
| data.task_id | string | 异步任务全局唯一流水号。 |
| data.status | string | 任务执行阶段:not_started(排队中)、running(生成中)、finished(已完成)、failed(失败)。 |
| data.files | array | 生成成功时包含的成片文件列表,每项含 file_url 与 file_type。 |
| data.error_message | string | null | 任务执行异常时的具体错误描述。 |
任务生命周期
客户端应根据 status 字段判断任务进度,达到 finished 或 failed 终态时立即终止轮询:
not_started任务已接收,等待执行。
running正在生成。
finished生成完成,从 data.files 获取视频 URL。
failed生成失败,请查看 data.error_message,已扣积分按现有流程返还。
轮询与异常处理
- 轮询频次推荐建议初始轮询间隔设为 2–3 秒,随着任务持续可递增至 5 秒一次,避免过密请求。
- 网络波动与重试若查询网络出现 5xx 或连接超时,不代表任务失败,可稍作休眠后继续重试查询。
- 异步 Webhook 回调支持在提交请求体根层级传递 callback_url,在任务终态时系统将通过 POST 自动推送完整任务结果。
接口规格
| 规格项 | 取值 | 说明 |
|---|---|---|
| 模型 ID | kwaivgi/kling-video/v1.6/standard/text-to-video | 请求根级 model 字段。 |
| 时长 | 5 / 10s | 必填数值 5 或 10 秒;不接受字符串、布尔值或小数时长。API 无默认值,体验表单初始选择 5 秒。 |
Kling 1.6 Standard Text to Video
Kling 1.6 Standard Text to Video 由快手(Kwaivgi)研发,专为高性价比的文本生成视频创意工作流打造。用户可通过输入最多 2,500 字符的提示词,细致指导场景氛围、主体动作与镜头运镜轨迹。模型在 720p 分辨率下生成物理拟真度极高且画面流畅的 5 秒或 10 秒短视频,兼具极高的生成效率与实惠的每秒 9 积分计费机制,支持灵活的宽高比选择与负向提示词优化。
为什么选择此模式?
纯文本驱动自然动态无需任何参考素材,仅通过文字描述即可快速构想角色姿态、宏观场景与丰富的情节发展。
精准物理动力学表现深入模拟重力加速度、布料与毛发摆动以及流体运动,确保肢体与环境的物理交互自然流畅。
多构图比例灵活适配原生支持 16:9 横屏、9:16 竖屏与 1:1 方形画幅,无缝对接社交媒体短视频与专业影视分镜。
灵活的提示词与引导调节支持长达 2,500 字符的文字输入,并可结合 negative_prompt 与 0–1 范围的 cfg_scale 精确平衡创意与契合度。
透明实惠的按秒计费单秒仅需 9 积分($0.045/秒),5 秒仅需 45 积分,10 秒 90 积分,生成异常自动全额返还点数。
参数说明
| 参数 | 要求 | 说明 |
|---|---|---|
| prompt | 必填 | 必填非空字符串,去除首尾空白后最多 2,500 个 Unicode 字符。 |
| duration | 必填 | 必填数值 5 或 10 秒;不接受字符串、布尔值或小数时长。API 无默认值,体验表单初始选择 5 秒。 |
| aspect_ratio | 可选 | 可选 1:1、16:9、9:16,无默认值。 |
| negative_prompt | 可选 | 可选字符串,最多 2,500 个 Unicode 字符。 |
| cfg_scale | 可选 | 可选有限数值 0–1,无默认值;Elements 工作流不支持。 |
使用方法
构思主体与场景在提示词开头明确人物外貌、主体动作以及环境光影,构建清晰的时空背景。
设定摄影机运镜使用推镜头、拉远、平移或航拍等镜头词汇,为视频增加戏剧性与空间透视感。
选择时长与画幅根据叙事需求选取 5 秒或 10 秒时长,并设置 16:9 宽屏、9:16 竖屏或 1:1 正方形比例。
微调负向词与引导度按需填入 negative_prompt 排除噪点畸变,并调节 cfg_scale 参数控制画面对文字的严格依从度。
提交任务并查询结果点击运行或通过 REST API 发起异步生成,获取 task_id 并在任务完成后下载 MP4 视频。
价格
9 credits / 秒 · $0.045 / 秒。1 credit = $0.005。Fal 对比价 $0.056 / 秒,节省 20%。
| 计费项 | 费率 | 说明 |
|---|---|---|
| 5 秒 | 45 credits · $0.225 | 9 credits × 5 秒 |
| 10 秒 | 90 credits · $0.450 | 9 credits × 10 秒 |
适用场景
社交媒体短视频制作批量产出具有高视觉冲击力的生活、旅行与概念短片,极大提升内容分发与运营效率。
影视剧作概念动态预演在前期筹备中将剧本文字具象化为动态分镜镜头,低成本验证运镜节奏与戏剧张力。
商业营销创意脚本样片快速将广告策划案转化为包含光影氛围的视觉短片,加速团队沟通与提案评审。
游戏与动画美术场景构建基于奇幻、科幻或写实世界观文字描述,迅速生成宏大的场景漫游与角色动态概念演示。
创作技巧
- 善用动词与分镜连接词:使用“走向镜头然后转身”等具有清晰时序性的动词短语,让长镜头动作更连贯。
- 充分发挥 2,500 字符容量:详细描述光影方向、材质反光与环境微动态(如“落叶随风飘散”),显著提升质感。
- 合理设置 cfg_scale 参数:想要更强的创意发散可设为 0.3–0.5;追求严谨遵循剧本文本时建议设为 0.7–1.0。
- 利用 negative_prompt 过滤杂质:填入“画面模糊、肢体变形、过度曝光、低分辨率”等负向词,净化视觉细节。
- 按叙事节奏选择成片时长:快速特写或单一镜头推荐 5 秒(45 积分);复合多阶段情节推荐 10 秒(90 积分)。
注意事项
- 纯文本接口契约:本端点专用于纯文本生成视频,仅接收 prompt 及文本控制参数,不支持传递任何图片字段。
- 固定 720p 分辨率输出:Standard 系列输出规格为清晰的 720p,如需原生 1080p 超高清画质请选用 Pro 端点。
- 异步执行与计费保障:接口采用异步 task_id 追踪任务进度;积分在提交验证时扣除,若上游生成失败将自动退款。
Kling 1.6 Standard Text to Video API 常见问题
Kling 1.6 Standard Text to Video API 是什么?
Kling 1.6 Standard Text to Video 是快手(Kwaivgi)研发的文本生成视频模型。它根据纯文本提示词直接生成 720p 分辨率的连续动态视频,支持 5 秒与 10 秒单次输出、多种画幅构图与写实物理动力学模拟。基于先进的多模态生成架构,它在严格遵循文本时序动作与镜头运镜的同时,稳定保持主体细节与空间光影的连贯性。你可以通过 API 进行程序化调用,也可以在上方体验区直接在线试用。
Kling 1.6 Standard Text to Video 支持生成 10 秒视频吗?
支持。模型提供 5 秒与 10 秒两种整秒时长选项。选择 10 秒时长能够在单次生成任务中容纳更丰富的情节推进与镜头过渡,消耗 90 积分。
Kling 1.6 Standard Text to Video 支持哪些画面宽高比?
该端点支持 16:9 横屏、9:16 竖屏以及 1:1 正方形三种主流比例。你可以通过 aspect_ratio 参数自由指定,以适配不同的社交媒体与视频播放终端。
Kling 1.6 Standard Text to Video 的 cfg_scale 参数有什么作用?
cfg_scale 用于控制生成视频对文本提示词的遵循严格度,取值范围为 0 到 1 的有限数值。数值较高时画面与提示词贴合更紧密,数值较低时模型则拥有更广阔的自由发散创作空间。
Kling 1.6 Standard Text to Video 如何计费?
该端点按秒计费,费率为 9 积分/秒(1 积分 = $0.005,相当于 $0.045/秒)。5 秒视频单次消耗 45 积分($0.225),10 秒视频消耗 90 积分($0.450),若任务执行失败扣除的积分将全额自动返还。
Kling 1.6 Standard Text to Video 支持多少字符的提示词?
有效提示词长度最多支持 2,500 个 Unicode 字符(在去除首尾空白后)。你可以充分利用该文本容量详尽刻画环境氛围、角色外貌特征与镜头运动轨迹。
什么时候该选择 Kling 1.6 Standard 而不是 Pro 模式?
Standard 模式在 720p 分辨率下提供更具成本效益的生成体验,单秒仅需 9 积分,非常适合日常内容创作、概念探索与高频试错;若项目对原生 1080p 超高清细节与复杂动作表现力有极高要求,建议选择 Pro 模式。