Kling 3.0 Turbo Pro Text to Video API

kwaivgi/kling-v3-turbo-pro/text-to-video

Kling 3.0 Turbo Pro Text to Video 将文本提示词转化为 3–15 秒旗舰级 1080p 动态视频,支持细腻纹理与物理动力学、原生音画口型同步以及最多 6 镜头分镜脚本。它在多镜头叙事中保持角色外貌与场景连贯,并使对白口型与环境音效自然契合。使用 multi_prompt 并省略顶层 duration 时,也支持镜头合计 1–2 秒。

输入
0/2500
输出
等待运行

生成的视频会显示在这里

填写提示词并添加所需素材,确认设置后点击“运行”。

Kling 3.0 Turbo Pro · 5 秒 × 22/秒 = $0.550 (110 积分)
继续使用

示例

Low drone shot skimming over golden sunset waves crashing against dark coastal rocks, spray catching the warm light, cinematic color grading, epic seascape

A great grey owl in a snowy forest turning its head to look directly at the camera, snowflakes drifting down, soft winter light, wildlife documentary close-up

A green sea turtle gliding over a vibrant coral reef, sun rays piercing through crystal clear blue water, schools of small fish scattering, underwater documentary footage

Kling 3.0 Turbo Pro Text to Video

Kling 3.0 Turbo Pro Text to Video 面向成片交付场景,仅凭自然语言提示词即可输出 3 至 15 秒旗舰级 1080p 动态画面,并随画面同步生成多语言对白口型与环境音效。依托更细腻的纹理表现与物理动力学,配合 multi_prompt 最多 6 镜头分镜脚本,适合品牌广告成片、竖屏社交叙事与需要口型对齐的人物表演短片。使用 multi_prompt 并省略顶层 duration 时,也支持镜头合计 1–2 秒。

为什么选择它?

  • 旗舰级 1080p 成片画质Pro 档固定输出工作室级全高清 1080p,边缘与材质层次更清晰,可直接进入剪辑与成片交付流程。

  • 细腻纹理与物理动力学强化布料、刚体与环境交互的运动表现,让主体动作与光影在镜头推进中保持自然可信。

  • 原生音画与口型同步生成画面的同时合成匹配音频,人物对白口型与发音对齐,适合口播、对话与反应镜头。

  • 最多 6 镜头分镜脚本通过 multi_prompt 在单次请求中编排 1 至 6 个镜头的提示词与时长,由模型按时序组织切镜。

  • 多镜头主体与场景连贯在景别切换与运镜推移中保持人物面容、服饰与场景特征一致,支撑完整短片叙事。

  • 3–15 秒灵活时长与画幅整数秒可控时长默认 5 秒,并提供 16:9、9:16、1:1 三种画幅,覆盖横屏成片与竖屏社媒投放。

参数

参数要求说明
prompt可选

字符串,1–2500 字符。与 multi_prompt 互斥。

duration可选

显式 duration 必须为 3–15 秒;多镜头时须等于镜头总时长。省略时使用镜头总时长(允许 1–15 秒),无多镜头时默认为 5 秒。

默认值镜头总时长 / 5
aspect_ratio可选

字符串。文生视频画幅;体验区预选 16:9。

默认值16:99:161:1
multi_prompt可选

1–6 个镜头;每个镜头必须有非空 prompt,duration 可选,范围 1–15 秒,默认 5 秒。总时长不超过 15 秒。与非空 prompt 互斥。

使用方法

  1. 编写场景提示词在 prompt 中写清主体外观、动作、运镜与希望呈现的声音线索;需要分镜时改用 multi_prompt,并为每个镜头单独描述。

  2. 设置输出时长不使用 multi_prompt 时,duration 为 3–15 秒的整数,默认 5 秒。使用 multi_prompt 时可省略顶层 duration,按镜头总时长(1–15 秒)生成;显式提供时必须为 3–15 秒且等于镜头总和。

  3. 选择画幅比例按投放版式选择 16:9、9:16 或 1:1,体验区默认 16:9。竖屏社交内容建议直接指定 9:16。

  4. 确认 1080p 成片规格Pro 档固定输出 1080p,无需在请求中额外设置分辨率字段,适合成片与高清预览。

  5. 编排多镜头分镜(可选)需要多镜叙事时,启用 multi_prompt 填写 1–6 个镜头,并确保与顶层 prompt 互斥、总时长不超过 15 秒。

  6. 确认费用并运行查看运行按钮显示的当前配置费用(按输出秒数 × 22 credits/秒),完成设置后点击「运行」。

  7. 预览并下载视频任务完成后,在输出面板预览画面与同步音频,再点击「下载视频」保存结果。

价格

按输出视频秒数计费。1 credit = $0.005。Pro 档固定 1080p。

用量费率说明
1080p22 credits/sec ($0.11/sec)默认 5s 为 110 credits($0.55)。官方对比价 $0.1375/sec。

适用场景

  • 品牌广告与产品成片用详尽的产品外观、运镜与节奏描述,直接生成可进入剪辑的 1080p 宣传短片。

  • 多镜头分镜广告脚本通过 multi_prompt 一次编排特写、跟拍与收束镜头,完成完整广告节拍。

  • 竖屏社交与短视频叙事选择 9:16 画幅,结合情节与声音线索,产出带口型同步的高清竖屏内容。

  • 口播与人物表演镜头面向 talking-head 或反应镜头,依托原生音画口型同步呈现自然对白表现。

  • 电商与产品动态展示用文本描述材质反光、手部交互与环境运动,生成细腻可信的产品动态片段。

Pro Tips

  • 多镜头脚本中为同一角色使用一致的外貌与服饰描述,帮助跨镜头保持主体连贯。
  • 每个镜头写清景别、运镜与动作节拍,例如「3 秒鞋底特写落地」再接「低机位侧跟加速」。
  • 需要口型对齐时,在提示词中明确对白语言、情绪与发音节奏,便于音画同步。
  • 竖屏投放请直接选择 9:16;横屏成片或宽银幕叙事优先 16:9。
  • 使用 multi_prompt 配置 1–6 个镜头,每项 prompt 必填,duration 可省略,默认为 5 秒。总时长不超过 15 秒;顶层 duration 可省略,提供时须等于镜头总和且为 3–15 秒。

使用说明

  • Kling 3.0 Turbo Pro Text to Video 以纯文本 prompt 驱动生成,可配置 duration、aspect_ratio;分镜时改用 multi_prompt,二者互斥。
  • Pro 档固定输出 1080p,按输出秒数以 22 credits/秒计费,默认 5 秒为 110 credits($0.55)。
  • 通过 API 提交后请保存返回的 task_id,用于查询任务进度并获取最终文件链接。
  • 生成结果为标准视频文件,可在主流播放器与剪辑软件中直接使用。

Kling 3.0 Turbo Pro Text to Video API 常见问题

Kling 3.0 Turbo Pro Text to Video API 是什么?

Kling 3.0 Turbo Pro Text to Video 是快手(Kling AI)用于纯文本生成视频的旗舰 Turbo Pro 模型。它根据文本提示词通常生成 3–15 秒旗舰级 1080p 视频,具备细腻纹理与物理动力学、原生音画口型同步,并支持 multi_prompt 最多 6 镜头分镜脚本。依托 Kling 3.0 系列的多镜头叙事与视听联合生成能力,它在遵循提示词中的运镜与声景设计的同时,保持角色外貌、场景连贯与对白口型对齐。你可以通过 API 进行程序化调用,也可以在上方体验区直接在线试用。 使用 multi_prompt 并省略顶层 duration 时,也允许镜头合计 1 或 2 秒。

Kling 3.0 Turbo Pro Text to Video 的 1080p 画质适合成片吗?

适合。Pro 档固定输出工作室级全高清 1080p,纹理与边缘层次更细腻,可直接作为成片素材进入剪辑。分辨率由档位决定,无需在请求中另设 resolution 字段;完整规格见本页参数与模型规格说明。

Kling 3.0 Turbo Pro Text to Video 如何使用 multi_prompt 分镜?

multi_prompt 支持 1–6 个镜头,每个镜头必须有非空 prompt;镜头 duration 可选,须为 1–15 秒的整数,默认 5 秒。镜头总时长不能超过 15 秒。省略顶层 duration 时使用镜头时长之和,也允许合计 1 或 2 秒;显式传入时须为 3–15 秒的整数,且等于镜头时长之和。multi_prompt 不能与非空的顶层 prompt 同时使用。分镜请在 JSON 模式编辑;尝试切换表单时会保留 JSON 模式及全部镜头配置。

Kling 3.0 Turbo Pro Text to Video 支持原生口型同步吗?

支持。生成结果随画面同步输出音频,并对多语言对白提供口型对齐,适合口播、对话与反应镜头。在提示词中写明语言、情绪与发音节奏,可进一步指导声轨与口型表现。

Kling 3.0 Turbo Pro Text to Video 该如何选择画幅?

可选 16:9、9:16 与 1:1,体验区默认 16:9。横屏广告与成片优先 16:9,TikTok / Reels / Shorts 等竖屏渠道直接选 9:16,方形封面或社交帖可用 1:1。完整取值见本页参数说明。

Kling 3.0 Turbo Pro Text to Video 与 Base 模型该如何选型?

需要旗舰级 1080p 成片、更细腻纹理与口型同步短片时,优先本 Pro 文生视频档位;若以快速打样、高吞吐和更低单秒成本为主,可改用同系列 Standard 720p 文生视频。完整 Kling 3.0 Base 更侧重更高保真与电影级最终镜头,可在本页相关模型中对照系列能力。

Kling 3.0 Turbo Pro Text to Video 如何按秒计费?

按输出视频秒数计费,费率为 22 credits/秒($0.11/秒,1 credit = $0.005)。默认 5 秒为 110 credits($0.55),时长越长费用越高;完整对照见本页价格说明。