All models

kling-v1-6

KuaishouVideo
2.8–9.8 Credits
Get your API key
kling-v1-6

面向短镜头创作的图文生成与视频延展模型

kling-v1-6 是快手可灵 V1 系列的视频生成型号,适合把文字构想或静态图片制作成短镜头,再沿已有片段继续创作。它提供文生视频、图生视频与视频延展,pro 模式还可用首尾帧约束画面起止。需要人物说话时,可结合照片与现成音频完成动画化及对口型。

Kuaishou模型品牌
视频模型类型
视频任务能力

规格与接口特性

在选型前明确容量、输入输出与调用方式。

视频创作方式
文生视频、图生视频、已有视频延展
生成时长
本平台视频入口:5 秒或 10 秒
生成模式
std / pro;不支持 4k 模式
视频画幅
16:9、9:16、1:1
首尾帧控制
图生视频需首帧;pro 可配合尾帧,std 不支持尾帧
音频方式
不支持原生伴音;会说话的照片使用外部音频驱动
任务交付
视频链接、视频 ID、任务 ID 与状态;支持异步及回调

上述时长、模式与操作范围对应本平台的 kling-v1-6 入口,照片对口型属于组合创作功能,不等同于模型原生伴音。

核心能力

了解 kling-v1-6 能为你的工作带来什么。

从文字构想到图片动画

没有现成画面时,可用提示词描述主体、环境与动作生成镜头;已有产品图、角色图或场景图时,则以首帧固定起点,再说明希望发生的变化。这两种方式适合分别处理概念探索与素材再创作,让短片从明确的视觉目标开始。

用首尾帧安排镜头起止

pro 模式的图生视频可同时指定首帧与尾帧,用于安排人物姿态变化、产品展示前后状态或场景过渡。尾帧需要与首帧配合,不能单独使用。它约束的是镜头起止画面,不是逐帧轨迹,也不能替代专门的运镜控制参数。

沿已有片段继续创作

视频延展可在 std 与 pro 模式下使用:保留生成结果的 video_id,再提交下一段动作或情节提示词。这样可以先确定短镜头,再续写后续内容,而不必每次从文字重新建立场景。任务完成后通过视频链接取回结果,便于继续剪辑。

适用场景

从具体任务出发,找到模型发挥作用的位置。

产品静态素材转短片

输入一张产品首帧图,描述展示动作、背景氛围与画面变化,生成适合剪辑的短素材。竖版可用于移动端展示,横版可用于演示画面;若已有明确的结束构图,可在 pro 中加入尾帧,再为成片补充字幕、音乐与品牌信息。

分镜预演与情节续写

把一个分镜写成主体、动作和环境清晰的提示词,先生成单个镜头,再用视频延展尝试后续情节。交付物是可观看、可剪辑的视频片段,适合在正式拍摄或制作前讨论节奏与画面方向,而不是直接替代完整多镜头剪辑工程。

照片口播与角色讲解

准备清晰的单人正脸照片和录制好的语音,在会说话的照片功能中选择 kling-v1-6,并补充动作或表情要求。一次任务完成照片动画化与音频对口型,返回最终口播视频和中间动画片段,适合短句讲解、角色问候或内容预览。

如何选择这个模型

结合任务复杂度、输入材料与预期结果选择。

何时选择 V1.6 与 pro

如果任务是图片动画、短镜头生成或已有片段续写,V1.6 的操作组合较直接;需要控制结束画面时选择 pro。与 kling-v1 相比,不能把旧版的运镜参数沿用到 V1.6:kling-v1 的运镜有 5 秒条件,而 V1.6 不支持 camera_control,应按实际控制需求选择。

何时改用后续型号

需要画面与声音同时生成时,可考虑支持伴音的 kling-v2-6 pro;需要 3–15 秒灵活时长或 4k 模式时,可考虑 kling-v3。V1.6 更适合已明确采用 5 秒或 10 秒、声音另行制作的短片流程。外部音频对口型与原生伴音是不同任务,不应混用。

开始使用

从一次小规模任务到正式接入。

01

准备任务与材料

明确目标、必要输入与输出要求,使用真实业务样例作为起点。

02

在 API 调试区试用

打开试用页,确认此入口支持的参数,再提交小规模任务查看结果。

03

按 API 文档接入

保留完整模型 ID,使用文档规定的请求格式,并在 Pricing 页确认计费规则。

使用边界

在正式使用前,了解输出质量与能力范围。

  • kling-v1-6 不支持 generate_audio、camera_control 或 4k 模式。可在提示词里描述镜头意图,但这不等同于参数化运镜;如果成片必须有声音,需要另行配音配乐,或使用照片加音频的对口型功能。
  • std 图生视频不能指定尾帧;pro 的尾帧也必须与首帧一起提交。首尾帧适合表达起止构图,不保证中间所有动作都按预设路径发生,制作前应把主体变化与动作目标写清楚,再检查生成片段。
  • 会说话的照片建议使用清晰单人正脸,驱动音频需为可访问的链接,支持 mp3、wav、m4a、aac,大小不超过 5MB。音频长度建议不超过所选视频时长,避免把长段口播直接放入短片任务。

常见问题

解答使用 kling-v1-6 时的常见疑问。

调用时怎样确保使用 kling-v1-6?

在视频生成或会说话的照片请求中显式填写 model=kling-v1-6,不依赖省略后的默认选择。普通视频还需选择 text2video、image2video 或 extend,并按任务提供提示词、首帧图片或已有视频 ID。

V1.6 可以生成多长的视频?

视频生成入口支持选择 5 秒或 10 秒,会说话的照片也提供这两个时长。需要继续创作时,可用 extend 提交已有 video_id 和后续提示词;延展是接续已有片段的操作,不等于单次生成任意长度的视频。

为什么 std 模式不能使用尾帧?

kling-v1-6 的 std 不支持尾帧约束。需要明确结束画面时,应改用 pro 的 image2video,并同时提供 start_image_url 与 end_image_url;只传尾帧不能完成这类任务,首帧仍是必要输入。

会说话的照片是否意味着 V1.6 能生成声音?

不是。V1.6 不支持原生伴音,会说话的照片使用你提供的音频:先让照片形成动画,再按音频对口型。需要提交 image_url 与 audio_url,提示词主要用于动画阶段的动作或表情,而不是生成语音内容。

生成任务适合怎样接入应用?

可使用 async=true 获取 task_id,再查询任务状态,或配置 callback_url 接收完成结果。应用应区分任务已提交与视频已完成,完成后读取 video_url;如果后续要延展,还应保存 video_id,不能用 task_id 代替。

模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。

把 kling-v1-6 用到你的下一项任务

从清晰的目标开始,在实际结果中判断它是否适合你的工作。