从文字构想到图片动画
没有现成画面时,可用提示词描述主体、环境与动作生成镜头;已有产品图、角色图或场景图时,则以首帧固定起点,再说明希望发生的变化。这两种方式适合分别处理概念探索与素材再创作,让短片从明确的视觉目标开始。
在选型前明确容量、输入输出与调用方式。
上述时长、模式与操作范围对应本平台的 kling-v1-6 入口,照片对口型属于组合创作功能,不等同于模型原生伴音。
了解 kling-v1-6 能为你的工作带来什么。
没有现成画面时,可用提示词描述主体、环境与动作生成镜头;已有产品图、角色图或场景图时,则以首帧固定起点,再说明希望发生的变化。这两种方式适合分别处理概念探索与素材再创作,让短片从明确的视觉目标开始。
pro 模式的图生视频可同时指定首帧与尾帧,用于安排人物姿态变化、产品展示前后状态或场景过渡。尾帧需要与首帧配合,不能单独使用。它约束的是镜头起止画面,不是逐帧轨迹,也不能替代专门的运镜控制参数。
视频延展可在 std 与 pro 模式下使用:保留生成结果的 video_id,再提交下一段动作或情节提示词。这样可以先确定短镜头,再续写后续内容,而不必每次从文字重新建立场景。任务完成后通过视频链接取回结果,便于继续剪辑。
从具体任务出发,找到模型发挥作用的位置。
输入一张产品首帧图,描述展示动作、背景氛围与画面变化,生成适合剪辑的短素材。竖版可用于移动端展示,横版可用于演示画面;若已有明确的结束构图,可在 pro 中加入尾帧,再为成片补充字幕、音乐与品牌信息。
把一个分镜写成主体、动作和环境清晰的提示词,先生成单个镜头,再用视频延展尝试后续情节。交付物是可观看、可剪辑的视频片段,适合在正式拍摄或制作前讨论节奏与画面方向,而不是直接替代完整多镜头剪辑工程。
准备清晰的单人正脸照片和录制好的语音,在会说话的照片功能中选择 kling-v1-6,并补充动作或表情要求。一次任务完成照片动画化与音频对口型,返回最终口播视频和中间动画片段,适合短句讲解、角色问候或内容预览。
结合任务复杂度、输入材料与预期结果选择。
如果任务是图片动画、短镜头生成或已有片段续写,V1.6 的操作组合较直接;需要控制结束画面时选择 pro。与 kling-v1 相比,不能把旧版的运镜参数沿用到 V1.6:kling-v1 的运镜有 5 秒条件,而 V1.6 不支持 camera_control,应按实际控制需求选择。
需要画面与声音同时生成时,可考虑支持伴音的 kling-v2-6 pro;需要 3–15 秒灵活时长或 4k 模式时,可考虑 kling-v3。V1.6 更适合已明确采用 5 秒或 10 秒、声音另行制作的短片流程。外部音频对口型与原生伴音是不同任务,不应混用。
从一次小规模任务到正式接入。
明确目标、必要输入与输出要求,使用真实业务样例作为起点。
打开试用页,确认此入口支持的参数,再提交小规模任务查看结果。
保留完整模型 ID,使用文档规定的请求格式,并在 Pricing 页确认计费规则。
在正式使用前,了解输出质量与能力范围。
解答使用 kling-v1-6 时的常见疑问。
在视频生成或会说话的照片请求中显式填写 model=kling-v1-6,不依赖省略后的默认选择。普通视频还需选择 text2video、image2video 或 extend,并按任务提供提示词、首帧图片或已有视频 ID。
视频生成入口支持选择 5 秒或 10 秒,会说话的照片也提供这两个时长。需要继续创作时,可用 extend 提交已有 video_id 和后续提示词;延展是接续已有片段的操作,不等于单次生成任意长度的视频。
kling-v1-6 的 std 不支持尾帧约束。需要明确结束画面时,应改用 pro 的 image2video,并同时提供 start_image_url 与 end_image_url;只传尾帧不能完成这类任务,首帧仍是必要输入。
不是。V1.6 不支持原生伴音,会说话的照片使用你提供的音频:先让照片形成动画,再按音频对口型。需要提交 image_url 与 audio_url,提示词主要用于动画阶段的动作或表情,而不是生成语音内容。
可使用 async=true 获取 task_id,再查询任务状态,或配置 callback_url 接收完成结果。应用应区分任务已提交与视频已完成,完成后读取 video_url;如果后续要延展,还应保存 video_id,不能用 task_id 代替。
模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。