以画面质量与一致性为选择重点
V2.1 Master 的定位侧重画面质量与一致性,适合把注意力放在主体表现、场景氛围和镜头整体观感上。创作时可用文字明确主体、动作、环境和光线,再围绕同一镜头调整描述,比较不同结果,选取适合剪辑与展示的片段。
在选型前明确容量、输入输出与调用方式。
以上为本平台对应入口的可用规格;照片口播通过动画化与口型同步完成,不属于模型原生伴音。
了解 kling-v2-1-master 能为你的工作带来什么。
V2.1 Master 的定位侧重画面质量与一致性,适合把注意力放在主体表现、场景氛围和镜头整体观感上。创作时可用文字明确主体、动作、环境和光线,再围绕同一镜头调整描述,比较不同结果,选取适合剪辑与展示的片段。
没有现成视觉素材时,可用文生视频探索镜头;已有产品图、人物照或场景图时,可用首帧图生视频从指定画面开始。两种方式分别服务于概念探索和素材动画化,提示词重点描述接下来发生的动作,而不是仅重复图片内容。
会说话的照片功能接收人物照片和录制好的音频,先生成照片动画,再完成口型同步。可用提示词补充表情或动作要求,获得最终口播视频及中间动画视频,适合已有声音素材、希望快速形成短段人物表达的制作流程。
从具体任务出发,找到模型发挥作用的位置。
以产品图片作为首帧,描述想要的动作、环境变化和展示重点,制作适合商品介绍或社交内容的短视频。根据投放位置选择横屏、竖屏或方形画幅,交付可进入剪辑流程的视频素材;本型号不通过尾帧图片指定最终构图。
将脚本拆成独立镜头,为每段写明主体、动作和场景,用文生视频制作视觉草案。5 秒片段可用于简短动作展示,10 秒片段可容纳更完整的过程表达,输出用于讨论构图、节奏和氛围的预演素材,而非一次完成整部影片。
准备清晰的单人正脸照片与短段音频,制作介绍、问候或角色台词视频。音频建议不长于选定的视频时长,提示词可补充希望出现的表情和动作。最终视频用于口播交付,中间动画则可用于检查照片动态表现。
结合任务复杂度、输入材料与预期结果选择。
在 V2 Master 与 V2.1 Master 之间选择时,可将 V2.1 Master 作为更关注质量与一致性的候选,用同一提示词或首帧比较实际结果。两者都不能因 Master 名称而被理解为支持全部高级控制。若希望使用尾帧约束,可考虑支持该能力的 V2.5 Turbo pro。
普通视频创作需要同步伴音时,可考虑 V2.6 pro 或 V3;需要原生 4K 时可考虑 V3 系列的对应模式。若任务是多图参考、参考视频或已有视频编辑,可选择 O1 或 V3 Omni。已有照片与音频的短口播,则可继续使用本型号的会说话的照片功能。
从一次小规模任务到正式接入。
明确目标、必要输入与输出要求,使用真实业务样例作为起点。
打开试用页,确认此入口支持的参数,再提交小规模任务查看结果。
保留完整模型 ID,使用文档规定的请求格式,并在 Pricing 页确认计费规则。
在正式使用前,了解输出质量与能力范围。
解答使用 kling-v2-1-master 时的常见疑问。
V2.1 Master 更适合作为画面质量与一致性取向的候选。建议使用相同提示词或首帧比较两者的实际结果,而不是只看版本名称。两者在这里都按 5 秒或 10 秒短片使用,不能据此推定更多控制能力。
本型号采用首帧图生视频:提交 start_image_url,并用提示词描述后续动作,不支持 end_image_url 尾帧约束。若必须指定结束画面,可选择支持首尾帧的型号,例如 V2.5 Turbo pro,再按相应创作方式准备素材。
普通视频从文字或首帧图片生成动态画面,本型号不原生同步生成伴音。会说话的照片则必须提供照片和已有音频,通过动画化与口型同步生成口播视频;其中音频是输入素材,不是模型自动创作的声音。
调用 POST /kling/videos,显式设置 model 为 kling-v2-1-master,选择 text2video 或 image2video,并提交提示词及 5 或 10 秒时长。图生视频还需首帧图片链接,完成后通过 video_url 获取生成视频。
可设置 async=true,先保存返回的 task_id,再查询任务进度;也可配置 callback_url 接收完成通知。取得结果后按任务 ID 关联视频链接和状态。照片口播同样可采用异步方式,并返回最终视频及中间动画链接。
模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。