用文字组织一个完整短镜头
通过 text2video 描述主体、场景、动作与光线,把镜头构想转化为视频。创作时可将重点放在一个主要事件,例如人物转身或商品进入画面,再用反向提示词排除不想出现的元素,便于比较不同描述形成的视觉方案。
在选型前明确容量、输入输出与调用方式。
以上时长与控制范围对应本平台调用入口;照片说话是组合创作流程,不代表模型原生生成伴音。
了解 kling-v2-5-turbo 能为你的工作带来什么。
通过 text2video 描述主体、场景、动作与光线,把镜头构想转化为视频。创作时可将重点放在一个主要事件,例如人物转身或商品进入画面,再用反向提示词排除不想出现的元素,便于比较不同描述形成的视觉方案。
图生视频以首帧作为视觉起点,适合已有商品图、角色图或分镜画面的项目。pro 模式还可加入尾帧,让创作同时具有起点和结束目标。首尾帧用于引导生成,并不等于逐帧编辑,中间动作仍需通过提示词清楚表达。
在照片说话流程中,提交人物图片和已准备好的音频即可制作动态口播视频。V2.5 Turbo 负责照片动画化,随后按音频完成对口型;提示词可描述动画阶段的动作与表情,结果同时包含最终成片和中间动画视频链接。
从具体任务出发,找到模型发挥作用的位置。
输入商品首帧图片,描述希望呈现的动作、环境与光线,生成用于商品页或宣传剪辑的短镜头。需要指定结束构图时,可选择 pro 并加入尾帧;先确定横屏、竖屏或方形用途,再组织素材,减少后期裁切造成的构图损失。
将脚本中的单个镜头拆成主体、动作和场景描述,以文字生成不同视觉版本;已有分镜图时则用首帧启动。交付物是可查看和剪辑的视频片段,适合比较镜头方向与画面氛围,而不是把整段多场景叙事集中在一次生成中。
准备清晰单人正脸照片及录制好的台词音频,通过 /kling/talking-photo 生成角色介绍或短口播。音频长度建议不超过所选视频时长,动作提示以表情和轻量动作描述为主;完成后可获取对口型成片及未对口型的动画片段。
结合任务复杂度、输入材料与预期结果选择。
如果目标是从一张图片出发制作短镜头,可按任务选择 std 或 pro;当结束画面也必须参与引导时,应选择 pro。与 kling-v2-1-master 相比,V2.5 Turbo 的 pro 提供首尾帧创作方式,因此更适合已经准备起止分镜的任务,但不意味着中间过程能够被精确逐帧锁定。
选择 V2.5 Turbo 的重点是文字或图片驱动的短视频创作。需要同步生成伴音,可考虑 kling-v2-6 的 pro;需要3至15秒时长或4K模式,可考虑 kling-v3。若任务是多图参考或直接编辑已有视频,应选择 kling-o1 或 kling-v3-omni,而不是给本型号加入这些素材字段。
从一次小规模任务到正式接入。
明确目标、必要输入与输出要求,使用真实业务样例作为起点。
打开试用页,确认此入口支持的参数,再提交小规模任务查看结果。
保留完整模型 ID,使用文档规定的请求格式,并在 Pricing 页确认计费规则。
在正式使用前,了解输出质量与能力范围。
解答使用 kling-v2-5-turbo 时的常见疑问。
在 /kling/videos 或 /kling/talking-photo 请求中明确填写 model=kling-v2-5-turbo,不要依赖默认模型。视频创作同时选择 text2video 或 image2video;图生视频需要首帧,照片说话则需要图片与音频。
V2.5 Turbo 的 std 不支持尾帧,pro 支持首尾帧引导。需要指定结束画面时,选择 image2video 和 pro,同时提交 start_image_url 与 end_image_url;只提交尾帧不成立,也不能用尾帧代替首帧。
普通视频生成不支持 generate_audio。若已有配音,可使用照片说话入口,把人物图片与音频组合成对口型视频;这不是模型自行创作声音。需要同步生成伴音的视频任务,可选择支持该能力的可灵版本。
本型号适合文字、首帧以及 pro 首尾帧创作,不应按 Omni 工作流提交多图或参考视频。需要参考多个主体、借用视频特征或修改已有视频时,应选择 kling-o1 或 kling-v3-omni,按对应素材规则组织任务。
完成结果提供 video_url、video_id、task_id 和状态信息。批量或后台任务可使用 async=true 获取任务ID,再查询结果,也可配置 callback_url 接收完成通知;照片说话结果另外提供中间动画的 source_video_url。
模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。