Kling 生态探索原生音频、多镜头视频与动作控制探索模型

Kling 3.0

可灵 3.0 开启电影级 AI 视频创作。支持文生视频与图生视频,具备多镜头叙事、原生音效及 15 秒灵活时长输出。即刻体验可灵 3.0。

打开视频工作台
图片与视频用于展示创作方向。

Kling 3.0 模型

可灵 3.0 开启电影级 AI 视频创作。支持文生视频与图生视频,具备多镜头叙事、原生音效及 15 秒灵活时长输出。即刻体验可灵 3.0。

可灵 3.0 文生视频

可灵 3.0 文生视频功能支持用户仅凭提示词生成电影级视频。可灵 3.0 文生视频支持叙事控制、多镜头结构及原生音效,是创意视频工作流与故事创作的理想选择。

打开工作台

可灵 3.0 模型首尾帧控制

Kling Video 3.0 模型支持首尾帧控制,用于设定起始与结束画面,引导运动、视觉连贯性、构图及视频走向。首尾帧适用于单镜头生成;多镜头生成仅支持首帧。

打开工作台

Kling AI 3.0 核心功能概览

支持原生音效与多镜头叙事

Kling AI 3.0 支持跨语言原生音频生成

Kling 3.0 支持中、英、日、韩、西等多语种及口音的原生音频生成。在单一 Kling Video 3.0 模型工作流中,可生成语音、复杂的多角色对话,并结合口型同步。模型还支持同视频混合语言,以及粤语、四川话和美式、英式、印度式英语口音。

Kling 3.0 支持生成长达 15 秒的视频

Kling 3.0 突破了以往的时长限制,支持灵活生成 3 至 15 秒的视频。Kling video 3.0 模型能够流畅处理更长的场景,非常适合需要高度连贯性与叙事流畅度的故事创作、广告创意及电影级片段。

Kling Video 3.0 赋能智能多镜头电影级叙事

Kling AI 3.0 深度理解多镜头指令与镜头语言。通过 Kling 3.0,用户可以生成包含动态运镜、镜头切换及结构化叙事的复杂场景,让 Kling video 3.0 模型化身“AI 导演”,助力创意视频制作。

Kling V3 具备强大的角色与场景一致性

借助参考控制技术,Kling 3.0 有助于保持帧间一致性。Kling AI 3.0 可通过参考保留人物、物体和环境特征,支持运镜、场景切换及多镜头生成中的视觉连贯性。

体验 Kling AI 的照片级写实画质与精准文本呈现

Kling 3.0 在呈现电影级写实效果的同时,清晰保留了图像与视频中的文本细节。Kling AI 能精准呈现标牌、Logo、字幕及画面文字,这使得 Kling Video 3.0 模型成为电商推广、品牌建设及专业营销视频制作的理想之选。

Kling 3.0 vs Kling 2.6:Kling 3.0 有哪些新特性

对比项目Kling Video 2.6Kling Video 3.0
文生视频支持支持
图生视频支持支持
首尾帧生成视频支持支持
原生音频生成支持支持
多镜头叙事不支持支持
中文、英语、日语、韩语和西班牙语不支持支持
方言与口音不支持支持
最长输出时长时长有限最长 15 秒
灵活的视频时长控制不支持支持

可灵 3.0 视频生成的应用场景

1

利用可灵 3.0 文生视频打造电影级叙事

Kling 3.0 文生视频可将剧本与构想转为电影场景,生成多镜头叙事、角色故事及视觉一致的场景,无需手动剪辑或复杂制作流程。

2

使用可灵 3.0 制作产品广告与电商视频

Kling V3 可生成具有逼真动作与清晰视觉细节的产品短视频。图生视频可展示产品,保留 Logo 与文字,制作适用于广告和电商平台的营销视频。

3

基于可灵 AI 3.0 生成多语言对话与社媒内容

Kling AI 3.0 可用于带原生音频的社交媒体与短视频内容,支持多语言对白、口音和自然口型同步,为创作者、网红及内容平台制作面向不同语言受众的视频。

4

借助可灵 3.0 模型实现游戏与动画的视觉呈现

Kling Video 3.0 支持游戏、动画与创意项目的视觉呈现,可将概念图或参考图片转为动画场景,帮助团队预览创意、测试风格并进行创意迭代。

常见问题

可以用文字、首帧或首尾两张图片开始吗?

可以。单镜头可从文字、一张首帧,或按顺序添加的首尾两张图片开始;多镜头模式支持首帧,不接受首尾帧组合。

如何在一个视频中安排多个镜头?

开启多镜头后,为每个镜头填写描述和时长。最多五个镜头,单镜头 1–12 秒;各镜头合计需与所选总时长一致,并在 3–15 秒范围内。

有哪些时长和画面比例可选?

时长可选择 3–15 秒的整数。文字场景提供 16:9、9:16 和 1:1;提供首尾帧图片时,画面比例会根据输入图片适配。

标准、Pro 和 4K 输出有什么区别?

16:9 下,标准输出为 1280×720,Pro 为 1920×1080,4K 为 3840×2160。竖屏交换宽高,方形使用等边尺寸;切换画质后请重新查看报价。

生成场景可以带声音吗?

Kling 3.0 提供声音开关。将所需对白、环境声或音效写入场景描述,提交前确认声音设置。它属于视频工作流的声音生成,与 Avatar 上传语音录音不同。

一个任务可以引用多少个主体?

一个任务最多引用三个元素。为各主体设置清晰名称,并在提示词中引用;使用元素引用时需要首帧输入。切换单镜头与多镜头后,请重新核对参考控件。

从 Kling 2.6 切换过来,需要注意什么?

Kling 2.6 提供 5 秒或 10 秒;Kling 3.0 提供 3–15 秒、多镜头安排以及标准、Pro、4K 选择。切换后重新确认声音、首尾帧和积分报价。

开始使用 Kling 3.0 创作

可灵 3.0 开启电影级 AI 视频创作。支持文生视频与图生视频,具备多镜头叙事、原生音效及 15 秒灵活时长输出。即刻体验可灵 3.0。

打开视频工作台
探索全部 Kling 模型