Klingエコシステムネイティブ音声、マルチショット動画、動きの制御を探索モデルを見る

Kling O3 — Kling 3.0 Omni動画モデル

Kling O3 を使って、マルチモーダル参照に基づく AI 動画を作成しましょう。ネイティブ音声、キャラクターの一貫性、マルチショット生成を組み合わせて、シーンや物語を描けます。

動画ワークスペースを開く
画像と動画で、制作の方向性を紹介しています。

Kling 3.0 Omni動画モデル

Kling O3は、マルチモーダル参照、ネイティブ音声、キャラクターの一貫性、マルチショット動画生成を提供します。

Kling 3.0 Omni テキストから動画

テキストから動画生成では、空ではないシーン説明を使用します。再利用できる被写体は、2〜4枚の画像またはキャラクター動画1本で定義でき、任意で被写体の音声参照を追加できます。カスタムのマルチショット生成は最大6ショットに対応し、各ショットに個別の説明と長さを指定できます。ネイティブ音声は有効・無効を切り替えられます。出力は3〜15秒、720p・1080p・4Kに対応します。

ワークスペースを開く

Kling 3.0 Omni 画像から動画

画像から動画生成は、開始フレーム画像1枚、または開始フレームと終了フレームに、シーン説明を添えて始めます。被写体参照、音声、最大6つのカスタムショットに対応し、各ショットに説明と長さを指定できます。出力は3〜15秒、720p・1080p・4Kに対応します。カスタムのマルチショットモード以外では、アスペクト比は画像に従います。

ワークスペースを開く

Kling 3.0 Omni 参照素材から動画

参照生成では、シーン説明と対応する画像・被写体の参照素材を組み合わせ、参照動画も含められます。動画入力がない場合は、カスタムショットとネイティブ音声に対応します。参照動画がある場合は、生成音声をオフにする必要があります。動画のみの入力は元のアスペクト比を使用し、動画と画像の組み合わせは固定比率に対応します。参照画像と被写体の組み合わせには、入力モードごとに異なる制限があります。

ワークスペースを開く

Kling 3.0 Omni 動画変換

動画変換では、元の動画と空ではないシーン説明を使用し、対応する画像・被写体の参照素材を追加できます。被写体参照には、複数の画像、キャラクター動画、音声を使用できます。動画のみの入力は元のアスペクト比を使用し、動画と画像の組み合わせは16:9、9:16、1:1に対応します。このワークフローには独自の音声設定があり、720p・1080p・4K出力に対応します。

ワークスペースを開く

Kling O3の主要機能

Kling 3.0 Omni動画モデル

Kling 3.0 Omniによる統合マルチモーダル入力

Kling 3.0 Omniは、テキスト、画像、動画、再利用できる要素を生成入力として理解します。異なる参照情報を、柔軟なひとつのKling AI動画ワークフローで組み合わせ、キャラクター、物体、シーン、動き、映像の細部を導けます。

Kling O3によるキャラクターと要素の一貫性

Kling O3は参照素材を使い、ショットの切り替えや視点の変化を通じて、キャラクター、商品、物体、シーンを保持しやすくします。参照素材の理解により、複数キャラクターが登場する複雑なシーンでも、主要な映像の細部を維持できます。

Kling V3 Omniによるネイティブ音声生成

Kling V3 Omniは、映像と音声が同期した動画を生成します。ネイティブ音声は、映像と音声のタスクを分けずに、同じ生成ワークフローで対話とシーン音を組み合わせます。入力動画を使う参照生成では、生成音声をオフにする必要があります。

Kling 3.0 AIのマルチショット絵コンテ制作

Kling 3.0 AIは、構成されたプロンプトをマルチショット動画に変換します。ショットの長さ、フレーミング、カメラアングル、キャラクターの動作、対話、カメラの動きが、物語の制御とシーンの移行を支えます。カスタムショットは、入力動画を使わないテキスト・画像・参照生成に対応し、動画変換では別の操作を使用します。

Kling O3:最大15秒の動画生成

Kling O3は、入力動画を使わないテキスト・画像・参照生成で、最大15秒の動画に対応します。マルチショットシーケンス、一貫した要素、ネイティブ音声、柔軟な長さが、より長い物語の構成を支えます。動画入力を使うワークフローには、独自の長さのルールがあります。

Kling 3.0 Omniの複数画像参照

複数の視点からの画像が、キャラクター、商品、物体、シーンを定義し、細部と一貫性の維持を助けます。短い動画は、新しいシーン、アクション、カメラアングル向けにキャラクターの特徴を提供できます。再利用できるキャラクター要素には、対話や物語制作のための声の特徴を付けられます。各ワークフローが対応する参照上限の範囲内で、キャラクター、物体、画像、動画を組み合わせられます。

Kling 3.0 Omniを動画作品に活用

1

キャラクターに一貫性のある動画を制作

Kling 3.0 Omniは、シーンやショットの切り替えを通じてキャラクターの外見を保つ、キャラクター中心の動画に対応します。再利用できるキャラクター要素は、物語、バーチャルアバター、ブランドのマーケティングコンテンツに活用できます。

2

Kling V3 Omniによる商品・広告動画

Kling V3 Omniは、商品デモ、広告、マーケティングキャンペーン、SNSコンテンツに対応します。対応ワークフローでは、商品画像、シーンの参照素材、動きのプロンプト、ネイティブ音声で、制作素材をマーケティング動画に変換できます。

3

Kling Video 3.0 Omniによるマルチショットの物語制作

Kling Video 3.0 Omniは、ひとつのシーケンスで複数のショットを生成する物語動画に対応します。フレーミング、ショットの長さ、対話、カメラの動き、キャラクターの動作で、構成された物語を作れます。

4

Kling 3.0 AIによる声を中心としたキャラクターシーン

Kling 3.0 AIは、対話シーン、バーチャルアバター、バーチャルキャラクターに対応します。対応する生成ワークフローのキャラクター参照、声の参照素材、ネイティブ音声が、映像と声の特徴に一貫性のある、再利用可能なキャラクターを提供します。

質問と回答

O3のText、Image、Reference、Transformationはどう違いますか?

Textはプロンプトから始まり、Imageは開始フレーム1枚または開始・終了フレームの組み合わせから始まります。Referenceは、対応する被写体、画像、動画の参照素材を組み合わせます。Transformationは、変更したい既存の動画から始まります。それぞれに独立したメディア操作があります。

O3はどの開始・終了フレーム画像を受け付けますか?

Imageワークフローは、開始フレーム1枚、または開始・終了の順に並べた正確に2枚の画像を受け付けます。1枚あたり最大50 MBのJPG、JPEG、PNGを使用し、縦横とも300 px以上、アスペクト比0.4〜2.5にしてください。

O3で複数ショットを構成できますか?

カスタムのマルチショットモードは、最大6つのショット説明を受け付けます。カスタム構成とインテリジェントなショット構成を同時に有効にはできません。全体の長さを3〜15秒から選び、送信前に各ショットの時間を確認してください。

参照画像はいくつ追加できますか?

参照動画がない場合、画像参照と複数画像の被写体には合計最大7つの上限があり、異なる被写体タイプを混ぜると上限が減ります。参照動画がある場合、最大4つの画像参照が、許可された被写体枠を共有します。現在の組み合わせのカウンターに従ってください。

O3の参照素材にはどの動画を使えますか?

3〜15.5秒、最大200 MBのMP4またはMOVクリップを1本使用してください。縦横それぞれ700〜4,553 px、総画素数は最大8,294,400、アスペクト比0.4〜2、フレームレート24〜60 fpsが必要です。既存の作品も、同じ制限を満たす必要があります。

参照動画を追加すると音声を利用できなくなるのはなぜですか?

Referenceワークフローでは、動画を入力すると音声生成をオフにする必要があります。TextとImageは音声生成を提供できます。Transformationには独自の音声設定があるため、すべてのO3入力が同じように動作すると考えず、実際のワークフローを確認してください。

利用可能な解像度とアスペクト比は?

O3は720p、1080p、4Kを提供します。Textは16:9、9:16、1:1に対応します。Imageと動画ワークフローは、入力の組み合わせとショットモードに応じて、自動の比率または明示的な比率を使用する場合があります。参照素材を変更したときは、操作項目を再確認してください。

Kling O3で制作を始める

Kling O3 を使って、マルチモーダル参照に基づく AI 動画を作成しましょう。ネイティブ音声、キャラクターの一貫性、マルチショット生成を組み合わせて、シーンや物語を描けます。

動画ワークスペースを開く
すべてのKlingモデルを見る