Kling-ÖkosystemEntdecke natives Audio, Videos mit mehreren Einstellungen und BewegungssteuerungModelle entdecken

Kling O3 — Kling 3.0 Omni Videomodell

Erstelle mit Kling O3 KI-Videos mit multimodalen Referenzen. Kombiniere natives Audio, konsistente Figuren und mehrere Einstellungen, um Szenen und Geschichten zu gestalten.

Videoarbeitsbereich öffnen
Bilder und Videos veranschaulichen kreative Ausrichtungen.

Kling 3.0 Omni Videomodell

Kling O3 bietet multimodale Referenzen, natives Audio, konsistente Charaktere und Videogenerierung mit mehreren Einstellungen.

Kling 3.0 Omni Text zu Video

Text zu Video verwendet eine nicht leere Szenenbeschreibung. Wiederverwendbare Motive können durch 2–4 Bilder oder ein Charaktervideo definiert werden, mit optionalen Audioreferenzen zum Motiv. Benutzerdefinierte Generierung mit mehreren Einstellungen unterstützt bis zu sechs Einstellungen, jeweils mit eigener Beschreibung und Dauer; natives Audio kann aktiviert oder deaktiviert werden. Die Ausgabe unterstützt 3–15 Sekunden und 720p, 1080p oder 4K.

Arbeitsbereich öffnen

Kling 3.0 Omni Bild zu Video

Bild zu Video beginnt mit einem ersten Bild oder einem ersten und letzten Bild zusammen mit einer Szenenbeschreibung. Es unterstützt Motivreferenzen, Audio und bis zu sechs benutzerdefinierte Einstellungen, jeweils mit Beschreibung und Dauer. Die Ausgabe unterstützt 3–15 Sekunden und 720p, 1080p oder 4K; außerhalb des benutzerdefinierten Modus mit mehreren Einstellungen folgt das Seitenverhältnis dem Bild.

Arbeitsbereich öffnen

Kling 3.0 Omni Referenz zu Video

Referenzgenerierung kombiniert eine Szenenbeschreibung mit unterstützten Bild- und Motivreferenzen und kann ein Referenzvideo enthalten. Ohne Videoeingabe unterstützt sie benutzerdefinierte Einstellungen und natives Audio. Bei einem Referenzvideo muss generiertes Audio deaktiviert sein; reine Videoeingabe verwendet das Quellseitenverhältnis, während Video mit Bildern feste Seitenverhältnisse unterstützt. Kombinationen aus Referenzbildern und Motiven haben je nach Eingabemodus unterschiedliche Grenzen.

Arbeitsbereich öffnen

Kling 3.0 Omni Transformation

Videotransformation verwendet ein Quellvideo und eine nicht leere Szenenbeschreibung mit unterstützten Bild- und Motivreferenzen. Motivreferenzen können mehrere Bilder, Charaktervideos und Audio verwenden. Reine Videoeingabe verwendet das Quellseitenverhältnis; Video mit Bildern unterstützt 16:9, 9:16 oder 1:1. Dieser Arbeitsablauf hat eine eigene Audioeinstellung und unterstützt Ausgabe in 720p, 1080p und 4K.

Arbeitsbereich öffnen

Kernfunktionen von Kling O3

Kling 3.0 Omni Videomodell

Integrierte multimodale Eingaben mit Kling 3.0 Omni

Kling 3.0 Omni versteht Text, Bilder, Videos und wiederverwendbare Elemente als Generierungseingaben. Unterschiedliche Referenzinformationen lassen sich in einem flexiblen Kling AI-Videoarbeitsablauf kombinieren, um Charaktere, Objekte, Szenen, Bewegung und visuelle Details zu steuern.

Konsistente Charaktere und Elemente mit Kling O3

Kling O3 nutzt Referenzen, um Charaktere, Produkte, Objekte und Szenen über Einstellungswechsel und Blickwinkel hinweg zu bewahren. Das Referenzverständnis unterstützt die Erhaltung wichtiger visueller Details in komplexen Szenen mit mehreren Charakteren.

Native Audiogenerierung mit Kling V3 Omni

Kling V3 Omni generiert synchronisierte audiovisuelle Videos. Natives Audio kombiniert Dialoge und Szenengeräusche im selben Generierungsarbeitsablauf, ohne Bild- und Tonaufgaben zu trennen. Bei Referenzgenerierung mit einem Eingabevideo muss generiertes Audio deaktiviert sein.

Storyboard mit mehreren Einstellungen in Kling 3.0 AI

Kling 3.0 AI verwandelt strukturierte Prompts in Videos mit mehreren Einstellungen, wobei Einstellungsdauer, Bildausschnitt, Kamerawinkel, Charakteraktionen, Dialoge und Kamerabewegungen die Erzählsteuerung und Szenenübergänge unterstützen. Benutzerdefinierte Einstellungen werden bei Text-, Bild- und Referenzgenerierung ohne Eingabevideo unterstützt; Videotransformation verwendet separate Einstellungen.

Kling O3: Videogenerierung bis zu 15 Sekunden

Kling O3 unterstützt Videos bis zu 15 Sekunden bei Text-, Bild- und Referenzgenerierung ohne Eingabevideo. Sequenzen mit mehreren Einstellungen, konsistente Elemente, natives Audio und flexible Dauer helfen, längere Erzählungen zu bilden; Arbeitsabläufe mit Videoeingabe haben eigene Dauerregeln.

Referenzen aus mehreren Bildern in Kling 3.0 Omni

Bilder aus mehreren Perspektiven definieren Charaktere, Produkte, Objekte und Szenen und helfen, Details und Konsistenz zu bewahren. Kurze Videos können Charaktermerkmale für neue Szenen, Aktionen und Kamerawinkel bereitstellen. Stimmmerkmale können an wiederverwendbare Charakterelemente für Dialoge und Geschichten gebunden werden. Charaktere, Objekte, Bilder und Videos lassen sich innerhalb der unterstützten Referenzgrenzen jedes Arbeitsablaufs kombinieren.

Kling 3.0 Omni in Videoprodukte umsetzen

1

Videos mit konsistenten Charakteren erstellen

Kling 3.0 Omni unterstützt charaktergetriebene Videos, die das Aussehen eines Charakters über Szenen und Einstellungswechsel hinweg bewahren. Wiederverwendbare Charakterelemente unterstützen Geschichten, virtuelle Avatare und Markenmarketinginhalte.

2

Produkt- und Werbevideos mit Kling V3 Omni

Kling V3 Omni unterstützt Produktdemonstrationen, Werbung, Marketingkampagnen und Social-Media-Inhalte. Produktbilder, Szenenreferenzen, Bewegungsprompts und natives Audio in unterstützten Arbeitsabläufen verwandeln kreative Medien in Marketingvideos.

3

Geschichten in mehreren Einstellungen mit Kling Video 3.0 Omni

Kling Video 3.0 Omni unterstützt erzählerisches Video, das mehrere Einstellungen in einer Sequenz generiert. Bildausschnitt, Einstellungsdauer, Dialoge, Kamerabewegung und Charakteraktionen ermöglichen strukturierte Geschichten.

4

Sprachgesteuerte Charakterszenen mit Kling 3.0 AI

Kling 3.0 AI unterstützt Dialogszenen, virtuelle Avatare und virtuelle Charaktere. Charakterreferenzen, Stimmreferenzen und natives Audio in unterstützten Generierungsarbeitsabläufen liefern wiederverwendbare Charaktere mit konsistenten visuellen und stimmlichen Merkmalen.

Fragen und Antworten

Wie unterscheiden sich O3 Text, Image, Reference und Transformation?

Text beginnt mit einem Prompt; Image mit einem ersten Bild oder einem Start-Endbild-Paar. Reference kombiniert unterstützte Motiv-, Bild- oder Videoreferenzen. Transformation beginnt mit einem vorhandenen Video, das du ändern möchtest. Jeder Arbeitsablauf hat eigene Mediensteuerungen.

Welche Start- und Endbilder akzeptiert O3?

Der Image-Arbeitsablauf akzeptiert ein erstes Bild oder genau zwei Bilder in der Reihenfolge erstes, dann letztes Bild. Verwende JPG, JPEG oder PNG bis zu 50 MB pro Bild mit beiden Abmessungen von mindestens 300 px und einem Seitenverhältnis zwischen 0.4 und 2.5.

Kann ich in O3 mehrere Einstellungen anordnen?

Der benutzerdefinierte Modus mit mehreren Einstellungen akzeptiert bis zu sechs Einstellungsbeschreibungen. Individuelle und intelligente Aufnahmeplanung können nicht gleichzeitig aktiviert sein. Wähle eine Gesamtdauer von 3–15 Sekunden und prüfe die Zeitplanung der Einstellungen vor dem Absenden.

Wie viele Referenzbilder kann ich hinzufügen?

Ohne Referenzvideo teilen sich Bildreferenzen und Motive aus mehreren Bildern eine gemeinsame Grenze von bis zu sieben, die bei gemischten Motivtypen reduziert wird. Mit einem Referenzvideo teilen sich bis zu vier Bildreferenzen die zulässigen Motivplätze. Beachte den Zähler für die aktuelle Kombination.

Welche Videos kann ich als O3-Referenzen verwenden?

Verwende einen MP4- oder MOV-Clip von 3–15.5 Sekunden und höchstens 200 MB. Jede Abmessung muss 700–4,553 px betragen, bei höchstens 8,294,400 Pixeln insgesamt, einem Seitenverhältnis von 0.4–2 und einer Bildrate von 24–60 fps. Eine vorhandene Kreation muss dieselben Grenzen erfüllen.

Warum kann Audio nach dem Hinzufügen einer Videoreferenz nicht verfügbar sein?

Im Reference-Arbeitsablauf muss die Audiogenerierung bei Bereitstellung eines Videos deaktiviert sein. Text und Image können Audiogenerierung anbieten. Transformation hat eine eigene Audioeinstellung; prüfe daher den tatsächlichen Arbeitsablauf, statt anzunehmen, dass alle O3-Eingaben gleich funktionieren.

Welche Auflösungen und Seitenverhältnisse sind verfügbar?

O3 bietet 720p, 1080p und 4K. Text unterstützt 16:9, 9:16 und 1:1. Bild- und Videoarbeitsabläufe können je nach Eingabekombination und Einstellungsmodus automatische Proportionen oder explizite Seitenverhältnisse verwenden. Prüfe die Einstellungen erneut, wenn sich Referenzen ändern.

Mit Kling O3 kreativ werden

Erstelle mit Kling O3 KI-Videos mit multimodalen Referenzen. Kombiniere natives Audio, konsistente Figuren und mehrere Einstellungen, um Szenen und Geschichten zu gestalten.

Videoarbeitsbereich öffnen
Alle Kling-Modelle entdecken