Google DeepMind

Gemini Omni

Googles multimodales Erstellungsmodell — wo Geminis Denkfähigkeit auf kreative Gestaltung trifft. Erstelle und bearbeite Videos aus Text, Bildern, Video oder Audio mit natürlicher Sprache. Jede Bearbeitung baut auf der vorherigen auf. Kostenlos testen mit Nano Banana Pro.

About

Über Gemini Omni

Gemini Omni ist das multimodale Erstellungsmodell von Google DeepMind, vorgestellt auf der Google I/O 2025. Es vereint Geminis Denkfähigkeit mit generativen Mediensystemen und ermöglicht Videogenerierung und -bearbeitung, die über einfache Prompt-zu-Video-Ausgabe hinausgeht. Das Modell versteht Szenen, Handlungen, Umgebungen, physikalisches Verhalten und realen Kontext — und liefert Ergebnisse, die gezielt wirken statt zufällig. Gemini Omni Flash ist das erste Modell der Omni-Familie, entwickelt für praktische Workflows zur Videoerstellung und -bearbeitung, bei denen Nutzer Filmmaterial transformieren, Ergebnisse mit Referenzen steuern und Szenen durch natürliche Sprachkonversation verfeinern können.

Über Gemini Omni
Funktionen im Überblick

Kernfunktionen

Multimodaler Input, konversationelle Bearbeitung, Stiltransformation und Weltwissen — alles in einem Modell

Mehrstufige konversationelle Bearbeitung

01

Bearbeite Videos durch natürliche Sprachkonversation — jede Bearbeitung baut auf der vorherigen auf

Gemini Omni führt einen grundlegend anderen Ansatz zur Videobearbeitung ein. Anstatt bei jeder Generierung von vorne zu beginnen, kannst du dein Video durch eine Reihe natürlichsprachlicher Anweisungen verfeinern. Ändere den Hintergrund, passe die Handlung an, ersetze Objekte, verschiebe den Kamerawinkel oder füge visuelle Effekte hinzu — alles bei gleichzeitiger Stabilität des restlichen Videos. Dieser konversationelle Workflow bedeutet, dass du Schritt für Schritt auf deine Vision hinarbeiten kannst, ähnlich wie beim Bearbeiten eines Dokuments mit nachverfolgten Änderungen.

Prompt

Bearbeite in mehreren Schritten: Zuerst die Szene aufbauen, dann den Kamerawinkel ändern, dann atmosphärische Effekte hinzufügen — durchgehend Konsistenz bewahren

Mehrstufige Bearbeitung bewahrt die Szenenkohärenz über sequenzielle Änderungen hinweg

Zuerst eine Person in einem Raum etablieren, dann die Beleuchtung auf goldene Stunde ändern, dann Regen am Fenster hinzufügen — jede Bearbeitung baut auf der letzten auf

Sequenzielle Umgebungsänderungen demonstrieren konversationelle Verfeinerung

Output (Example)
2

Echtzeit-Stiltransformation

02

Transformiere Video-Ästhetik in Metall, Skizze, Puppe, Hologramm, Voxel und mehr

Gemini Omni kann den visuellen Stil jedes Eingabevideos transformieren und dabei die zugrundeliegende Bewegung, Struktur und Szenenkomposition bewahren. Beschreibe die gewünschte Ästhetik — metallische Oberflächen, handgezeichnete Skizzen, Filzpuppen, holografische Projektionen, Voxel-Kunst — und das Modell wendet die Transformation kohärent auf jeden Frame an. Die ursprüngliche Kamerabewegung, Charakterhandlungen und räumlichen Beziehungen bleiben intakt, was einen nahtlosen Stiltransfer erzeugt, der weit über einfache Filter hinausgeht.

Prompt

Wenn die Person den Spiegel berührt, soll der Spiegel wunderschön wie Flüssigkeit wellen, und der Arm der Person verwandelt sich in reflektierendes Spiegelmaterial

Stiltransformation bewahrt die Bewegung bei vollständiger Änderung der visuellen Ästhetik

Wenn die Person den Spiegel berührt, verwandelt sich die gesamte Umgebung in 3D-Voxel-Kunst mit blockigen geometrischen Formen

Vollständige Umgebungstransformation in Voxel-Kunst bei Bewahrung der räumlichen Struktur

Output (Example)
2

Echter multimodaler Input

03

Akzeptiert Text, Bilder, Video und Audio als kreative Referenzen in einer einzigen Generierung

Im Gegensatz zu Modellen, die nur Text oder ein einzelnes Bild akzeptieren, kann Gemini Omni mehrere Eingabetypen gleichzeitig verarbeiten. Gib Text für die Richtung, Bilder als visuelle Referenz, Video für Bewegungsführung und Audio für Sprach- oder Klangsynchronisation an. Das Modell synthetisiert alle Eingaben zu einer einzigen zusammenhängenden Videoausgabe. Das macht es praktisch für reale kreative Workflows, bei denen Inspiration aus mehreren Quellen kommt — eine Storyboard-Skizze, ein Referenzclip, eine Sprachaufnahme und eine schriftliche Beschreibung können alle zum Endergebnis beitragen.

Prompt

Füge Harfenklänge hinzu, die synchron erklingen, wenn ich jedes Farnblatt berühre. Verwandle die Blattstruktur in biolumineszente Pflanzen mit umherfliegenden Glühwürmchen

Kombination von Videoeingabe mit Textanweisungen und Audioreferenz für synchronisierte Ausgabe

Visualisiere den Proteinfaltungsprozess mit realem wissenschaftlichem Wissen, gerendert im Knetanimationsstil mit genauem molekularem Verhalten

Reales Wissen angewandt auf wissenschaftliche Visualisierung mit kreativem Stil

Output (Example)
2
FAQ

Häufig gestellte Fragen

Gemini Omni FAQ

Was Creator über Gemini Omni sagen

Was Creator über Gemini Omni sagen

Alle Geschichten lesen
Florian Berger
Florian BergerDie mehrstufige Bearbeitung auf Nano Banana Pro hat meinen Ansatz zur Videoproduktion verändert. Ich kann eine Szene über mehrere Runden verfeinern, ohne die Kontinuität zu verlieren — das kommt einem KI-Kameramann am nächsten.
Katharina Weiß
Katharina WeißMit Gemini Omnis Stiltransformation verwandeln wir einen einzigen Dreh in Dutzende Variationen — Metall, Skizze, Hologramm — bei Beibehaltung der Originalbewegung. Unser Content-Output hat sich verdreifacht, ohne zusätzliche Drehs.
Maximilian Richter
Maximilian RichterDas Weltwissen hebt Gemini Omni ab. Als ich eine Proteinfaltungs-Visualisierung anforderte, war das molekulare Verhalten wissenschaftlich korrekt — nicht nur visuell beeindruckend, sondern tatsächlich physikalisch richtig.
Leyla Demir
Leyla DemirDas Team kann Stile wiederholen, ohne jedes Asset neu aufzubauen.
Camille Bernard
Camille BernardSehr hilfreich fuer Hintergruende, Kompositionen und erste Produktvisuals.
Diego Santos
Diego SantosWiederkehrende Content Aufgaben werden spuerbar schneller.
Anna Kowalska
Anna KowalskaMit klaren Prompts lassen sich die Ergebnisse gut steuern.
Nora Klein
Nora KleinFuer regelmaessige visuelle Produktion spart es viele manuelle Runden.

Weitere KI-Video-Modelle entdecken

Starte jetzt mit Gemini Omni

Erlebe die Leistungsfähigkeit von Gemini Omni — kostenlos online