Google präsentiert neue KI-Modelle für schnelle Bild- und Videogenerierung

2026-06-30 · kamil

Google stärkt KI-Portfolio: Schnelle Bilder und dynamische Videos

Der Technologieriese Google hat kürzlich zwei innovative generative Künstliche-Intelligenz-Modelle vorgestellt, die darauf abzielen, die Erstellung von Inhalten zu beschleunigen und zu vereinfachen. Diese Neuentwicklungen markieren einen wichtigen Schritt in der Evolution der kreativen KI-Anwendungen und sind insbesondere für Entwickler und Content-Produzenten interessant.

Nano Banana 2 Lite: Blitzschnelle Bilderstellung

Eines der neuen Modelle ist Nano Banana 2 Lite, das speziell für die schnelle Generierung von Bildern konzipiert wurde. Es ist in der Lage, ein Bild in beeindruckenden vier Sekunden zu erstellen. Mit einem Preis von 0,034 US-Dollar pro generiertem Bild bietet es eine kosteneffiziente Lösung für Anwendungen, die eine hohe Frequenz an visuellen Inhalten benötigen. Generative KI-Modelle sind Algorithmen, die in der Lage sind, neue Daten (in diesem Fall Bilder) zu erzeugen, die den Daten ähneln, mit denen sie trainiert wurden.

Gemini Omni Flash: Video-Erstellung per API

Das zweite vorgestellte Modell ist Gemini Omni Flash. Dieses Modell bringt eine neue Dimension der Kreativität, indem es erstmals die Generierung und Bearbeitung von Videos über Textbefehle (sogenannte „Text Prompts“) mittels einer API ermöglicht. Eine API (Application Programming Interface) ist eine Schnittstelle, die es verschiedenen Softwareprogrammen erlaubt, miteinander zu kommunizieren. Dies bedeutet, dass Entwickler Gemini Omni Flash direkt in ihre eigenen Anwendungen und Dienste integrieren können, um dynamische Videoinhalte auf Basis einfacher Texteingaben zu erstellen oder zu modifizieren.

Die Synergie der Modelle: Vom Bild zum Video

Google betont das Potenzial der Verknüpfung beider Modelle. So könnte Nano Banana 2 Lite zunächst ein schnelles Ausgangsbild generieren, das dann von Gemini Omni Flash in ein animiertes Video umgewandelt wird. Diese Verkettung von KI-Modellen eröffnet neue Möglichkeiten für automatisierte und komplexe Content-Erstellungsprozesse, die von der initialen Idee bis zum fertigen Video reichen können, ohne dass umfangreiche manuelle Eingriffe erforderlich sind. Dies könnte die Arbeitsweise in vielen kreativen und technischen Berufsfeldern grundlegend verändern.


Thema: Gemini. Quelle/Inspiration: The Decoder.

← Zurück zu Aktuelles

Ähnliche Artikel