Anzeige
Skip to content

Google bringt mit Nano Banana 2 Lite sein bisher schnellstes KI-Bildmodell und Gemini Omni Flash in die API

Image description
Nano Banana Pro prompted by THE DECODER

Kurz & Knapp

  • Google hat zwei neue generative KI-Modelle veröffentlicht, darunter "Nano Banana 2 Lite", das für eine schnelle Bildgenerierung in nur vier Sekunden ausgelegt ist und 0,034 US-Dollar pro Bild in 1K-Auflösung kostet.
  • Das zweite Modell, "Gemini Omni Flash", ermöglicht Entwicklern erstmals die Generierung und konversationelle Bearbeitung von bis zu zehn Sekunden langen Videos per Textbefehl über die API für 0,10 US-Dollar pro Sekunde.
  • Google empfiehlt die Kombination beider Modelle, um mit Nano Banana 2 Lite generierte Bilder direkt durch Gemini Omni Flash in Videos zu animieren. Zudem werden alle erstellten Inhalte mit SynthID-Wasserzeichen versehen, um sie eindeutig als KI-generiert kennzeichnen zu können.

Google veröffentlicht zwei neue generative KI-Modelle. Nano Banana 2 Lite soll Bilder in vier Sekunden erzeugen. Gemini Omni Flash ermöglicht erstmals Videogenerierung und -bearbeitung per Textbefehl über die API.

Nano Banana 2 Lite erzeugt Bilder in vier Sekunden

Das Modell trägt die interne Bezeichnung gemini-3.1-flash-lite-image. Google hat es auf schnelle Ideenfindung und Entwickler-Pipelines mit hohem Durchsatz ausgelegt. Die Text-zu-Bild-Generierung soll vier Sekunden dauern, bei Kosten von 0,034 US-Dollar pro Bild in 1K-Auflösung.

Modell Preis pro Bild Auflösung
Nano Banana 2 Lite 0,034 US-Dollar 1K
Nano Banana 2 0,067 US-Dollar 1K
Nano Banana Pro 0,134 US-Dollar 1K oder 2K

Trotz des Fokus auf Geschwindigkeit soll Nano Banana 2 Lite laut Google zuverlässige Prompt-Befolgung, konsistente Charakterdarstellung und lesbaren Text in generierten Bildern liefern. Neben den Entwicklerplattformen wird das Modell auch in Googles Konsumentenprodukte integriert, darunter AI Mode in der Google-Suche, die Gemini-App, NotebookLM, Google Photos, Stitch, Google Flow und Google Ads.

Nano Banana 2 Lite löst das auf Gemini 2.5 basierende erste Nano-Banana-Modell ab. | Bild: Google

Mit Nano Banana 2 Lite umfasst die Nano-Banana-Familie nun drei produktive Modelle. Nano Banana 2 (Gemini 3.1 Flash Image) positioniert Google als Allrounder mit der besten Balance aus Qualität und Kosten. Nano Banana Pro (Gemini 3 Pro Image) ist für komplexe, professionelle Anwendungsfälle gedacht und bietet laut Google die robusteste Kontrolle und das fortgeschrittenste Reasoning. Entwickler sollen je nach Anwendungsfall zwischen Geschwindigkeit, Qualität und Kosten wählen können.

Anzeige
DEC_D_Incontent-1

Vergleichstabelle der Nano-Banana-Modelle. | Bild: Google

Das ursprüngliche Nano Banana (Gemini 2.5 Flash Image) stuft Google als veraltet ein. Auch wir nutzen weiterhin hauptsächlich Nano Banana Pro, da Bildqualität und Prompt-Verlässlichkeit des Modells Nano Banana 2 und OpenAIs GPT-Image-2 meist überlegen sind.

Gemini Omni Flash bringt Videogenerierung in die API

Gemini Omni Flash war bereits auf der Google I/O vorgestellt worden und wird nun erstmals für Entwickler über die Gemini API und Google AI Studio zugänglich. Das Modell kombiniert Geminis multimodales Reasoning mit Videogenerierung und ‑bearbeitung. Der Preis liegt bei 0,10 US-Dollar pro Sekunde Videoausgabe und entspricht damit dem Preis von Veo 3.1 Fast.

Laut Google liegen die Stärken des Modells in der konversationellen Videobearbeitung per natürlicher Sprache, der Kombination verschiedener Eingabeformate wie Text, Bild und Video sowie der Nutzung von Geminis Weltwissen für die Videogenerierung. Text und Grafiken sollen sich direkt mit Videoaktionen synchronisieren lassen.

Gemini Omni Flash generiert derzeit nur Videos mit einer Länge von zehn Sekunden. Auch Audio-Referenzen und Szenenerweiterungen werden in der API noch nicht unterstützt. Video-Referenzen bis drei Sekunden Dauer akzeptiert das API-Schema zwar, laut Google verarbeitet das Modell sie aber bisher nicht korrekt. Auch die Charakterkonsistenz bei Szenenwechseln oder Kamerabewegungen sei noch eingeschränkt.

Anzeige
DEC_D_Incontent-2

Google setzt auf Verkettung beider Modelle

Einen Mehrwert sieht Google in der Kombination beider Modelle. Entwickler sollen mit Nano Banana 2 Lite schnell Bilder generieren und diese als Referenz an Gemini Omni Flash übergeben, um sie in Videos zu animieren. Über die Interactions-API lassen sich dabei Session-Historie und Kontext beibehalten, sodass bis zu drei aufeinanderfolgende Bearbeitungen möglich sind.

Google stellt drei Demo-Apps bereit, die das Zusammenspiel demonstrieren sollen. "Anywhere" versetzt Nutzer per Selfie an Wahrzeichen und animiert das Ergebnis. "Space Lift" generiert Innendesign-Konzepte aus Raumfotos und erstellt daraus ein Video. "Omni Product Studio" wandelt statische Produktbilder in E-Commerce-Videos um.

Beide Modelle nutzen laut Google SynthID-Wasserzeichen, um KI-generierte Inhalte als solche kennzeichnen zu können. Die Verifizierung soll über die Gemini-App, Gemini in Chrome oder die Google-Suche möglich sein.

Beide Modelle sind ab sofort in Google AI Studio, der Gemini API und der Gemini Enterprise Agent Platform verfügbar.

KI-News ohne Hype – von Menschen kuratiert

Mit dem THE‑DECODER‑Abo liest du werbefrei und wirst Teil unserer Community: Diskutiere im Kommentarsystem, erhalte unseren wöchentlichen KI‑Newsletter, 6× im Jahr den "KI Radar"‑Frontier‑Newsletter mit den neuesten Entwicklungen aus der Spitze der KI‑Forschung, bis zu 25 % Rabatt auf KI Pro‑Events und Zugriff auf das komplette Archiv der letzten zehn Jahre.

Quelle: Google Blog