Google führt einen nächtlichen Überraschungsangriff gegen OpenAI durch und besiegt dessen Pro-Angebot zu einem Spottpreis.
Gerade hat Google spät in der Nacht Nano Banana 2.1 vorgestellt!
Ein kleines Modell auf Flash-Niveau hat sogar das hauseigene Flaggschiff Nano Banana Pro übertroffen.
Die wichtigsten Punkte im Überblick:
Bildbearbeitung: Unterstützt die lokale Bearbeitung per Maske, Sie markieren den Bereich, der geändert werden soll, alle anderen Teile bleiben unverändert.
Konsistenz: Personen und Produkte bleiben auch nach mehreren Bearbeitungsrunden unverändert, es können bis zu 14 Referenzbilder eingefügt werden.
Bildqualität: Die Aufnahmen sehen aus wie echte Fotos, die maximale Ausgabeauflösung beträgt 4K.
Preis: Der Preis für die Bildgenerierung beträgt die Hälfte des Preises von Nano Banana 2, ein Bild in 1K kostet 0,034 US-Dollar.
Rangliste: Bei Arena belegt es den 4. Platz in der Kategorie Mehrbildbearbeitung, vor ihm liegen nur noch die drei GPT Image-Modelle von OpenAI.
Verfügbarkeit: Gemini App, der KI-Suchmodus, AI Studio, Flow und weitere Plattformen sind ab heute nach und nach nutzbar.
Flash schlägt Pro, setzt Nano Banana auf ein gutes Preis-Leistungs-Verhältnis?
Zuerst einmal: Nano Banana 2.1 gehört zur Gemini 3-Modellreihe, basiert auf Gemini 3.6 Flash und hat einen Wissensstand bis März 2026.
Nach der bisherigen Namensgebung könnte Nano Banana 2.1 auch als Gemini 3.6 Flash Image bezeichnet werden.
Laut offiziellen Benchmarks liegt Nano Banana 2.1 in Bereichen wie visuelles Design, Bearbeitung und Konsistenz weit vorne.
Obwohl es bei der Darstellung kleines Textes, 3D-Schlussfolgerungen und Faktengenauigkeit noch Verbesserungspotenzial gibt, ist es für Nutzer, die Dienste zur Bildgenerierung und -bearbeitung benötigen, zweifellos ein hervorragendes Update:
Erstellen und Bearbeiten von Bildern mit professioneller Präzision und Kontrolle, unterstützt schnelle Iterationen in mehreren Durchgängen.
Generieren von klarem Text für Poster und komplexe Diagramme.
Weltwissen mit langem Kontext.
Lokalisierte Textdarstellung in mehreren Sprachen.
Die blinde Abstimmung der Nutzer bestätigt dies ebenfalls.
Auf der Arena-Plattform erreicht Nano Banana 2.1 den 4. Platz bei der Mehrbildbearbeitung, den 5. Platz bei Text-zu-Bild und den 6. Platz bei der Einzelbildbearbeitung.
Besonders in der Rangliste für Mehrbildbearbeitung stehen vor ihm nur noch die drei GPT Image-Modelle von OpenAI.
Im Vergleich dazu belegte das Vorgängermodell Nano Banana 2 in diesen drei Ranglisten nur die Plätze 7, 11 und 14.
Zum Anzeigen nach links oder rechts wischen
Da der Preis für die Bildgenerierung nur die Hälfte von Nano Banana 2 beträgt, scheint Google einen Preiskrieg zu starten.
Markieren, was geändert werden soll – das Gesicht bleibt unverändert
Maskenbearbeitung ist allen bekannt, die Photoshop nutzen: Sie markieren einen Bereich, nur dieser wird geändert, alle anderen Teile bleiben wie zuvor.
In der KI-Bildgenerierung war dies bisher sehr schwierig umzusetzen.
Wenn Sie dem Modell sagen „Ersetze die Tasse unten links durch eine rote“, muss es zuerst erraten, welche Tasse Sie meinen, und dann das gesamte Bild neu generieren. Ob die anderen Teile erhalten bleiben, hängt vom Zufall ab.
Jetzt reicht es, den Bereich zu markieren. Beim Wechseln von Kleidung, Austauschen von Schildern oder Entfernen von Passanten im Hintergrund wird nur der markierte Bereich verändert.
Der Nutzer ibexdream hat drei aufeinanderfolgende Aufgaben gestellt: Bildgenerierung, Bildbearbeitung und Stilwechsel.
Erste Aufgabe: Zeichnen Sie eine Banknote. Auf dem Bild ist ein alter Philosoph abgebildet, der nachdenklich sein Kinn stützt – seine Haare bilden ein ganzes Labyrinth.
Zweite Aufgabe: Bearbeiten Sie genau dieses Bild. Die Nummer wird von „№ 1098471“ in „NB-21098471“ geändert, die kleinen Texte an den Seiten werden ausgetauscht, der Philosoph hält eine Banane als Telefon in der Hand und unten wird ein Spruchband mit der Aufschrift „IN BANANA WE TRUST“ hinzugefügt.
Wenn man die beiden Bilder vergleicht, sind das Labyrinth, die Robe und der Bart vollständig unverändert geblieben.
Dritte Aufgabe: Wechseln Sie den Stil, die gesamte Banknote wird zu einem Ölgemälde.
In der Bewertung des Modellblatts erreicht Version 2.1 bei der Maskenbearbeitung 1049 Punkte, 84 Punkte mehr als Nano Banana 2 und 122 Punkte mehr als die Pro-Version.
Sogar ohne aktivierten Denkmodell übertrifft 2.1 die Pro-Version in allen Kategorien.
Ein weiteres Upgrade ist die Konsistenz der Hauptmotive, im Klartext: Das Gesicht darf nicht verändert werden.
Wer E-Commerce-Bilder erstellt, Markenposter gestaltet oder Comics zeichnet, weiß das genau: Wenn dasselbe Modell zehn verschiedene Kleidungen anzieht, sieht das Gesicht ab der dritten Kleidung nicht mehr richtig aus.
Diese Kategorie hat den größten Punkteanstieg verzeichnet: Die Konsistenz mehrerer Personen erreicht 1106 Punkte, 128 Punkte mehr als bei Nano Banana 2.
Entwickler können bis zu 10 Referenzbilder für Objekte und 4 Referenzbilder für Personen einfügen, damit das Modell diese exakt nachzeichnet.
Der Nutzer BG-VC hat das ausprobiert: Er hat ein Foto eines Modells sowie 5 Referenzbilder für Oberteil, Rock, Tasche, Schuhe und Ohrringe übergeben, um 6 Fotos in verschiedenen Szenen zu erstellen – alle 6 Bilder wurden auf einmal generiert.
Ob stehend, sitzend oder an der Kante eines Tisches gelehnt – bei allen 6 Posen bleiben Gesicht, Kleidung, Tasche und Ohrringe unverändert, die Bilder können direkt als E-Commerce-Fotos verwendet werden.
Die Bilder sehen auch aus wie echte Aufnahmen: Auf den offiziellen Beispielbildern ist ein Käfer mit Wassertropfen und ein Mädchen in einem grünen Kleid auf der Treppe vor einem rosa Haus zu sehen – auf den ersten Blick kann man nicht unterscheiden, ob sie von KI gezeichnet wurden.
Darüber hinaus kann es bei der Erstellung von Infografiken zuerst mit der Google Websuche und Bildersuche Informationen abrufen, bevor es mit der Zeichnung beginnt.
In der automatischen Bewertung von Google erreicht Version 2.1 einen Faktengenauigkeitswert von 0,521 bei Infografiken, während Nano Banana 2 nur 0,179 und die Pro-Version nur 0,265 erreicht.
Mit anderen Worten: Wenn Sie es ein wissenschaftliches Diagramm zeichnen lassen, gibt es deutlich weniger inhaltliche Fehler.
Bildgenerierung wird günstiger, Denkfunktionen werden teurer
Die Bildgenerierung kostet 30 US-Dollar pro Million Token, genau die Hälfte des Preises von Nano Banana 2.
Der Preis für ein 1K-Bild sinkt von 0,067 US-Dollar auf 0,034 US-Dollar, der Preis für ein 4K-Bild von 0,151 US-Dollar auf 0,076 US-Dollar.
Dieser Preis ist identisch mit dem von Nano Banana 2 Lite, das im Juli zu einem sehr niedrigen Preis auf den Markt kam.
Allerdings sind die Preise für andere Funktionen gestiegen.
Der Preis für die Eingabe ist von 0,5 US-Dollar auf 1,5 US-Dollar pro Million Token gestiegen, also dreimal so hoch wie zuvor. Der Preis für die Ausgabe von Text und Denkinhalten ist ebenfalls von 3 US-Dollar auf 7,