KI-News im Überblick: Google enthüllt Nano Banana 2
Google stellt mit Nano Banana 2 (basierend auf Gemini 3.1 Flash Image) eine leistungsstarke KI für Bildgenerierung vor, die Präzision und Effizienz neu definier
Google hat die nächste Evolutionsstufe seiner Bildgenerierungs-KI vorgestellt: Nano Banana 2. Intern als Gemini 3.1 Flash Image bekannt, ist diese leistungsstarke Modellversion ab sofort in Googles Gemini und weiteren generativen Diensten verfügbar und setzt neue Maßstäbe in der visuellen Kreation.
Nano Banana 2: Eine neue Ära der Bildgenerierung
Die Kerninnovation von Nano Banana 2 liegt in ihrer Fähigkeit, auf Basis des Gemini 3.1 Flash Image deutlich präzisere und komplexere visuelle Inhalte zu erstellen. Eine der herausragenden Funktionen ist die Integration einer Echtzeit-Websuche, die es der KI ermöglicht, aktuelle Informationen für die Erstellung von Infografiken und Diagrammen zu nutzen. Dies erweitert die Möglichkeiten für datengestützte Visualisierungen erheblich.
Entwickler und Kreative profitieren von einem erheblich erweiterten Kontrollniveau:
- Komplexere Prompts: Nano Banana 2 folgt anspruchsvollen Texteingaben stringenter, was zu genaueren und gewünschten Ergebnissen führt.
- Konsistenz: Das Modell kann bis zu 5 Charaktere und 14 Objekte stabil in einem einzigen Workflow beibehalten, was für die Erstellung komplexer Szenen entscheidend ist.
- Flexibilität bei der Ausgabe: Anwender können das Seitenverhältnis und die Auflösung beliebig anpassen und unterstützt Bilder in bis zu 4K-Qualität.
Die Modellintegration geht weiter: Nano Banana 2 ist bereits als Standardgenerator im Videoeditor Flow implementiert und steht Entwicklern über eine API zur Verfügung. Die Generierung eines 4K-Bildes über die API soll 0,15 US-Dollar kosten, was das Modell im Vergleich zu bisherigen High-End-Lösungen von Google deutlich günstiger macht.
Quelle: blog.google
Verwandte Artikel
Was ist Gemini-SQL2? Googles Text-to-SQL-Lösung im 2026 Guide
Gemini-SQL2 wandelt Sprache präzise in SQL-Abfragen um. Erfahre alles über Gemini 3.1 Pro Benchmarks und Vorteile für Entwickler im großen Guide für 2026.
Google Gemini Embedding 2: Revolutionäre Multimodalität für Entwickler
Google hat Gemini Embedding 2 veröffentlicht, ein nativ multimodales Embedding-Modell, das Text, Bilder, Videos und Audio verarbeitet.
Google Gemini Embedding 2: Eine Ära der multimodalen Embeddings beginnt
Google stellt Gemini Embedding 2 vor, das erste vollständig multimodale Embedding-Modell, das Text, Bilder, Videos und Audio in einem Raum vereint.