Google veröffentlicht offiziell stabile Versionen von Gemini 2.5 Pro und Flash
Google hat offiziell bekannt gegeben, dass seine Modelle Gemini 2.5 Pro und Flash nun allgemein als stabile Versionen verfügbar und für den Produktionseinsatz vorgesehen sind. Diese Modellfamilie wurde als hybrides Reasoning-System konzipiert, das eine hervorragende Leistung bei einem optimalen Verhältnis von Kosten und Geschwindigkeit bietet. Das Modell Gemini 2.5 Pro bleibt gegenüber der Version vom 6. Mai unverändert, während Gemini 2.5 Flash mit der Version vom 20. Mai identisch ist, die auf der Google-I/O-Konferenz vorgestellt wurde. Entwickler wie Spline und Rooms sowie Organisationen wie Snap und SmartBear setzen diese neuesten Versionen bereits seit mehreren Wochen in Produktionsumgebungen ein.
Die stabilen Versionen geben Entwicklern die Sicherheit, zuverlässig Produktionsanwendungen erstellen zu können. Sowohl Gemini 2.5 Pro als auch Flash sind nun nicht nur über Google AI Studio und Vertex AI, sondern auch in der Gemini-App verfügbar. Darüber hinaus hat Google eigene Versionen der Modelle 2.5 Flash-Lite und Flash direkt in seine Suchmaschine integriert, wodurch ihre Verfügbarkeit und Nutzung auf verschiedenen Google-Plattformen erweitert wird.
Vorstellung des neuen Modells Gemini 2.5 Flash-Lite
Der jüngste Neuzugang in der Gemini-2.5-Familie ist das Modell Flash-Lite, das nun als Preview-Version verfügbar ist. Dieses Modell stellt die kosteneffizienteste und schnellste Variante der gesamten Gemini-2.5-Familie dar. Flash-Lite wurde als kosteneffizientes Upgrade der vorherigen Modelle 1.5 und 2.0 Flash entwickelt und bietet bei den meisten Bewertungstests eine bessere Leistung, während zugleich eine geringere Latenz bis zur ersten Antwort und eine höhere Geschwindigkeit bei der Token-Dekodierung erreicht werden.
Das Modell 2.5 Flash-Lite weist in den Bereichen Programmierung, Mathematik, Naturwissenschaften, logisches Denken und multimodale Benchmarks durchweg eine höhere Qualität als 2.0 Flash-Lite auf. Besonders stark ist es bei umfangreichen, latenzsensitiven Aufgaben wie Übersetzung und Klassifizierung, bei denen es über eine breite Auswahl von Prompts hinweg eine geringere Latenz als 2.0 Flash-Lite und 2.0 Flash erreicht. Das Modell verfügt über dieselben Funktionen, die die gesamte Gemini-2.5-Familie nützlich machen, darunter die Möglichkeit, das „Denken“ mit unterschiedlichen Budgets zu aktivieren, die Anbindung an Tools wie Google Search und die Codeausführung, multimodale Eingaben sowie eine Kontextlänge von einer Million Token.

Fortschrittliche „denkende“ Modelle mit dynamischer Steuerung
Alle Gemini-2.5-Modelle werden als „denkende“ Modelle charakterisiert, die ihre Überlegungen vor der Antwort durchdenken können, was zu einer besseren Leistung und höheren Genauigkeit führt. Jedes Modell bietet Kontrolle über das Budget für das „Denken“, sodass Entwickler festlegen können, wann und wie intensiv das Modell vor der Generierung einer Antwort „nachdenken“ soll. Diese Funktion stellt eine bedeutende Innovation im Bereich der künstlichen Intelligenz dar, da sie es ermöglicht, das Verhalten des Modells an die konkreten Anforderungen einer Anwendung anzupassen.
Das Modell Gemini 2.5 Flash-Lite ist auf Kosten und Geschwindigkeit optimiert, weshalb seine Funktion zum „Denken“ im Gegensatz zu den anderen Modellen standardmäßig deaktiviert ist. Dennoch unterstützt es die dynamische Steuerung des Denkbudgets über einen API-Parameter. Flash-Lite unterstützt neben Funktionsaufrufen außerdem alle nativen Google-Tools, einschließlich Grounding mit Google Search, Code Execution und URL Context.

Änderungen an der Preisgestaltung und Preisstruktur
Google hat bedeutende Anpassungen an der Preisgestaltung des Modells Gemini 2.5 Flash vorgenommen. Im vergangenen Jahr haben die Forschungsteams des Unternehmens die Pareto-Grenze bei der Flash-Modellreihe kontinuierlich weiter verschoben. Als das Modell 2.5 Flash ursprünglich angekündigt wurde, hatte Google die Fähigkeiten von 2.5 Flash-Lite noch nicht finalisiert und startete mit einer Preisgestaltung, die zwischen „Denken“ und „Nicht-Denken“ unterschied, was bei Entwicklern zu Unklarheiten führte.
Mit der Veröffentlichung der stabilen Version von Gemini 2.5 Flash hat Google die Preise auf 0,30 US-Dollar pro 1 Million Eingabe-Token (eine Erhöhung gegenüber 0,15 US-Dollar) und 2,50 US-Dollar pro 1 Million Ausgabe-Token (eine Senkung gegenüber 3,50 US-Dollar) aktualisiert. Das Unternehmen hat den Preisunterschied zwischen dem Modus „Denken“ und „Nicht-Denken“ abgeschafft und unabhängig von der Anzahl der Eingabe-Token eine einzige Preisstufe beibehalten. Obwohl Google eine konsistente Preispolitik zwischen Preview- und stabilen Versionen anstrebt, spiegelt diese konkrete Anpassung den außergewöhnlichen Wert des Flash-Modells wider, das weiterhin das beste Preis-Leistungs-Verhältnis in Bezug auf Intelligenz auf dem Markt bietet.
Anhaltendes Wachstum und Beliebtheit von Gemini 2.5 Pro
Das Wachstum und die Nachfrage nach dem Modell Gemini 2.5 Pro weisen weiterhin die steilste Kurve aller Modelle auf, die Google je veröffentlicht hat. Damit mehr Kunden Produktionsanwendungen auf Basis dieses Modells erstellen können, stellt Google die Version vom 5. Juni als stabile Version mit derselben optimalen Preisstruktur wie zuvor bereit. Es wird erwartet, dass das Pro-Modell in Anwendungsfällen herausragt, in denen höchste Intelligenz und maximale Fähigkeiten erforderlich sind, etwa bei Programmier- und agentenbasierten Aufgaben.
Gemini 2.5 Pro bildet das Herzstück vieler der beliebtesten Entwicklertools, darunter Cursor, Bolt, Cline, Cognition, Windsurf, GitHub, Lovable, Replit und Zed Industries. Diese Tools nutzen die fortschrittlichen Fähigkeiten des Pro-Modells, um ihren Nutzern hochwertige Dienste bereitzustellen. Google teilt außerdem mit, dass es in naher Zukunft weitere Informationen zur Skalierung über das Pro-Modell hinaus veröffentlichen wird, was auf weitere Entwicklungen in diesem Bereich hindeutet.
Für Nutzer älterer Preview-Versionen der Modelle hat Google klare Migrationsfristen festgelegt. Nutzern der Version 2.5 Pro Preview 05-06 steht das Modell bis zum 19. Juni 2025 zur Verfügung; anschließend wird es abgeschaltet. Nutzer der Version 2.5 Pro Preview 06-05 können die Modellzeichenfolge einfach auf „gemini-2.5-pro“ aktualisieren. Ebenso gelten für Nutzer von Gemini 2.5 Flash Preview 04-17 die bestehenden Preview-Preise bis zur geplanten Einstellung am 15. Juli 2025, an dem dieser Endpoint abgeschaltet wird.



