Google I/O 2025: Große Neuigkeiten im Bereich KI – Gemini 2.5, Project Astra und ein vollständiger Überblick über alle Neuerungen
Google hat auf seiner Entwicklerkonferenz I/O 2025 eine Reihe bahnbrechender Neuigkeiten im Bereich der künstlichen Intelligenz vorgestellt, die grundlegend verändern, wie wir künftig mit Technologien arbeiten werden. Die diesjährige Keynote konzentrierte sich fast ausschließlich auf KI-Innovationen im gesamten Google-Ökosystem. Werfen wir einen detaillierten Blick auf alle wichtigen Neuerungen, die das Unternehmen angekündigt hat.
KI-Modus in der Google-Suche – Eine neue Ära der Suche
Google hat einen völlig neuen „KI-Modus“ für die Suchmaschine Google Search vorgestellt, der nun allen Nutzern in den USA zur Verfügung steht. Dieser Modus nutzt das modernste Modell Gemini 2.5 und bietet ein intelligenteres und agentischeres Sucherlebnis. Nutzer können im KI-Modus längere und komplexere Anfragen als je zuvor stellen, detaillierte, von künstlicher Intelligenz generierte Übersichten erhalten, nahtlos Folgefragen stellen und umfassendere Recherchefunktionen einschließlich Visualisierungen und Live-multimodaler Antworten nutzen. Laut dem Blog der Google-Suche werden diese erweiterten Funktionen schrittweise in die Standardsuche für alle Nutzer integriert. „Der KI-Modus ist über einen eigenen Tab in Google Search verfügbar und bietet uns einen Raum, in dem wir einige unserer fortschrittlichsten KI-Funktionen für komplexe Suchanfragen implementieren können“, heißt es im offiziellen Google-Blog. Die Suchmaschine bietet in diesem Modus deutlich kontextbezogenere Antworten und kann den Gesprächsverlauf beibehalten, was einen natürlichen Dialog bei der Informationssuche ermöglicht.
Google hat bisher kein genaues Datum bekannt gegeben, wann der KI-Modus in der Tschechischen Republik verfügbar sein wird. Nach den verfügbaren Informationen soll er nach dem erfolgreichen Start in den USA schrittweise in weiteren Ländern eingeführt werden. AI Overviews (KI-Übersichten) sind in der Tschechischen Republik jedoch bereits vollständig verfügbar. Diese Übersichten generieren zusammenfassende Antworten auf komplexere Anfragen direkt in den Google-Suchergebnissen. Die Funktion ist in mehr als 200 Ländern einschließlich Tschechiens aktiv und unterstützt über 40 Sprachen, darunter auch Tschechisch. Bei komplexeren Suchanfragen erhalten Nutzer automatisch oberhalb der klassischen Suchergebnisse eine generierte Übersicht mit Links zu relevanten Websites.
Gemini 2.5 – Eine neue Generation von KI-Modellen
Das Herzstück vieler neuer Produkte und Entwicklertools ist nun das Modell Gemini 2.5 Pro. Google hat die Gemini API für schnelleres Prototyping über Google AI Studio deutlich verbessert, wo Entwickler Webanwendungen direkt aus Text-, Bild- oder Video-Prompts generieren können. Die neuen SDKs unterstützen das Model Context Protocol (MCP), was die Integration mit Open-Source-Tools erleichtert. Gemini 2.5 bietet deutlich verbesserte Fähigkeiten beim Verständnis von Kontext und bei der multimodalen Verarbeitung, wodurch anspruchsvollere Interaktionen zwischen Nutzern und KI möglich werden.
Project Astra – Visueller Assistent für die reale Welt
Project Astra, ein mobiler visueller Assistent, der den Kontext der realen Welt über die Kamera des Geräts versteht, wurde erheblich verbessert. Nach Informationen aus dem offiziellen Blog von Google DeepMind wurden während der Keynote Demonstrationen gezeigt, bei denen Astra mithilfe eines natürlichen Dialogs und gleichzeitiger visueller Analyse der Umgebung in Echtzeit Ratschläge gab, beispielsweise bei der Reparatur eines Fahrrads. Astra wird bereits heute auf den Plattformen Android und iOS eingeführt, und seine visuellen Erkennungsfähigkeiten werden auch dem KI-Modus in Google Search hinzugefügt. Project Astra kann Objekte identifizieren, Text aus Bildern lesen und auf Grundlage des Gesehenen relevante Informationen bereitstellen, wodurch es zu einem leistungsstarken Werkzeug für den täglichen Einsatz wird. „Project Astra stellt einen bedeutenden Schritt in unserer Vision dar, einen visuellen Assistenten zu schaffen, der die Welt um Sie herum tatsächlich versteht“, schreibt Google DeepMind in seinem Blog. Das System kombiniert fortschrittliche Computer Vision mit natürlicher Sprachverarbeitung, um in Echtzeit nützliche und kontextbezogene Informationen bereitzustellen.
Generative Medien: Imagen, Veo und Flow
Google präsentierte außerdem seine modernsten generativen Modelle – Imagen 4 zur Bildgenerierung und Veo 3 zur Videogenerierung. Diese Modelle sind nun deutlich leistungsfähiger bei der Erstellung realistischer und relevanter Inhalte auf Grundlage von Textbeschreibungen. Neu ist auch die Anwendung Flow, die sich an Kreative richtet und eine schnelle Videoproduktion mithilfe der generativen Fähigkeiten des Veo-Modells ermöglicht. Laut einem Artikel von The Verge und dem offiziellen Google-Blog senken diese Tools die Hürden für die Erstellung professionell wirkender Medieninhalte drastisch und eröffnen neue Möglichkeiten für den kreativen Ausdruck. „Flow ermöglicht es Kreativen, Videos allein durch die Beschreibung dessen zu erstellen, was sie sehen möchten, und anschließend Details mithilfe einfacher Textanweisungen zu bearbeiten“, schreibt Google in einem offiziellen Blogbeitrag.
Agent Mode und agentischere KI-Erfahrungen
Google hat den Agent Mode innerhalb von Gemini vorgestellt, der die Ausführung von Aufgaben im Hintergrund ermöglicht, etwa die Suche nach Mietangeboten oder die Planung von Ausflügen auf Grundlage persönlicher Präferenzen. Dieser Modus zeigt, wie Gemini proaktiv handeln kann, anstatt lediglich reaktiv auf Fragen zu antworten. „Der Agent Mode stellt den Übergang vom bloßen Beantworten von Fragen zur aktiven Lösung komplexer Aufgaben dar“, erklärt Google. Das System kann gleichzeitig mit vielen verschiedenen Informationsquellen arbeiten, den Kontext bewahren und mehrstufige Aufgaben ausführen, die andernfalls einen erheblichen manuellen Aufwand erfordern würden.
Project Mariner – Dynamische Suchfilter
Project Mariner von Google DeepMind ist ein neues Tool, das dabei hilft, Suchfilter während Aufgaben wie der Wohnungssuche dynamisch zu präzisieren. Nach Informationen aus dem offiziellen Blog von DeepMind analysiert Project Mariner die Präferenzen der Nutzer, beobachtet deren Feedback und passt die Suchparameter laufend an, damit die Ergebnisse den tatsächlichen Anforderungen besser entsprechen. „Project Mariner stellt einen neuen Ansatz für die Suche nach komplexen Informationen dar, bei dem Nutzerpräferenzen im Voraus nicht immer eindeutig definierbar sind“, erklärt Google DeepMind. Das System lernt aus Interaktionen und verbessert die Ergebnisse kontinuierlich, was zu einem deutlich effizienteren Entscheidungsprozess führt.
Android XR und die Integration intelligenter Brillen
Google hat offiziell Android XR mit Partnern wie Samsung und Xreal vorgestellt. Von Gemini betriebene intelligente Brillen können direkt auf dem Gerät Live-Übersetzungen liefern, Fragen zu dem beantworten, was Sie in Ihrer Umgebung sehen, mithilfe von Karten-Overlays durch Städte navigieren und sogar dabei helfen, Cafés auf Grundlage von Lebensmittelpräferenzen zu finden. Laut einem Artikel von The Verge betont Google, dass „AR-Brillen mit Android XR in der Lage sein werden, fortschrittliche KI-Aufgaben direkt auf dem Gerät zu verarbeiten, wodurch Datenschutz und schnelle Reaktionszeiten gewährleistet werden“. Diese Integration stellt einen bedeutenden Schritt hin zu allgegenwärtiger erweiterter Realität im Alltag dar.
Audio- und multimodale Verbesserungen
Gemini 2.5 Flash Native Audio bietet einen verbesserten Gesprächsfluss für Sprachinteraktionen auf verschiedenen Geräten und in mehreren Sprachen. Diese Funktion ermöglicht natürlichere und flüssigere Interaktionen mit Sprachassistenten und verbessert die Qualität von Gesprächen mit der KI deutlich. „Unsere neuesten Modelle zur Audioverarbeitung in Gemini 2.5 erreichen eine beispiellose Qualität beim Verständnis menschlicher Sprache und bei der Generierung natürlicher Antworten“, erklärt Google. Dies deutet darauf hin, dass zukünftige Sprachinteraktionen mit Technologien deutlich natürlicher und intuitiver sein werden. Tschechisch gehört zu den mehr als 24 Sprachen, die im Rahmen der neuen Funktion zur nativen Audioausgabe unterstützt werden.
Google Shopping mit KI und virtueller Anprobe
Google hat seine Einkaufsplattform Google Shopping mithilfe von KI-Funktionen deutlich verbessert. Laut dem offiziellen Google-Shopping-Blog wurde ein KI-Modus für das Einkaufen vorgestellt, der Kunden dabei hilft, leichter genau das zu finden, wonach sie suchen – selbst wenn sie noch keine klare Vorstellung von einem bestimmten Produkt haben. Eine wichtige Neuerung ist außerdem die Erweiterung der Funktionen zur virtuellen Anprobe, die nun deutlich mehr Produkttypen unterstützt. „Dank unserer fortschrittlichen Computer-Vision- und maschinellen Lernmodelle können Kunden jetzt Kleidung, Brillen, Make-up und weitere Produkte virtuell mit hoher Detailtreue und Realismus anprobieren“, heißt es im Google-Shopping-Blog. Das System integriert außerdem Produktrezensionen und -bewertungen besser, wobei die KI dabei hilft, die relevantesten Informationen aus Nutzerbewertungen zu extrahieren und übersichtlich darzustellen. Nutzer können bei der Kontoeinrichtung, der Verwaltung von Produkt-Feeds oder der Problembehebung die tschechische Lokalisierung verwenden.
Google Beam – Eine neue Art des Teilens von Inhalten
Zu den weiteren Neuheiten gehört auch Google Beam, das eine neue Möglichkeit zum Teilen von Inhalten zwischen Geräten bietet. Laut dem offiziellen Google-Blog ermöglicht diese Technologie das nahtlose Teilen von URLs, Texten, Bildern und weiteren Daten zwischen verschiedenen Geräten, indem man einfach mit dem Telefon darauf zeigt. „Google Beam nutzt eine Kombination aus Ultrabreitband (UWB), Bluetooth und visueller Erkennung, um beim Teilen von Inhalten ein nahezu magisches Erlebnis zu schaffen“, erklärt Google. Diese Technologie ist Teil der umfassenderen Vision von Google für vernetzte Geräte, die auf natürliche und intuitive Weise miteinander kommunizieren.
Die Zukunft von Google liegt in KI-Funktionen
Google I/O 2025 hat deutlich gezeigt, dass die Zukunft von Google eng mit fortschrittlicher generativer künstlicher Intelligenz verbunden ist. Das Unternehmen hat alles neu gestaltet – von der Suche über kreative Arbeitsabläufe bis hin zur Art und Weise, wie wir im Alltag mit Geräten interagieren. Mit dem Modell Gemini 2.5 als Grundlage für viele neue Produkte und Funktionen weist Google klar den Weg zu fortschrittlicher KI als einem zentralen Pfeiler seiner Strategie. Ob agentischere Suche, visuelle Assistenten wie Project Astra oder erweiterte Realität durch Android XR – Google bringt KI in jeden Aspekt des digitalen Lebens. All diese Innovationen signalisieren einen bedeutenden Wandel weg von traditionellen Mensch-Computer-Interaktionen hin zu deutlich natürlicheren, kontextbewussten und proaktiven Systemen, die nicht nur auf unsere Fragen reagieren, sondern uns aktiv dabei unterstützen, unsere Ziele zu erreichen.



