Google führt neue Gemini-Funktionen für die Arbeit mit Videos in Echtzeit ein
Google hat damit begonnen, neue KI-Funktionen in Gemini Live schrittweise einzuführen, die es dem Assistenten ermöglichen, Ihren Bildschirm zu „sehen“ oder den Blick durch die Kamera Ihres Smartphones wahrzunehmen und in Echtzeit auf Fragen zu antworten. Diese Funktionen kommen fast ein Jahr, nachdem Google erstmals „Project Astra“ vorgestellt hat, das die Grundlage für diese neuen Möglichkeiten bildet.
Was ermöglichen die neuen Funktionen?
Bildschirminhalte lesen – Gemini kann sehen und interpretieren, was auf Ihrem Bildschirm angezeigt wird, und auf diesem Inhalt basierende Antworten geben
Live-Video – Ermöglicht Gemini, den Live-Stream von der Kamera Ihres Telefons zu interpretieren und in Echtzeit auf Fragen zu antworten
In einem Beispielvideo von Google nutzt ein Benutzer beispielsweise die Live-Video-Funktion, damit Gemini ihm bei der Auswahl einer Farbe für frisch glasiertes Keramikgeschirr hilft.
Verfügbarkeit
Die neuen Funktionen werden derzeit für Abonnenten von Google One AI Premium mit Zugriff auf Gemini Advanced eingeführt. Einer der Nutzer auf Reddit bestätigte, dass die Funktion bereits auf seinem Xiaomi-Telefon erschienen ist.
Vorsprung vor der Konkurrenz
Dieser Schritt festigt Googles Vorsprung im Bereich der KI-Assistenten weiter – zu einer Zeit, in der Amazon einen begrenzten vorzeitigen Zugang zu seinem Update Alexa Plus vorbereitet und Apple die verbesserte Version von Siri verschoben hat. Samsung bietet zwar weiterhin Bixby an, aber Gemini ist inzwischen der Standardassistent auf seinen Telefonen.
Diese neuen Funktionen stellen einen weiteren Schritt bei der Integration künstlicher Intelligenz in den Alltag dar und zeigen, wie schnell sich die Möglichkeiten von KI-Assistenten in der realen Welt weiterentwickeln.



