Die schnellste und günstigste Version Gemini 2.5 Flash-Lite ist da

Die schnellste und günstigste Version Gemini 2.5 Flash-Lite ist da

Ondřej Barták
Ondřej Barták
Unternehmer und Programmierer
25. 7. 2025
2 Minuten Lesezeit · 5 Aufrufe
Die schnellste und günstigste Version Gemini 2.5 Flash-Lite ist da

Die schnellste und günstigste Version Gemini 2.5 Flash-Lite ist da

Am 22. Juli 2025 gaben Logan Kilpatrick und Zach Gleicher im Google Developers Blog bekannt, dass das Modell Gemini 2.5 Flash-Lite eine stabile Version erreicht hat und nun allgemein verfügbar ist. Dieses Modell ist das schnellste und günstigste der Gemini-2.5-Familie und wurde speziell für Aufgaben entwickelt, bei denen Latenz (Verzögerung) und Kosten eine wichtige Rolle spielen, etwa Übersetzungen oder Klassifizierungen. Mit einem Preis von nur 0,10 USD pro 1 Million Eingabe-Token und 0,40 USD pro 1 Million Ausgabe-Token ermöglicht es die Verarbeitung großer Mengen von Anfragen ohne hohe Kosten. Zudem wurde der Preis für Audioeingaben gegenüber der Testversion um 40 % gesenkt.

Hauptmerkmale des Modells

Gemini 2.5 Flash-Lite zeichnet sich bei einer breiten Palette von Prompts durch eine geringere Latenz als die Modelle 2.0 Flash-Lite und 2.0 Flash aus. Es bietet ein Kontextfenster von bis zu 1 Million Token und ermöglicht damit die Verarbeitung komplexer Aufgaben. Es unterstützt native Tools wie Grounding with Google Search (Fundierung mit der Google-Suche), Code Execution (Codeausführung) und URL Context (Kontext aus URLs). Das Modell wurde mit Daten bis Januar 2025 trainiert, und für anspruchsvollere Anwendungsfälle kann optional erweitertes Schlussfolgern aktiviert werden. Es ist multimodal und verarbeitet somit Text, Bilder, Dokumente, Videos und Audio, wobei die Eingabe auf 500 MB begrenzt ist.

Vergleich von Gemini 2.5

Praktische Anwendungsbeispiele

Bereits seit der Testversion hat sich das Modell in der Praxis bewährt. Das Unternehmen Satlyt nutzt es für eine dezentrale Plattform für Weltraum-Computing und erzielte damit bei der Diagnose im Orbit eine Verringerung der Latenz um 45 % sowie eine Senkung des Energieverbrauchs um 30 %. HeyGen automatisiert damit die Videoplanung, optimiert Inhalte und übersetzt für eine globale Personalisierung in mehr als 180 Sprachen. DocsHound verarbeitet lange Videos und extrahiert Tausende Screenshots mit geringer Latenz, wodurch die Erstellung von Dokumentationen beschleunigt wird. Evertune analysiert die Darstellung von Marken in KI-Modellen und erstellt dank der hohen Geschwindigkeit des Modells schnell Berichte.

Erste Schritte mit dem Modell

Geben Sie zur Verwendung im Code „gemini-2.5-flash-lite“ an. Wenn Sie den Preview-Alias verwendet haben, wechseln Sie bis zum 25. August 2025 zur stabilen Version, da die Preview-Version dann entfernt wird. Das Modell ist in Google AI Studio und Vertex AI verfügbar. Laut einschlägigen Informationen aus dem Internet, etwa dem technischen Bericht von Google, eignet es sich ideal für Produktionsbereitstellungen mit hohem Durchsatz und niedrigen Kosten, wobei es Geschwindigkeit, Preis und Qualität in Einklang bringt.

Werbung

Inhalte entstehen mit Unterstützung von UpTier.

SEO und GEO auf Autopilot. Die Multiagentensysteme von UpTier schreiben und optimieren Inhalte für Suchmaschinen und KI-Antworten.

UpTier entdecken ↗

Kategorie:KI
Hat Ihnen dieser Artikel gefallen?
Entdecken Sie weitere interessante Beiträge im Blog
Zurück zum Blog

Ähnliche Beiträge

ChatGPT führt virtuelle Anprobe für Kleidung und Accessoires einChatGPT führt virtuelle Anprobe für Kleidung und Accessoires ein
OpenAI startet weltweit zwei Shopping-Funktionen in ChatGPT: Nutzer können Kleidung und Accessoires auf einem eigenen Foto visualisieren und ausgewählte Produkte mit Favorites speichern.
1 Min. Lesezeit
2. 10. 2026
Codex erhält wiederverwendbare Cloud-Umgebungen mit Zugriff von jedem Gerät ausCodex erhält wiederverwendbare Cloud-Umgebungen mit Zugriff von jedem Gerät aus
OpenAI erweitert Codex um wiederverwendbare Cloud-Arbeitsumgebungen. Hinzu kommen Sprachsteuerung im CLI, Code-Reviews in der ChatGPT-Desktop-App und Sicherheitsprüfungen für GitHub-Repositories.
2 Min. Lesezeit
2. 10. 2026
Amazon veröffentlicht Strands Decider 2B für Entscheidungen in Agenten-WorkflowsAmazon veröffentlicht Strands Decider 2B für Entscheidungen in Agenten-Workflows
Strands Decider 2B wählt zwischen vorgegebenen Optionen und liefert dazu einen Konfidenzwert. Das neue Entscheidungsmodell von AWS ist vollständig Open Source und lässt sich lokal betreiben.
2 Min. Lesezeit
1. 10. 2026
Přihlaste se k odběru našeho newsletteru
Zůstaňte informováni o nejnovějších příspěvcích, exkluzivních nabídkách, a aktualizacích.
CodedTrip

Betreiber: CodedTrip LLC, USA.

YouTube
TikTok