Gemma 3 270M: Ultrakompakte KI für Mobilgeräte

Gemma 3 270M: Ultrakompakte KI für Mobilgeräte

Ondřej Barták
Ondřej Barták
Unternehmer und Programmierer
18. 8. 2025
2 Minuten Lesezeit · 4 Aufrufe
Gemma 3 270M: Ultrakompakte KI für Mobilgeräte

Gemma 3 270M: Ultrakompakte KI für mobile Geräte

Die Gemma-Modellfamilie von Google wächst rasant. Nach der Einführung von Gemma 3 und Gemma 3 QAT für die Cloud und Desktop-Systeme folgte Gemma 3n für Mobilgeräte mit multimodaler KI. Nun kommt Gemma 3 270M, ein Modell mit 270 Millionen Parametern (170 Millionen für Embeddings, 100 Millionen für Transformer-Blöcke), das für spezifisches Fine-Tuning entwickelt wurde. Mit einem Vokabular von 256.000 Tokens ist es ideal für Domänen wie Sprachen oder Fachgebiete. Das Kontextfenster umfasst 32.000 Tokens, was für die meisten Aufgaben ausreicht.

Das Modell zeichnet sich durch seine Energieeffizienz aus: Bei INT4-Quantisierung verbraucht es für 25 Unterhaltungen nur 0,75 % des Akkus eines Pixel 9 Pro. Es läuft auf Geräten mit mindestens 4 GB RAM (CPU) oder 2 GB VRAM (GPU), bei einer Dateigröße von rund 550 MB beziehungsweise bis zu 200 MB für quantisierte Versionen. Auf einem Apple M4 Max erreicht es bei niedriger Latenz mehr als 650 Tokens pro Sekunde.

Wichtige Fähigkeiten und Bereitstellung

Gemma 3 270M ist multimodal (es verarbeitet Text, Bilder und Videos) und mehrsprachig (über 140 Sprachen) und verfügt laut dem IFEval-Benchmark über integrierte Fähigkeiten zur Befolgung von Anweisungen. Es stehen sowohl vortrainierte als auch auf Anweisungen trainierte Checkpoints zur Verfügung, einschließlich QAT für INT4-Präzision ohne nennenswerten Leistungsverlust.

Das Fine-Tuning ist schnell – es lässt sich mit minimalen Daten mithilfe von LoRA auf Geräten mit 8 GB RAM und 4 GB VRAM durchführen. Unterstützt werden Plattformen wie Windows, macOS und Linux sowie Tools wie Hugging Face, UnSloth oder JAX. Die Bereitstellung ist lokal oder auf Google Cloud Run möglich und eignet sich ideal für datenschutzfreundliche Offline-Anwendungen.

Gemma3 270M

Praktische Einsatzmöglichkeiten

Das Modell ist für klar definierte Aufgaben wie Sentimentanalyse, Entitätsextraktion, Weiterleitung von Anfragen oder kreatives Schreiben vorgesehen. Ein Beispiel ist die Zusammenarbeit von Adaptive ML mit SK Telecom, bei der eine feinabgestimmte Version größere Modelle bei der mehrsprachigen Moderation übertraf. Zu den weiteren Anwendungen gehört der Bedtime Story Generator zur Offline-Erstellung von Geschichten.

Es eignet sich hervorragend für große Aufgabenvolumina, bei denen es Zeit und Kosten spart – es läuft auf kostengünstiger Infrastruktur oder direkt auf dem Gerät. Es ermöglicht den Aufbau einer Flotte spezialisierter Modelle ohne großes Budget.

Einschränkungen und Verfügbarkeit

Als kompaktes Modell kann es stärker zu Halluzinationen neigen und weniger robuste Ausgaben liefern als größere LLMs. Weder die Trainingsdaten noch der Quellcode wurden veröffentlicht, sondern lediglich die vortrainierten Gewichte. Es kann von Hugging Face, Ollama, Kaggle, LM Studio oder Docker heruntergeladen werden. Testen Sie es auf Vertex AI, llama.cpp, Gemma.cpp, LiteRT, Keras oder MLX.

Gemma 3 270M, das Mitte August 2025 vorgestellt wurde, verschiebt die Grenzen der Effizienz für Entwickler, die schnelle und sparsame KI-Lösungen auf Edge-Geräten einsetzen möchten. Wir freuen uns auf Ihre Innovationen im Gemmaverse.

Werbung

Inhalte entstehen mit Unterstützung von UpTier.

SEO und GEO auf Autopilot. Die Multiagentensysteme von UpTier schreiben und optimieren Inhalte für Suchmaschinen und KI-Antworten.

UpTier entdecken ↗

Kategorie:KI
Hat Ihnen dieser Artikel gefallen?
Entdecken Sie weitere interessante Beiträge im Blog
Zurück zum Blog

Ähnliche Beiträge

ChatGPT führt virtuelle Anprobe für Kleidung und Accessoires einChatGPT führt virtuelle Anprobe für Kleidung und Accessoires ein
OpenAI startet weltweit zwei Shopping-Funktionen in ChatGPT: Nutzer können Kleidung und Accessoires auf einem eigenen Foto visualisieren und ausgewählte Produkte mit Favorites speichern.
1 Min. Lesezeit
2. 10. 2026
Codex erhält wiederverwendbare Cloud-Umgebungen mit Zugriff von jedem Gerät ausCodex erhält wiederverwendbare Cloud-Umgebungen mit Zugriff von jedem Gerät aus
OpenAI erweitert Codex um wiederverwendbare Cloud-Arbeitsumgebungen. Hinzu kommen Sprachsteuerung im CLI, Code-Reviews in der ChatGPT-Desktop-App und Sicherheitsprüfungen für GitHub-Repositories.
2 Min. Lesezeit
2. 10. 2026
Amazon veröffentlicht Strands Decider 2B für Entscheidungen in Agenten-WorkflowsAmazon veröffentlicht Strands Decider 2B für Entscheidungen in Agenten-Workflows
Strands Decider 2B wählt zwischen vorgegebenen Optionen und liefert dazu einen Konfidenzwert. Das neue Entscheidungsmodell von AWS ist vollständig Open Source und lässt sich lokal betreiben.
2 Min. Lesezeit
1. 10. 2026
Přihlaste se k odběru našeho newsletteru
Zůstaňte informováni o nejnovějších příspěvcích, exkluzivních nabídkách, a aktualizacích.
CodedTrip

Betreiber: CodedTrip LLC, USA.

YouTube
TikTok