GLM-4.5: Chinas offenes Modell übertrifft globale Giganten

GLM-4.5: Chinas offenes Modell übertrifft globale Giganten

Ondřej Barták
Ondřej Barták
Unternehmer und Programmierer
1. 8. 2025
5 Minuten Lesezeit
GLM-4.5: Chinas offenes Modell übertrifft globale Giganten

GLM-4.5: Das offene chinesische Modell, das die globalen Giganten übertrifft

Stellen Sie sich eine künstliche Intelligenz vor, die nicht nur wie ein Mensch denkt, sondern auch selbstständig programmieren, das Web durchsuchen und allein auf Grundlage einer einfachen Beschreibung ganze PowerPoint-Präsentationen erstellen kann – und das sogar auf Tschechisch. Das ist die Realität des neuen Modells GLM-4.5 des chinesischen Unternehmens Zhipu AI, das auch als Z.ai bekannt ist. Dieses offene Modell, das Ende Juli 2025 veröffentlicht wurde, bringt revolutionäre Fortschritte bei agentischen Fähigkeiten, logischem Denken und Programmieren. Laut dem offiziellen Blog von Z.ai und einer Analyse von VentureBeat belegt GLM-4.5 unter den weltweiten Modellen in 12 wichtigen Benchmarks den dritten Platz und übertrifft in einigen Tests Modelle wie Claude 3.5 Sonnet oder Gemini 1.5 Pro. Und das Beste daran? Es ist kostenlos unter der Apache-2.0-Lizenz verfügbar, sodass Entwickler es frei verwenden, anpassen und bereitstellen können.

Das Modell GLM-4.5 ist nicht nur ein weiteres großes Sprachmodell (LLM). Es wurde speziell für komplexe Aufgaben entwickelt, bei denen logisches Denken, Programmierung und die Interaktion mit Werkzeugen kombiniert werden. Das 2019 gegründete Unternehmen Zhipu AI erhielt Investitionen von mehr als 1,5 Milliarden US-Dollar von Giganten wie Alibaba oder Tencent. Laut CNBC ermöglichte dies die Entwicklung eines Modells, das auf nur acht Nvidia-H20-Grafikkarten läuft – halb so vielen, wie vergleichbare Modelle von DeepSeek benötigen. Dadurch ist GLM-4.5 nicht nur leistungsstark, sondern auch für eine breite Nutzung wirtschaftlich erschwinglich.

Die Architektur und das Training, die GLM-4.5 so außergewöhnlich machen

Die Grundlage von GLM-4.5 bildet eine Mixture-of-Experts-Architektur (MoE), die insgesamt 355 Milliarden Parameter mit 32 Milliarden aktiven Parametern kombiniert. Die leichtere Version GLM-4.5-Air verfügt über insgesamt 106 Milliarden und 12 Milliarden aktive Parameter, wodurch sie sich ideal für weniger anspruchsvolle Anwendungen eignet. Laut dem Blog von Z.ai erhöht diese Struktur die Tiefe des Modells (mehr Schichten), was das logische Denken verbessert, während die Breite zugunsten der Effizienz reduziert wird. Das Modell verwendet Grouped-Query Attention mit 96 Köpfen für eine bessere Verarbeitung von Kontexten mit bis zu 128.000 Token sowie Multi-Token Prediction für eine schnellere Inferenz.

Das Training erfolgte in mehreren Phasen: Zunächst mit 15 Billionen Token aus einem allgemeinen Korpus, anschließend mit 7 Billionen Token aus spezialisierten Daten für Code und logisches Denken. In einer weiteren Phase kamen 1,1 Billionen Token aus Code auf Repository-Ebene, synthetischen Schlussfolgerungseingaben und langen Kontexten hinzu. Zhipu AI nutzte eine eigene RL-Infrastruktur namens slime, die die Datengenerierung vom Training trennt und dadurch die Effizienz steigert. Techniken wie Mixed-Precision-Rollouts und adaptives Curriculum Learning ermöglichten es dem Modell, schrittweise komplexere Aufgaben zu bewältigen – von einfachen bis hin zu agentischen Aufgaben.

Das Ergebnis ist ein Modell, das zwei Modi unterstützt: „Denken“ für komplexe Schlussfolgerungen und den Einsatz von Werkzeugen sowie „Nicht-Denken“ für schnelle Antworten. Laut VentureBeat ermöglicht dies die automatische Erstellung vollständiger PowerPoint-Präsentationen allein anhand eines Titels oder Prompts, was für Besprechungen, Bildungszwecke oder Berichte nützlich ist.

Leistung in Benchmarks: Es übertrifft die Konkurrenz

GLM-4.5 glänzt in Tests zu agentischen Aufgaben, logischem Denken und Programmierung. Im BrowseComp-Benchmark erreicht es eine Genauigkeit von 26,4 %, womit es Claude 3 Opus (18,8 %) übertrifft und sich o1-mini-high (28,3 %) annähert. Bei TAU-bench-Retail erzielt es 79,7 Punkte, bei TAU-bench-Airline 60,4 und bei BFCL v3 77,8. Damit liegt es auf dem Niveau von Claude 3.5 Sonnet.

BrowseComp-Benchmark

Beim logischen Denken erzielt es hohe Werte: 98,2 % bei MATH 500, 91,0 % bei AIME24 und 79,1 % bei GPQA. Beim Programmieren erreicht es 64,2 % bei SWE-bench Verified und 37,5 % bei Terminal-Bench, womit es GPT-4o (48,6 % bei SWE-bench) und Qwen2-Coder (80,8 % Gewinnrate in direkten Vergleichen) übertrifft. GLM-4.5-Air, die leichtere Variante, belegt insgesamt den sechsten Platz und erzielt ähnliche Ergebnisse, stellt jedoch geringere Anforderungen an die Hardware.

Leistungsvergleich

Laut weiteren Informationen aus der Recherche, etwa von MarkTechPost oder Pandaily, ist GLM-4.5 das erste offene Modell, das logisches Denken, Programmierung und agentische Fähigkeiten nativ integriert. Es ist unter der MIT-Lizenz lizenziert und auf Hugging Face verfügbar, wodurch es sich ideal für die Integration in Plattformen wie GPTBots.ai von Aurora Mobile eignet.

Praktische Beispiele und Anwendungen: Von Spielen bis zu Präsentationen

Zhipu AI hat mehrere Demos vorgestellt, die die Leistungsfähigkeit des Modells zeigen. So kann GLM-4.5 beispielsweise einen Klon des Spiels Flappy Bird, ein 3D-Labyrinth oder eine Aufgabenliste mit Drag-and-drop-Funktion erstellen – alles in HTML, SVG oder Python. Bei der Erstellung von Präsentationen sucht der Agent selbstständig im Web nach Informationen und generiert Folien, etwa über die Erfolge des Radrennfahrers Tadej Pogačar oder über die Urknalltheorie.

Weitere Beispiele umfassen vollwertige Webanwendungen: einen Pokémon-Pokédex mit Typenfilterung, einen Generator für mittelalterliche Gedichte oder Cyberpunk-Karten. Diese Funktionen sind direkt auf der Plattform Z.ai oder über eine API verfügbar, die mit den OpenAI-Standards kompatibel ist. Die API-Preise sind niedrig: 0,60 US-Dollar pro Million Eingabe-Token für GLM-4.5 und 0,20 US-Dollar für Air, bei 2,20 beziehungsweise 1,10 US-Dollar für die Ausgabe.

Pokémon

Das Modell unterstützt kreatives Schreiben, emotionales Copywriting und Dialogsysteme für den Kundensupport oder Rollenspiele. Die Integration mit Werkzeugen wie CodeGeex oder Roo Code verbessert seine agentischen Programmierfähigkeiten. Beim Aufruf von Werkzeugen erreicht es eine Erfolgsquote von 90,6 % und übertrifft damit Claude 3.5 Sonnet (89,5 %).

Verfügbarkeit und Auswirkungen auf den Markt

GLM-4.5 ist auf Z.ai, über die API, auf Hugging Face und ModelScope verfügbar. Für die lokale Bereitstellung unterstützt es Inferenz über vLLM und SGLang. Laut VentureBeat ist es Teil einer Welle offener chinesischer Modelle wie Qwen von Alibaba oder Kimi K2 von Moonshot, die amerikanische Giganten wie Meta oder OpenAI unter Druck setzen.

Für Unternehmen bedeutet GLM-4.5 dank Streaming, Kontext-Caching und strukturierten JSON-Antworten eine geringere Abhängigkeit von proprietären Modellen. Es eignet sich ideal für Teams mit begrenztem Budget, da es die Kosten gegenüber Claude um bis zu 90 % senkt. Als chinesisches Modell kann es jedoch lokalen Vorschriften unterliegen, was für die Kontrolle über die Daten von Bedeutung ist.

In einer Zeit, in der KI zu einem alltäglichen Bestandteil des Lebens wird, bietet GLM-4.5 von Zhipu AI erschwingliche Leistungsfähigkeit, die unsere Arbeit mit Technologien verändern kann. Wenn Sie ein Modell suchen, das schnell, intelligent und offen ist, dann ist dieses genau das Richtige.

Kategorie:KI
Hat Ihnen dieser Artikel gefallen?
Entdecken Sie weitere interessante Beiträge im Blog
Zurück zum Blog

Ähnliche Beiträge

Altman verkündete die Singularität – wenige Tage, nachdem seine Modelle selbst aus dem Labor entkamenAltman verkündete die Singularität – wenige Tage, nachdem seine Modelle selbst aus dem Labor entkamen
OpenAI-Chef Sam Altman erklärte in einer Folge des Podcasts Relentless, die Menschheit sei bereits in die Singularität eingetreten. „Wir sind jetzt gewissermaßen in der Singularität“, sagte er wörtlich. Ein Begriff, der jahrzehntelang eher zur Science-Fiction gehörte
6 Min. Lesezeit
28. 7. 2026
KI remixte Madonnas Song – jetzt führt er Australiens Charts an. Musiker sind empört.KI remixte Madonnas Song – jetzt führt er Australiens Charts an. Musiker sind empört.
Australische Radios spielen seit April Madonnas Dance-Version von Like a Prayer in Dauerschleife. Veröffentlicht vom Queensland-DJ Josh Fawaz, führt sie die Radiocharts an und hat auf Spotify 35 Millionen Streams.
5 Min. Lesezeit
28. 7. 2026
Claude Opus 5 hat einen Shooter von Grund auf programmiert. Was kann Claude of Duty?Claude Opus 5 hat einen Shooter von Grund auf programmiert. Was kann Claude of Duty?
Der Ego-Shooter läuft direkt im Browser, bietet eine eigene Physik und elf separate Codebereiche. Insgesamt rund 55.000 Zeilen, verteilt auf elf Subsysteme und aufgebaut auf Thr
4 Min. Lesezeit
28. 7. 2026
Přihlaste se k odběru našeho newsletteru
Zůstaňte informováni o nejnovějších příspěvcích, exkluzivních nabídkách, a aktualizacích.
CodedTrip

Betreiber: CodedTrip LLC, USA.

YouTube
TikTok