Nach einem missglückten Herbst kehrt OpenAI mit dem neuen und besseren ChatGPT-5.2 zurück

Nach einem missglückten Herbst kehrt OpenAI mit dem neuen und besseren ChatGPT-5.2 zurück

Ondřej Barták
Ondřej Barták
Unternehmer und Programmierer
16. 12. 2025
4 Minuten Lesezeit
Nach einem missglückten Herbst kehrt OpenAI mit dem neuen und besseren ChatGPT-5.2 zurück

OpenAI hat gerade eine neue Modellfamilie namens GPT-5.2 veröffentlicht, die in drei Versionen erhältlich ist: Instant, Thinking und Pro. Dieses Modell wurde entwickelt, um Menschen bei der Arbeit zu unterstützen, etwa beim Erstellen von Tabellen, Präsentationen oder beim Schreiben von Code. Laut Fidji Simo, Produktchefin bei OpenAI, versteht GPT-5.2 Bilder, lange Texte und komplexe Projekte, die mehrere Schritte erfordern, besser. Das Unternehmen kündigte dies am 11. Dezember 2025 in seinem Blog an und betonte, dass das Modell bis zu 400.000 Token auf einmal verarbeiten kann – das bedeutet, dass es Hunderte von Dokumenten gleichzeitig analysieren kann. Der Wissensstand des Modells reicht bis zum 31. August 2025, sodass es über die meisten Ereignisse dieses Jahres auf dem Laufenden ist.

Die Instant-Version ist schnell bei einfachen Aufgaben wie dem Verfassen von Texten oder Übersetzungen. Thinking ergänzt simuliertes Denken für komplexere Aufgaben wie Mathematik oder Programmierung, und Pro ist die präziseste Variante für anspruchsvolle Probleme.

Beschleunigte Veröffentlichung

Die Veröffentlichung folgt auf ein internes Memo von CEO Sam Altman, in dem er die Situation aufgrund des Drucks von Google als „Alarmstufe Rot“ bezeichnete. Google stellte nämlich kürzlich das Modell Gemini 3 vor, das einige Benchmarks übertraf und innerhalb von drei Monaten 200 Millionen Nutzer gewann. OpenAI reagierte darauf, indem es andere Pläne wie Werbung in ChatGPT verschob und sich auf die Verbesserung seines Chatbots konzentrierte. OpenAI hat 800 Millionen wöchentlich aktive ChatGPT-Nutzer, während Google Gemini 650 Millionen hat. Das Unternehmen OpenAI investierte 1,4 Billionen Dollar (etwa 32,2 Billionen CZK) in die Infrastruktur, um seinen Vorsprung zu halten.

Dies ist die dritte große Modellveröffentlichung seit August 2025. GPT-5 erschien im August mit einer Umschaltung zwischen schnellen Antworten und Denken, doch die Nutzer beschwerten sich über unterkühlte Antworten. Im November folgte GPT-5.1 mit acht Persönlichkeiten für bessere Unterhaltungen. Laut vielen Nutzern sank die Qualität der Antworten jedoch deutlich, weshalb sie zur Konkurrenz wechselten. Nun bringt GPT-5.2 weitere Verbesserungen mit sich, darunter weniger Fehler – laut Max Schwarzer von OpenAI halluziniert das Modell 38 % weniger als GPT-5.1.

Wie schneidet GPT-5.2 in Tests ab?

Das Modell erzielte in vielen Tests hervorragende Ergebnisse. Im Benchmark GDPval, der Aufgaben aus 44 Berufen misst, übertraf GPT-5.2 Thinking in 70,9 % der Fälle Fachleute oder erreichte deren Niveau. Dazu gehört das Erstellen von Präsentationen, Tabellen oder Diagrammen, und es erledigt dies 11-mal schneller und für weniger als 1 % der Kosten eines menschlichen Experten. Bei SWE-Bench Pro für Softwareentwicklung erreichte es 55,6 %, was besser ist als die 43,3 % von Gemini 3 Pro und die 52,0 % von Claude Opus 4.5.

Im Test GPQA Diamond für wissenschaftliche Fragen erreichte GPT-5.2 Thinking 92,4 % und lag damit knapp vor den 91,9 % von Gemini 3 Pro. Im Mathematiktest AIME 2025 erreichte es 100 %, bei FrontierMath (Stufen 1–3) 40,3 % und auf Stufe 4 dann 14,6 %. Beim abstrakten Schlussfolgern ARC-AGI-1 (Verified) erreicht es 86,2 %, bei ARC-AGI-2 dann 52,9 %. Bei visuellen Aufgaben wie dem Lesen von Diagrammen halbierte es die Fehlerquote – bei CharXiv Reasoning erreichte es mit dem Python-Tool 88,7 %.

Das Modell ist auch bei langen Kontexten besser und kann in einigen Tests Informationen aus 256.000 Token mit nahezu 100-prozentiger Genauigkeit verarbeiten. Bei der Werkzeugnutzung im Tau2-bench Telecom erreichte es 98,7 %, was eine zuverlässige Bearbeitung von Kundenanfragen über mehrere Runden hinweg bedeutet.

Benchmarks
Vergleich der Ergebnisse der Modelle 5.2 Thinking und 5.1 Thinking.

Verfügbarkeit und Preise für Nutzer

GPT-5.2 ist seit dem 11. Dezember 2025 in ChatGPT für die kostenpflichtigen Tarife Plus, Pro, Business oder Enterprise verfügbar. Das ältere GPT-5.1 bleibt drei Monate lang im Menü für Legacy-Modelle verfügbar. In der API für Entwickler kostet GPT-5.2 1,75 Dollar (etwa 40 CZK) pro Million Eingabe-Token, was 40 % mehr als bei GPT-5.1 ist, allerdings mit einem Rabatt von 90 % auf zwischengespeicherte Eingaben. Ausgabe-Token kosten 14 Dollar (etwa 322 CZK) pro Million. GPT-5.2 Pro ist teurer: 21 Dollar (etwa 483 CZK) pro Million Eingabe-Token und 168 Dollar (etwa 3.864 CZK) pro Million Ausgabe-Token.

Das Unternehmen arbeitet mit Nvidia und Microsoft zusammen und nutzt deren Hardware, etwa die GPUs H100, H200 oder GB200-NVL72. Die Sicherheit wurde verbessert – das Modell reagiert besser auf sensible Themen wie Suizid oder psychische Gesundheit und lieferte in Tests weniger als 1 % unerwünschte Antworten. OpenAI plant, eine Vorhersage des Nutzeralters einzuführen, um jüngere Nutzer unter 18 Jahren zu schützen.

GPT-5.2 in der Praxis

GPT-5.2 erleichtert die Arbeit mit Dokumenten, Bildern oder Code. Es kann beispielsweise Screenshots von Benutzeroberflächen bei ScreenSpot-Pro mit einer Genauigkeit von 86,3 % analysieren oder mathematische Probleme mithilfe von Werkzeugen lösen. Im Kundensupport bewältigt es komplexe Szenarien wie einen verspäteten Flug mit Anforderungen an eine Unterkunft und einen speziellen Sitzplatz, wobei es die Umbuchung und Entschädigung koordiniert. Das Modell stellt den größten Sprung beim agentischen Programmieren seit GPT-5 dar und funktioniert auch mit einfachen Anweisungen zuverlässig.

Fotoanalyse
Fotoanalyse.
Kategorie:KI
Hat Ihnen dieser Artikel gefallen?
Entdecken Sie weitere interessante Beiträge im Blog
Zurück zum Blog

Ähnliche Beiträge

Altman verkündete die Singularität – wenige Tage, nachdem seine Modelle selbst aus dem Labor entkamenAltman verkündete die Singularität – wenige Tage, nachdem seine Modelle selbst aus dem Labor entkamen
OpenAI-Chef Sam Altman erklärte in einer Folge des Podcasts Relentless, die Menschheit sei bereits in die Singularität eingetreten. „Wir sind jetzt gewissermaßen in der Singularität“, sagte er wörtlich. Ein Begriff, der jahrzehntelang eher zur Science-Fiction gehörte
6 Min. Lesezeit
28. 7. 2026
KI remixte Madonnas Song – jetzt führt er Australiens Charts an. Musiker sind empört.KI remixte Madonnas Song – jetzt führt er Australiens Charts an. Musiker sind empört.
Australische Radios spielen seit April Madonnas Dance-Version von Like a Prayer in Dauerschleife. Veröffentlicht vom Queensland-DJ Josh Fawaz, führt sie die Radiocharts an und hat auf Spotify 35 Millionen Streams.
5 Min. Lesezeit
28. 7. 2026
Claude Opus 5 hat einen Shooter von Grund auf programmiert. Was kann Claude of Duty?Claude Opus 5 hat einen Shooter von Grund auf programmiert. Was kann Claude of Duty?
Der Ego-Shooter läuft direkt im Browser, bietet eine eigene Physik und elf separate Codebereiche. Insgesamt rund 55.000 Zeilen, verteilt auf elf Subsysteme und aufgebaut auf Thr
4 Min. Lesezeit
28. 7. 2026
Přihlaste se k odběru našeho newsletteru
Zůstaňte informováni o nejnovějších příspěvcích, exkluzivních nabídkách, a aktualizacích.
CodedTrip

Betreiber: CodedTrip LLC, USA.

YouTube
TikTok