Wenn Sie das letzte Mal Anfang 2025 auf ChatGPT geachtet haben, ist das Modell, das Sie damals benchmarkt haben, wahrscheinlich bereits verschwunden. GPT-4o ist eingestellt. Das o3-Reasoning-Modell ist eingestellt. Sogar das ursprüngliche GPT-5.0 vom August 2025 ist von der API-Preisliste von OpenAI verschwunden [S3, S4].
In weniger als einem Jahr hat OpenAI sieben verschiedene Versionen von GPT-5 veröffentlicht, jede mit unterschiedlichen Fähigkeiten, Kontextfenstern und Preispunkten [3]. Das Tempo lag bei etwa einem neuen Modell oder einer größeren Funktion alle sechs Wochen [6]. Für alle, die ChatGPT gelegentlich nutzen oder auf der API aufbauen, ist die praktische Frage nicht mehr, ob man upgraden soll, sondern welches Modell man im Moment wählen sollte.
Die Entwicklung der GPT-5-Familie
Jede GPT-5-Variante löste ein spezifisches Problem. Die Entwicklung zu verstehen, hilft zu erklären, was man heute tatsächlich erhält.
GPT-5.0 startete am 7. August 2025 als ein einheitliches System mit einem schnellen Basismodell und einer tieferen Reasoning-Ebene, die automatisch je nach Komplexität der Anfrage aktiviert wurde [S3, S4]. Es erreichte 94,6 % beim AIME 2025 Mathematik-Test ohne Tools und 100 % mit Python-Tools im Pro-Modus [3].
GPT-5.1 erschien am 13. November 2025 mit adaptivem Reasoning, wodurch es bei einfachen Aufgaben 2- bis 3-mal schneller wurde, während die Preise identisch zu GPT-5.0 blieben [3]. Der Fokus lag auf der Gesprächsqualität und einer flüssigeren Interaktion [6].
GPT-5.2, veröffentlicht am 11. Dezember 2025, war das erste Modell, das über 90 % beim ARC-AGI-1 Pro erreichte und perfekte 100 % in Mathematik beim AIME 2025 erzielte [3]. Es verbesserte das Verständnis von langen Kontexten für Dokumente über 500.000 Token und stärkte die Zuverlässigkeit beim agentischen Tool-Calling [6].
GPT-5.3 Instant startete am 3. März 2026 und wurde zum Standard über alle Tarife hinweg, einschließlich der kostenlosen Version [S3, S4]. Es korrigierte den übervorsichtigen Ton früherer Modelle und lieferte bei aktivierter Websuche 26,8 % weniger Halluzinationen als GPT-5.2 [3]. Das Standard-GPT-5.3 ist jedoch inzwischen von der API-Preisliste von OpenAI verschwunden; aus dieser Generation überlebt nur noch gpt-5.3-codex [3].
GPT-5.4 kam am 5. März 2026 und führte ein Kontextfenster von 1 Million Token in der API sowie eine native Computer-Nutzung ein [S3, S6]. Es erreichte 75,0 % bei OSWorld-Verified und 57,7 % bei SWE-Bench Pro [3]. GPT-5.4 Thinking zeigte den Nutzern einen expliziten Denkplan, bevor die Antwort generiert wurde, was für zeitkritische Aufgaben ein- oder ausgeschaltet werden konnte [4].
GPT-5.5 startete am 23. April 2026 und wurde zum neuen Flaggschiff [S4, S6]. Es erreichte 93,6 % bei GPQA Diamond und 78,7 % bei OSWorld-Verified, beide Werte lagen vor GPT-5.4 [3]. Die wichtigste Verbesserung waren 52,5 % weniger halluzinierte Behauptungen als bei GPT-5.3 Instant bei kritischen Prompts in den Bereichen Medizin, Recht und Finanzen [6].
GPT-5.6 wurde am 9. Juli 2026 vollständig veröffentlicht und stellt die aktuelle technologische Grenze dar [3]. Es wird in drei Stufen angeboten: Sol (Flaggschiff), Terra (ausgewogen) und Luna (günstigste Option) [S3, S7]. Sol erreicht 88,8 % im Terminal-Bench 2.1 und kommt im Sol Ultra High-Effort-Modus auf 91,9 %, womit es die 88,0 % von GPT-5.5 im selben agentischen Coding-Test knapp übertrifft [3]. Es bietet ein API-Kontextfenster von 1,05 Millionen Token [3].
Was eingestellt wurde und was gefährdet ist
Der Modellwechsel verlief aggressiv. GPT-4o, GPT-4.5, o1, o3 und o4-mini sind alle aus der Modellauswahl des Consumer-ChatGPT verschwunden [4]. GPT-5.1 Instant, Thinking und Pro wurden am 11. März 2026 eingestellt, wobei bestehende Konversationen automatisch auf neuere Modelle migriert wurden [7].
Für Entwickler ist das Risiko konkreter. Fünfzehn Legacy-Modell-Snapshots verlieren am 23. Juli 2026 den API-Zugriff, darunter fünf Codex-Snapshots und beide chat-latest-Aliase [3]. Das ursprüngliche gpt-5-2025-08-07 sowie seine Mini-, Nano- und Pro-Varianten werden am 11. Dezember 2026 abgeschaltet [3]. Der Alias gpt-5.3-chat-latest wird am 10. August 2026 abgeschaltet [3].
Wenn Ihre Anwendung auf eingestellte Modell-Strings wie gpt-4o, o3 oder o4-mini verweist, hat OpenAI die langfristige API-Verfügbarkeit dieser Modelle nicht bestätigt [4]. Die Migration auf Modell-Strings der GPT-5-Familie ist jetzt der sicherste Weg.
Welches Modell sollten Sie tatsächlich verwenden?
Für die alltägliche Nutzung von ChatGPT hat sich der Standard bereits verschoben. GPT-5.5 Instant hat im April 2026 still und leise GPT-5.3 Instant als neuen Standard ersetzt [7]. Wenn Sie den kostenlosen Tarif nutzen, ist dies das Modell, das Sie verwenden.
Für Forschung, Strategie und Analysen, bei denen der Denkprozess entscheidend ist, bleibt GPT-5.4 Thinking für Plus-, Team- und Pro-Nutzer verfügbar [S2, S4]. GPT-5.2 Thinking, das von GPT-5.4 ersetzt wurde, wird jedoch am 5. Juni 2026 eingestellt [2].
Für agentisches Coding und Wissensarbeit ist GPT-5.5 die stärkste weithin verfügbare Option, wobei GPT-5.5 Pro eine höhere Genauigkeit für anspruchsvolle professionelle Aufgaben bietet [S4, S6]. GPT-5.6 Sol ist die aktuelle Spitze, sofern Sie API-Zugriff haben, befindet sich aber noch im Rollout [3].
Für kostenbewusste API-Arbeiten ändert die Preisstruktur von GPT-5.6 die Kalkulation. Sol bleibt bei 5 $ Input und 30 $ Output pro 1 Mio. Token, genau wie GPT-5.5 [3]. Terra sinkt auf 2 $ Input und 12 $ Output [3]. Luna ist mit 0,20 $ Input und 1,20 $ Output am günstigsten, nachdem OpenAI den Preis am 30. Juli 2026 um 80 % gesenkt hat [3].
Über Modelle hinaus: Speicher und wichtige Funktionen
Das Modell-Lineup ist nur ein Teil der Geschichte. Im Juni 2026 führte OpenAI ein neues Memory-System ein, das den Kontext über Sitzungen hinweg beibehält, Präferenzen befolgt und aktueller bleibt als die vorherige Implementierung [7]. Das Speicher-Upgrade erreichte zuerst Plus- und Pro-Nutzer in den USA, wobei die Personalisierung auf ChatGPT Go und die kostenlosen Tarife ausgeweitet wurde [7].
Memory Sources, die Anfang 2026 für alle ChatGPT-Pläne eingeführt wurden, geben Nutzern Einblick darin, welcher Kontext zur Personalisierung jeder Antwort verwendet wurde [6]. Man kann sehen, welche gespeicherten Erinnerungen, vergangenen Chats oder Wissensdateien eine bestimmte Antwort beeinflusst haben, und spezifische Erinnerungen löschen, ohne den gesamten Verlauf zu löschen [6]. Dies ist wichtig für Datenschutz und Vertrauen, insbesondere in professionellen Umgebungen, in denen man prüfen muss, worauf sich das Modell stützt.
Das praktische Fazit ist einfach: Prüfen Sie, welche Modell-Strings in Ihren Workflows verwendet werden, aktualisieren Sie alles, was auf eingestellte Versionen verweist, und nutzen Sie die gestaffelte Preisgestaltung, wenn Sie auf der API aufbauen. Das Modell, von dem Sie glauben, dass Sie es verwenden, könnte bereits ein ganz anderes sein.
Quellen
- The Ultimate ChatGPT Model Comparison: GPT-5.0 to 5.6
- ChatGPT 2026: Every Model, Feature & Update Explained
- What’s New in ChatGPT 2026: GPT-5.5, Memory Sources, and Every Major Update
- Latest ChatGPT Updates (2026): GPT-5.5, GPT-5.4, Memory & More - Appscribed
- Introducing GPT‑5.4 - OpenAI
- GPT-5.4 and the March 2026 ChatGPT Upgrade Cycle: Official Release …
- OpenAI News 2026 — GPT Releases, Codex, IPO, ChatGPT Updates, and All …