Use Cases

GPT-5 im Rückblick: Was das Modell brachte und was heute gilt

Kurzfazit

GPT-5 war beim Launch im August 2025 ein echter Sprung, und in der API günstiger als viele erwartet hatten. Heute ist das Modell Geschichte: In ChatGPT wurde es im Februar 2026 abgelöst, in der API läuft die Abschaltung. Für ein neues Projekt lohnt sich GPT-5 nicht mehr, die aktuelle GPT-5.6-Familie ist der bessere Ausgangspunkt. Wer noch darauf baut, plant jetzt die Migration.

Auf einen Blick

  • Was: GPT-5, OpenAIs Flaggschiff-Modell vom 7. August 2025, in der API mit 1.25 USD Input und 10 USD Output pro 1 Million Token, beim Input günstiger als das ältere GPT-4o.
  • Für wen: heute nur noch als Rückblick relevant sowie für Teams, die GPT-5 in Produktion haben und einen Migrationsplan brauchen.
  • Kosten oder Grenze: in ChatGPT seit 13. Februar 2026 abgelöst; die API-Basis-Snapshots enden am 11. Dezember 2026, gpt-5-chat-latest und gpt-5-codex bereits am 23. Juli 2026.
  • Empfehlung: Ignorieren

OpenAI hat GPT-5 am 7. August 2025 veröffentlicht, gleichzeitig in ChatGPT und in der API. Fast ein Jahr später ist ein nüchterner Rückblick fällig: Was hat das Modell gebracht, was war Aufregung rund um einen holprigen Start, und was davon gilt heute noch. Der wichtigste Punkt vorweg: GPT-5 ist kein Modell mehr, auf das du neu setzen solltest.

Stand: 17. Juli 2026. Dieser Rückblick ordnet den GPT-5-Launch vom August 2025 ein und nennt die heute geltenden Abschalt-Termine.

Was hat GPT-5 beim Launch gebracht?

GPT-5 war das Flaggschiff-Modell der Generation, die OpenAI im August 2025 startete. Kern der Neuerung war ein automatisches Routing: In ChatGPT entschied das System selbst, ob eine schnelle Antwort genügte oder tiefes Reasoning nötig war, statt dass du das Modell von Hand wählst. In der API kamen neue Steuer-Parameter dazu, mit denen sich Rechenaufwand und Antwortlänge dosieren liessen.

Zum Start legte OpenAI eine Reihe von Benchmark-Werten vor. Das sind Herstellerangaben aus der Launch-Publikation vom 7. August 2025, kein unabhängiger Test, und mehrere davon wurden inzwischen von neueren Versionen übertroffen. Die meistgenannten Zahlen:

  • Coding (SWE-bench Verified): 74,9 Prozent laut OpenAI, gegenüber rund 50 Prozent beim direkten Vorgänger.
  • Mathematik (AIME 2025, ohne Tools): 94,6 Prozent laut OpenAI.
  • Halluzinationen: im Reasoning-Modus laut OpenAI bis zu rund 80 Prozent weniger Faktenfehler als beim Vorgänger o3, der praxisrelevanteste Fortschritt.

Technisch brachte GPT-5 ein Kontextfenster von 400’000 Token in der API mit, dazu den Parameter reasoning_effort zur Steuerung der Denk-Tiefe und verbosity für die Antwortlänge. Neu waren auch die «Safe Completions»: Statt eine heikle Anfrage komplett abzulehnen, lieferte das Modell eine kontrollierte, eingeschränkte Antwort. Das senkte die Zahl der unerwarteten Null-Antworten in automatisierten Pipelines.

Was kostete GPT-5 in der API wirklich?

Rund um den Launch hielt sich das Gerücht, GPT-5 sei ein teures Premium-Modell. Das Gegenteil stimmt. In der API kostete GPT-5 1.25 USD pro 1 Million Input-Token und 10 USD pro 1 Million Output-Token, und diese Preise standen seit dem Launch öffentlich auf der OpenAI-Preisseite. Zum Vergleich: Das ältere GPT-4o lag bei 2.50 USD Input und 10 USD Output. Beim Input war GPT-5 also halb so teuer wie GPT-4o, beim Output gleich.

Modell (API)Input (USD / 1 Mio. Token)Output (USD / 1 Mio. Token)
GPT-5 (2025)1.2510
GPT-4o (Vorgänger)2.5010
GPT-5.5 (aktuelle Linie)530

Der Denkfehler entstand oft durch die Vermischung zweier Produkträume: Die ChatGPT-Tarife (Plus, Pro, Team, Enterprise) sind ein Abo, die API-Listenpreise sind etwas anderes. Wer wegen vermeintlicher Mehrkosten bei GPT-4o blieb, zahlte beim Input in Wahrheit doppelt so viel. Für einfache Aufgaben liess sich der Rechenaufwand zusätzlich über reasoning_effort senken, ohne auf ein schwächeres Modell auszuweichen.

Wie holprig war der Start im August 2025?

Der Launch verlief alles andere als rund. Kurz nach der Veröffentlichung häuften sich Berichte, vor allem auf Reddit, wonach GPT-5 bei komplexem Denken und beim Coding schlechter abschneide als erwartet. Für ein paar Tage wirkte das neue Flaggschiff schwächer als sein Vorgänger.

OpenAI reagierte schnell. In einem Reddit-AMA am 8. August 2025 erklärte Sam Altman die Ursache: Der Autoswitcher, der Anfragen automatisch dem passenden Modell zuweist, hatte zeitweise nicht funktioniert und deshalb schwächere Modelle gewählt. OpenAI reparierte das Routing, verdoppelte die Ratenlimits für zahlende Nutzer und holte GPT-4o auf Wunsch als wählbares Modell zurück. Die schwache Wahrnehmung lag also nicht am Modell selbst, sondern an der Auslieferung.

Die Lehre daraus gilt bis heute: Benchmark-Spitze und Produktions-Verlässlichkeit sind nicht dasselbe. Wenn du ein neues Modell für kritische Abläufe einsetzt, teste es an deinen eigenen Aufgaben, statt dich auf Ranglisten oder Community-Posts zu verlassen. Einen aktuellen Überblick, welche Modelle heute vorne liegen, findest du in unseren Modell-Rankings.

Wo steht GPT-5 heute?

GPT-5 ist inzwischen ein Auslaufmodell, und die beiden Produkträume sind getrennt zu betrachten. In ChatGPT wurde GPT-5 am 13. Februar 2026 abgelöst (Instant, Thinking und Pro), bestehende Chats laufen auf der neueren Generation weiter. In der API läuft die Abschaltung gestaffelt: Die Varianten gpt-5-chat-latest und gpt-5-codex enden bereits am 23. Juli 2026, der Basis-Snapshot gpt-5-2025-08-07 erst am 11. Dezember 2026.

Grenze

Steht in deinen Pipelines noch gpt-5-chat-latest oder gpt-5-codex, bleibt nur bis 23. Juli 2026 Zeit. Danach antworten diese Endpunkte nicht mehr. Prüfe Code-Basis und Automatisierungen jetzt, nicht erst zum Dezember-Termin der Basis-Snapshots.

Für Agenten-Workflows und produktive Automatisierungen im DACH-Raum kommt zur technischen Migration eine zweite Frage dazu: In regulierten oder haftungssensiblen Bereichen ist die Modellwahl auch eine Datenschutz-Frage (revDSG in der Schweiz, DSGVO plus BDSG in Deutschland, DSG in Österreich). Ein Modellwechsel ersetzt keine fachliche oder rechtliche Prüfung im Einzelfall, und ein Serverstandort in der EU ist noch keine Compliance-Zusage.

Was kam nach GPT-5?

Die GPT-5-Linie ist nicht verschwunden, sie ist mehrfach nachgezogen worden. Nach dem Basis-Modell folgten GPT-5.1 im November 2025 und GPT-5.2 im Dezember 2025. Im April 2026 kam GPT-5.5 (Launch am 23. April 2026, API am Tag darauf), mit einem Kontextfenster von rund 1 Million Token und Preisen von 5 USD Input und 30 USD Output.

Der aktuelle Stand ist die GPT-5.6-Familie, seit dem 9. Juli 2026 allgemein verfügbar. Sie kommt in drei Stufen: Sol als Flaggschiff (5 USD Input, 30 USD Output), Terra als ausgewogene Mittelstufe (2.50 USD / 15 USD) und Luna als günstigste Variante für Volumen-Workloads (1 USD / 6 USD). Wählst du heute ein Modell aus dem OpenAI-Haus, ist das dein Ausgangspunkt, nicht mehr GPT-5. Wie sich die Generationen unterscheiden, erklären wir in den KI-Grundlagen zu Sprachmodellen.

Beirat-Empfehlung

GPT-5 war ein wichtiger Schritt, aber als Modell für neue Projekte ist es durch. In ChatGPT ist es abgelöst, in der API läuft die Abschaltung: gpt-5-chat-latest und gpt-5-codex am 23. Juli 2026, die Basis-Snapshots am 11. Dezember 2026. Wer GPT-5 noch produktiv nutzt, plant die Migration jetzt auf GPT-5.5 oder die aktuelle GPT-5.6-Familie. Für alles Neue gilt: die aktuelle Generation nehmen. Empfehlung: Ignorieren.

Bevor du mehr in KI investierst: Hol dir «Die 7 KI-Kostenfallen» als kostenloses PDF. Das wöchentliche KI-Briefing von Beirat bekommst du dazu, pragmatisch und ohne Hype.

→ PDF und Briefing holen