OpenAI hat GPT-4.5 Preview als API-Modell inzwischen als veraltet eingestuft: Der Einsatz kostete bis zur Abkündigung 75 US-Dollar pro eine Million Input-Token und 150 US-Dollar pro eine Million Output-Token, bei einem Kontextfenster von 128.000 Token und maximal 16.384 Output-Token pro Anfrage. Für Unternehmen, die GPT-4.5 Preview noch in Produktivsystemen nutzen, ist die Abkündigung durch OpenAI ein konkreter Handlungsbedarf: OpenAI empfiehlt den Wechsel auf GPT-4.1 oder o3, die beide bei deutlich niedrigeren Kosten von 2 US-Dollar pro eine Million Token verfügbar sind. Angesichts eines Preisunterschieds von bis zu Faktor 75 beim Input sollten Entscheider ihre API-Nutzung und Budgetplanung umgehend prüfen.
OpenAI GPT-4.5 Preview: API-Preise, Kontextfenster und Rate-Limits im Überblick
GPT-4.5 Preview ist seit seiner Veröffentlichung offiziell als “Deprecated” eingestuft: OpenAI empfiehlt Entwicklern ausdrücklich, stattdessen auf GPT-4.1 oder o3 umzusteigen. Die wesentlichen technischen Eckdaten und Kostenpositionen des Modells sind dennoch für Unternehmen relevant, die bestehende Integrationen bewerten oder eine Migration planen.
Leitfakt: Hohe Tokenpreise bei mittlerer Geschwindigkeit
Laut OpenAI-Entwicklerdokumentation kostet der GPT-4.5-Preview-Input 75 US-Dollar pro einer Million Token, der Output 150 US-Dollar pro einer Million Token. Für zwischengespeicherte Eingaben (Cached Input) gilt ein reduzierter Satz von 37,50 US-Dollar pro Million Token. Das Kontextfenster umfasst 128.000 Token, der maximale Output liegt bei 16.384 Token. OpenAI klassifiziert die Modellgeschwindigkeit als “Medium” und die Intelligenz als “Higher”. Als Wissensstichtag ist der 1. Oktober 2023 angegeben.
Zum Vergleich: GPT-4.1 und o3 sind laut OpenAI-Preisseite für je 2,00 US-Dollar pro Million Input-Token erhältlich, also zu einem Bruchteil des GPT-4.5-Preises.
Praktische Implikationen für Entscheider
1. Kostendruck bei tokenschweren Workflows
Der Preisunterschied zwischen GPT-4.5 Preview und den Nachfolgemodellen ist erheblich. Wer große Dokumentmengen automatisiert verarbeitet, muss bei GPT-4.5 Preview mit dem 37-fachen Inputpreis gegenüber GPT-4.1 rechnen. Community-Berichten zufolge stoßen API-Nutzer bei der Completions-API bereits ab Tier-1-Accounts an Token-pro-Minute-Limits (TPM), die bei intensiven Batch-Verarbeitungen schnell überschritten werden. Ein Nutzer berichtete im OpenAI-Community-Forum im Dezember 2024, sein Tier-1-Limit von 30.000 TPM überschritten zu haben, obwohl er anhand seiner Ausgaben ein höheres Tier erwartet hatte. Dies zeigt: Die tatsächlich zugewiesene Tier-Stufe bestimmt das verfügbare TPM-Kontingent, nicht allein der bisherige Verbrauch.
Für tokenschwere Enterprise-Anwendungen lohnt sich ein genauer Blick auf den API-Kostenvergleich zwischen Claude, GPT und Gemini.
2. Nutzungslimits für ChatGPT Plus- und Pro-Nutzer
GPT-4.5 unterlag laut Nutzerberichten im OpenAI-Community-Forum (Stand Mai 2025) wöchentlichen Nachrichtenlimits. Zu Beginn des Rollouts im März 2025 wurden für Plus-Nutzer rund 50 Nachrichten pro Woche gemeldet, mit gelegentlichen Drosselungen auf noch niedrigere Werte. Ob und in welchem Umfang diese Limits seitdem angehoben wurden, kommuniziert OpenAI auf seinen offiziellen Seiten nicht transparent. Pro-Nutzer (200 US-Dollar/Monat) kritisierten im selben Forum, dass trotz des höheren Preises das Kontextfenster bei neueren Modellen auf 32.000 Token für Plus-Nutzer reduziert wurde, während GPT-4.5, o3, o4-mini und o4-mini-high weiterhin das volle 128k-Fenster bieten sollen. Diese Intransparenz bei Limit-Änderungen erschwert die langfristige Budgetplanung für Entscheider.
Einen methodischen Vergleich mit Wettbewerbern bietet der Artikel zu Anthropic Claude API-Preisen und Token-Kosten im GPT-4.5-Vergleich.
3. Migration zu günstigeren Nachfolgemodellen empfohlen
OpenAI hat GPT-4.5 Preview offiziell als “Deprecated large model” eingestuft und verweist auf GPT-4.1 und o3 als empfohlene Alternativen für die meisten Anwendungsfälle. Unternehmen, die aktuell auf GPT-4.5-Endpunkte setzen, sollten eine zeitnahe Migration einplanen. Die unterstützten Endpunkte umfassen unter anderem /v1/chat/completions, /v1/responses, /v1/assistants und /v1/batch. Das Modell unterstützt Text und Bild als Input, liefert aber ausschließlich Text als Output. Audio und Video werden nicht unterstützt.
Für die Migrationsentscheidung sind unabhängige Latenz- und Kostenbenchmarks relevant, wie sie etwa unter Latenz-Benchmarks 2025: Claude, GPT-4.5 und Gemini 2.0 im API-Vergleich zusammengefasst werden.
4. Enterprise-Rabattstaffeln: Keine öffentlichen Angaben
OpenAI veröffentlicht für GPT-4.5 Preview keine expliziten Enterprise-Rabattstaffeln auf seinen Entwicklerseiten. Die dokumentierten Listenpreise (75 US-Dollar Input, 150 US-Dollar Output, 37,50 US-Dollar Cached Input) gelten als Standardpreise. Volumenrabatte oder dedizierte Enterprise-Konditionen werden, sofern vorhanden, im Rahmen individueller Vertragsverhandlungen gewährt und sind nicht öffentlich einsehbar. Unternehmen mit hohem Tokenvolumen sollten dies bei der Anbieterauswahl berücksichtigen und Alternativen wie die Batch-API-Ansätze von Anthropic zur Kostenoptimierung in ihre Bewertung einbeziehen.
Quellen
- Token/Tier Limits for account – OpenAI Community Forum (Dezember 2024)
- What are the current GPT-4.5 weekly limits in 2025 May? – OpenAI Community Forum (Mai 2025)
- GPT-4.5 Preview Model – OpenAI API Dokumentation
Häufige Fragen
Was kostet die GPT-4.5-Preview-API pro eine Million Token?
Laut OpenAI-Entwicklerdokumentation berechnet OpenAI für GPT-4.5 Preview 75 US-Dollar pro eine Million Input-Token und 150 US-Dollar pro eine Million Output-Token. Für zwischengespeicherte Eingaben (Cached Input) gilt ein reduzierter Preis von 37,50 US-Dollar pro Million Token. Zum Vergleich: GPT-4.1 und o3 kosten jeweils lediglich 2 US-Dollar pro Million Input-Token, weshalb OpenAI selbst empfiehlt, für die meisten Anwendungsfälle auf diese neueren Modelle umzusteigen.
Wie groß ist das Kontextfenster von GPT-4.5 Preview?
GPT-4.5 Preview unterstützt ein Kontextfenster von 128.000 Token bei einer maximalen Ausgabelänge von 16.384 Token. Wichtig für Nutzer mit kostenpflichtigen ChatGPT-Abonnements: Laut Berichten aus der OpenAI-Community stand das volle 128.000-Token-Fenster im ChatGPT-Interface für Plus-Nutzer nicht durchgängig zur Verfügung, während Pro-Nutzer für 200 US-Dollar monatlich nach Angaben von Nutzern ebenfalls mit eingeschränktem Kontextzugang konfrontiert wurden.
Welche Rate-Limits gelten für GPT-4.5 in der API, und wie hängen sie vom Nutzertier ab?
OpenAI staffelt die Rate-Limits nach Nutzungstiers. Ein konkretes Beispiel aus der Community: Ein Nutzer, der sich auf Basis seiner Ausgaben im Tier 2 wähnte, wurde beim Einsatz von GPT-4-turbo-preview auf ein Limit von 30.000 Token pro Minute (TPM) beschränkt, obwohl Tier 2 eigentlich 450.000 TPM vorsieht. Ursache war, dass trotz Angabe von ‘gpt-4-turbo’ das Preview-Modell mit niedrigerem Tier-Limit genutzt wurde. Das genaue zugewiesene Tier lässt sich über die Einstellungen im OpenAI-Dashboard einsehen. Für GPT-4.5 gelten entsprechend abgestufte TPM- und RPM-Limits je nach Tier.
Welche wöchentlichen Nutzungsgrenzen gelten für GPT-4.5 im ChatGPT-Abonnement?
Zu Beginn der Verfügbarkeit von GPT-4.5 im März 2025 berichteten Plus-Nutzer von einem Limit von rund 50 Nachrichten pro Woche, mit gelegentlichen Drosselungen auf noch niedrigere Werte. Laut einem Nutzerbeitrag vom 2. Mai 2025 blieb unklar, ob diese Grenzen seitdem angehoben wurden, da die offiziellen OpenAI-Seiten dazu keine präzisen Angaben machten. Für Pro-Nutzer galten zum selben Zeitpunkt ebenfalls Beschränkungen, deren genaue Höhe OpenAI nicht transparent kommunizierte.
Ist GPT-4.5 Preview noch aktiv, oder wurde das Modell eingestellt?
GPT-4.5 Preview hat laut OpenAI-Entwicklerdokumentation den Status ‘Deprecated’, ist also offiziell abgekündigt. OpenAI empfiehlt Entwicklern ausdrücklich, stattdessen GPT-4.1 oder o3 zu verwenden. Das Modell hatte einen Wissensstand bis zum 1. Oktober 2023 und war als Research Preview konzipiert. Angesichts des deutlich günstigeren Preises und vergleichbarer oder höherer Leistung der Nachfolgemodelle rät OpenAI vom weiteren produktiven Einsatz von GPT-4.5 Preview ab.
Dieser Artikel wurde von einem KI-System automatisiert erstellt. Kennzeichnung gemäß Art. 50 der EU-KI-Verordnung.




