1. Bei ähnlich schwerer Arbeit kommt Claude früher ins Ziel
Verglichen wurde keine kurze Einzelfrage. Die Aufgaben mussten langen Kontext lesen, mehrere Schritte ausführen, unterwegs Entscheidungen treffen und umfangreiche Ergebnisse liefern.
Claude Opus 5.5 und GPT-6.1 Sol liefen parallel mit ungefähr mittlerem Reasoning-Aufwand. Keines der Systeme wurde künstlich in einen besonders leichten Modus gesetzt.
In der Praxis kam Claude sichtbar schneller voran und lieferte mehr fertige Arbeit. GPT-6.1 Sol arbeitete weiter, aber langsamer.
Bei einer einzelnen Frage sind zehn Minuten egal. Bei Agenten, die stundenlang laufen, werden zehn Minuten mal zwanzig zu mehr als drei Stunden.
Ein paar Benchmark-Punkte können weniger wert sein als zwei zusätzliche brauchbare Aufgaben, die vor Feierabend fertig werden.
2. Dann zeigte die Verbrauchsanzeige ungefähr 31% gegen 3%
Nach ungefähr einer Stunde vergleichbarer paralleler Arbeit zeigte ChatGPT 69% Rest – vereinfacht also rund 31% verbraucht. Claude zeigte ungefähr 3% Verbrauch.
31 geteilt durch 3 ergibt etwa 10,3. Das bedeutet aber nicht, dass Claude exakt 10,3-mal billiger ist.
Die Prozentwerte haben nicht denselben Nenner. Abo-Pools, Fünf-Stunden-Fenster, Wochenlimits, Modellgewichtung und interne Messregeln unterscheiden sich.
Das ist nicht Äpfel mit Äpfeln.
Vielleicht ist es eine Tankanzeige gegen die Restzeit eines All-you-can-eat-Buffets.
Trotzdem ist es für Käufer relevant: ähnliche Arbeit am selben Tag, eine Anzeige bewegt sich kaum, die andere fällt sichtbar – und das sparsamere System ist auch schneller fertig.
3. Dann kam ein weiterer Kostenfaktor: „Selected model is at capacity“
Auf der OpenAI-Seite erschien:
Selected model is at capacity. Please try a different model.
Der Verbrauch wirkte bereits höher. Dann war auch noch die Straße verstopft.
Die beobachtete Wartezeit betrug ungefähr 30 Sekunden.
Dreißig Sekunden allein sind kein Drama. Bei langen Jobs kommen aber Retry, Statusprüfung, Modellwechsel und die Aufmerksamkeit eines Menschen hinzu.
Im OpenAI Developer Community wurden dieselben Fehlermeldungen auch von Pro-Nutzern gemeldet, die nach eigener Aussage noch Nutzung übrig hatten.
„Mein Quota ist leer“ und „der Anbieter hat gerade nicht genug Capacity“ können also zwei verschiedene Fehler sein.
In die Vergleichstabelle gehört deshalb eine neue Spalte: Verfügbarkeit genau dann, wenn man das Modell braucht.
4. Auch Anthropic positioniert Opus 5.5 klar über Effizienz
Anthropic veröffentlichte Opus 5.5 am 22. September 2026 und gibt an, dass typische tokenbasierte Workloads ungefähr 40% günstiger laufen als mit Opus 5.
Das Unternehmen betont außerdem weniger Tokens, Schritte und Tool-Aufrufe pro abgeschlossener Aufgabe. Claude Code bietet zusätzlich einen Fast mode, der unter eigenen Bedingungen bis zu 2,5-mal schneller sein soll.
Die hier beschriebene Beobachtung war kein kontrollierter Fast-mode-Benchmark.
Wichtiger ist die Definition von Geschwindigkeit.
Weniger Umwege, weniger Retries, weniger unnötige Tool-Aufrufe und weniger Rückfragen sind ebenfalls Geschwindigkeit.
5. Gleichzeitig verändert sich die Ökonomie von OpenAI Pro $200
Am 30. September bezeichnet das öffentliche OpenAI Help Center Pro $200 weiterhin als Pro 20x.
Eine andere aktuelle OpenAI-Hilfeseite erklärt jedoch, dass berechtigte Bestandskunden die frühere inkludierte Nutzung bis zum 29. Oktober 2026 behalten und danach bei unverändert $200 pro Monat auf eine niedrigere inkludierte Nutzung wechseln.
Business Insider und öffentlich geteilte Kundenmitteilungen beschreiben Work/Codex als Rückgang von 20x auf 10x Plus und GPT-6 Pro Chat von 200 auf 100 Nachrichten pro Woche.
Die saubere Beschreibung lautet deshalb:
Die öffentliche Hilfeseite trägt noch das 20x-Label.
Die Übergangsmitteilungen nennen nach dem 29. Oktober niedrigere Limits für betroffene Nutzer.
OpenAI hat parallel Pro 500 mit höherer Nutzung und GPT-6 Astra Ultrafast gestartet.
Die Decke steigt.
Das $200-Regal wird leichter.
6. 62.500 Credits sind viel, aber nur vorübergehend
Öffentlich geteilte Hinweise beschreiben eine einmalige Vergabe von 62.500 usage credits im angegebenen Wert von $2.500, die am 31. Dezember 2026 verfallen.
Das ist eine starke Übergangshilfe.
Es ist keine dauerhafte Preissenkung.
Nach Verbrauch oder Ablauf bleiben Monatsgebühr und reguläre Nutzung.
Eine riesige Versorgungskiste ist angekommen.
Die Logistik des nächsten Jahres bleibt trotzdem offen.
7. Der echte Benchmark ist erledigte Arbeit geteilt durch Geld und Wartezeit
Heavy User sollten messen:
- brauchbare fertige Aufgaben pro Stunde;
- fertige Aufgaben pro 1% Nutzung;
- fertige Aufgaben pro Dollar;
- menschliche Korrekturzeit;
- verlorene Zeit durch Capacity, Retries und Modellwechsel;
- Anteil langer Aufgaben, die ohne Unterbrechung fertig werden.
Eine praktische Formel:
Effektiver Wert = brauchbare fertige Arbeit / (Abo + Zusatzkosten + menschliche Korrektur + Warte- und Retry-Kosten)
Ein KI-Abo ist eher ein Elektrowerkzeug als ein Luxuswein.
Maximale Leistung zählt, aber Akku, Hitzestopp und die Frage, ob das Gerät beim Drücken des Schalters überhaupt anspringt, zählen genauso.
8. Claude wirkt heute wie der bessere Hauptarbeiter – trotzdem brauchen Nutzer OpenAI im Preiskampf
Eine Beobachtung beweist nicht, dass Claude jeden Workload gewinnt.
GPT-6.1 Sol bietet ungefähr 1,05 Millionen Tokens Kontext, das OpenAI-Tool-Ökosystem und deutlich niedrigere API-Preise als GPT-6 Astra. OpenAI positioniert das Modell als near-Astra-Leistung für komplexe Arbeit zu niedrigeren Kosten.
Das Problem ist nicht ein schlechtes Modell.
Das Problem ist die Gesamtökonomie des Abos.
Wenn Claude schneller fertig wird, sichtbar weniger Nutzung verbraucht und ChatGPT zusätzlich Capacity-Wartezeiten zeigt, während das $200-Angebot schrumpft, ist eine Verlagerung der Hauptarbeit zu Claude logisch.
Aber ein vollständiger Rückzug OpenAIs aus dem Wettbewerb wäre ebenfalls schlecht.
Ohne starken Wettbewerb hätte Anthropic weniger Druck, die heutigen großzügigen Max-Limits zu halten. Anthropic schreibt selbst, dass zusätzliche Wochen-, Monats-, Modell- oder Feature-Limits zur Capacity-Steuerung möglich sind.
Für Kunden ist nicht die ewige Großzügigkeit eines Unternehmens ideal.
Ideal ist dauernder Preis-Leistungs-Wettbewerb.
Fazit
In dieser Beobachtung wirkt Claude Opus 5.5 bei langen Aufgaben hinsichtlich Durchsatz und sichtbarer Nutzungseffizienz klar stärker.
31% gegen 3% ist wegen unterschiedlicher Nenner kein universeller 10,3x-Beweis.
Zusammen mit der Veränderung von Pro $200, den temporären 62.500 Credits und einer realen Capacity-Wartezeit wird die richtige Kennzahl jedoch deutlich:
Wie viel brauchbare Arbeit wird bis Monatsende fertig – und wie lange muss man dafür warten?
Ein starkes Claude ist gut.
Ein kämpfendes OpenAI ist ebenfalls gut.
Wenn nur ein echter Sieger bleibt, könnte die nächste „Optimierung“ den Geldbeutel der Nutzer treffen.
KI-Unternehmen: Bitte führt den Preiskampf friedlich, aber maximal hart weiter.
Quellen, geprüft am 30. September 2026
- https://help.openai.com/en/articles/9793128-about-chatgpt-pro-tiers
- https://help-lb.openai.com/en/articles/9793128-about-chatgpt-pro-tiers
- https://developers.openai.com/api/docs/models/gpt-6.1-sol
- https://www.anthropic.com/claude-opus-5-5
- https://support.claude.com/en/articles/11049741-what-is-the-max-plan
- https://community.openai.com/t/request-for-account-review-pro20x-subscription-experiencing-capacity-errors-and-significant-performance-degradation/1400068
- https://www.businessinsider.com/chatgpt-new-plan-pro-500-cost-compute-allowance-2026-9
