3 Min. Lesezeit

GPT-6.1 Sol: Ultrafast verändert die Codex-Ökonomie

GPT-6.1 SolCodexUltrafast

OpenAI stellte GPT-6.1 Sol, die Geschwindigkeitsstufe Ultrafast, Decisions API und ein Open-Source-Codex-Harness vor. Ultrafast verspricht bis zu 300 Token pro Sekunde und schnellere Codex-Generierung, kostet aber das Sechsfache des Standard-API-Tarifs, ist zunächst nur begrenzt verfügbar und bestätigt keine Preissenkung um 95 Prozent.

Was OpenAI zu GPT-6.1 Sol und Codex hinzufügt

Ich würde diesen Release nicht auf eine weitere Beschleunigung des Modells reduzieren. In der DevDay-2026-Übersicht und den Referenzmaterialien von ChatGPT Learn beschreibt OpenAI mehrere zusammenhängende Änderungen: GPT-6.1 Sol, die Geschwindigkeitsstufen Fast und Ultrafast, Decisions API sowie ein Open-Source-Codex-Harness.

Die zentrale Zahl bei Ultrafast lautet: bis zu 300 Token pro Sekunde und eine bis zu achtmal schnellere Generierung in Codex. Für die API wird eine Beschleunigung um bis zu das Sechsfache genannt. Das ist jedoch Generierungsdurchsatz und kein Versprechen, dass eine vollständige Aufgabe ebenso viel schneller abgeschlossen wird.

Auch beim Preis geht es nicht um Dumping. Zum Start kostete Ultrafast das Sechsfache des Standard-API-Tarifs. Die in Diskussionen auftauchende Behauptung einer Preissenkung um 95 Prozent wird daher nicht durch offizielle OpenAI-Materialien gestützt.

Bei der Verfügbarkeit gibt es eine wichtige Einschränkung. GPT-6.1 Sol ist für Plus-, Pro-, Business-, Enterprise- und Edu-Nutzer in ChatGPT Work und Codex angekündigt, während Ultrafast-Unterstützung für Sol erst später folgen soll. Die Ultrafast-Stufe richtete sich zum Start an Pro-Abonnenten für 500 Dollar sowie geeignete Enterprise- und Edu-Workspaces, vorbehaltlich der Administratorberechtigungen.

Decisions API löst eine engere Aufgabe: Sie erhält eine Frage, eine begrenzte Auswahl an Optionen und Kontext und trifft dann eine Entscheidung. Es ist eine Schnittstelle für Routing, Klassifizierung und die Wahl des nächsten Schritts ohne unnötige freie Generierung. Das offene Codex-Harness erlaubt es wiederum, die Schicht zu untersuchen und anzupassen, die das Modell mit Arbeitsabläufen und Integrationen verbindet.

Warum mehr Geschwindigkeit nicht automatisch günstigere Entwicklung bedeutet

Ultrafast verändert die Rechnung tatsächlich dort, wo Latenz wichtiger ist als der Preis. Interaktive Codearbeit, kurze Fehlerbehebungszyklen und parallele Agentenaufgaben können von schnellerer Token-Ausgabe profitieren, selbst wenn jede Anfrage teurer wird.

Als Erstes würde ich nicht Token pro Sekunde, sondern die gesamte Bearbeitungszeit einer Aufgabe vergleichen. Planung, Tool-Aufrufe, Tests und Wiederholungsversuche verschwinden nicht. Wenn Generierung nur einen Teil des Zyklus einnimmt, kann ein angekündigter Achtfach-Gewinn leicht zu einem deutlich kleineren realen Vorteil werden.

Decisions API wirkt weniger spektakulär, kann aus Engineering-Sicht aber praktischer sein. Eine begrenzte Antwortmenge lässt sich leichter prüfen und in eine deterministische Pipeline integrieren. Es gibt weniger Magie, dafür einen klareren Vertrag und besser erkennbare Fehlerpunkte.

OpenAIs Strategie ist klar erkennbar: Ein Modell nach Latenzklassen segmentieren und für Dringlichkeit einen Aufpreis verlangen. Der eigentliche Test für Ultrafast beginnt dort, wo Generierungsgeschwindigkeit auf langsame Tools, lange Agentenschleifen und die tatsächlichen Kosten einer erledigten Aufgabe trifft.

Wir haben bereits den Rollout von OpenAIs Codex in ChatGPT für Android und dessen Bedeutung für Remote-Entwicklungsabläufe behandelt. Dieser Kontext hilft, die praktischen Folgen der jüngsten Codex-Updates bei Leistung und Preisen einzuordnen.