GPT-5.6 Sol Ultra erreicht 91,9 % bei Terminal-Bench 2.1 — und es landet in Codex

6. Juli 2026, 12:04

OpenAI’s neue Flaggschiff, GPT-5.6 Sol, ist ein Reasoning-Modell, das für agentisches Coding entwickelt wurde, und hat gerade einen neuen SOTA auf Terminal-Bench 2.1 gesetzt — den Benchmark, der Planung, Iteration und das Jonglieren mit Werkzeugen in einer echten Befehlszeile misst. Basis-Sol erreicht 88,8 %. Die „Sol Ultra“-Konfiguration steigert das auf 91,9 %, vor Claude Mythos 5 (84,3 %) und Gemini 3.1 Pro Preview (70,7 %).

Zwei Dinge sind tatsächlich neu. Ein max reasoning effort-Modus lässt das Modell bei schwierigen Problemen länger nachdenken. Und ultra-Modus setzt Subagenten ein, um Arbeit parallel auszuführen, und übertrifft damit, was ein einzelner Agent leisten kann. Letzteres ist der Grund, warum Entwickler interessiert sind: Ein Tweet mit dem Text „GPT-5.6 Sol Ultra will in Codex sein“ erreichte heute 287 Punkte auf HackerNews.

Was Sie tatsächlich damit tun können

Sol läuft über die API und innerhalb von Codex, sodass die Multi-Agent-Ausführung von ultra Ihr Coding-Assistent wird. Preis: 5 $ Eingabe / 30 $ Ausgabe pro Million Token.

Der Haken

Es ist eine gesperrte Vorschau — nur für etwa 20 von der Regierung geprüfte Organisationen. OpenAI hat die Veröffentlichungspläne zuerst mit der US‑Regierung abgestimmt. Alle anderen müssen warten.