Etwa drei Wochen nach dem GPT-5.5-Release im April 2026 fiel Entwicklern beim Durchsuchen der OpenAI Codex-Backend-Logs etwas auf: Die meisten Rollout-Mappings zeigten auf gpt-5.5, mindestens ein Eintrag jedoch auf gpt-5.6. Der Forscher Haider meldete die Anomalie um den 28. April; die Zeile verschwand aus späteren Sitzungsdateien. Community-Threads verknüpften den Checkpoint mit dem internen Codenamen iris-alpha (neben Tags wie ember-alpha und beacon-alpha). OpenAI hat GPT-5.6 nicht offiziell bestätigt.
Das ist kein Produktlaunch — es ist ein Canary-Leak: Beleg, dass ein experimenteller Build in der Codex-Rollout-Infrastruktur existierte und kurz echten Traffic annahm. Für Indie-Hacker, die unveröffentlichtes Modell-Routing verfolgen, zählt welche Log-Zeilen heute reproduzierbar sind versus Gerüchte. Dieser Tracker trennt bestätigte Signale von Polymarket-Hype, zitiert die WaveSpeed-Zusammenfassung und liefert ein Verifikations-Runbook — minimale NodeMac-Werbung.
Leak-Zeitleiste: April–Juni 2026
| Datum (2026) | Ereignis | Quellenebene |
|---|---|---|
| ~23. Apr. | GPT-5.5 öffentlich; Codex als stärkste agentische Coding-Oberfläche | OpenAI offiziell |
| 28. Apr. | Haider sieht einen Codex-Routing-Eintrag → gpt-5.6; verschwindet später | Entwicklerbericht |
| 30. Apr. | OpenAI-Post-Mortem zu GPT-5.5 Reward-Shaping (Goblins) | OpenAI offiziell |
| Anfang Mai | Pro-OAuth-Probes auf gpt-5.6; einige behaupten 1,5M Kontext | Community — unbestätigt |
| 13. Mai | Polymarket ~89 % Chance öffentliches GPT-5.6 bis 30. Juni | Prognosemarkt — keine Ground Truth |
| 3. Juni | Keine öffentliche Modellkarte; gpt-5.6 fehlt im Verzeichnis | Heute beobachtbar |
Zitierbar: Eine einzelne Routing-Map-Zeichenkette beweist ein lauffähiges Artefakt im Codex-Rollout — nicht Parameterzahl, Preis oder GA-Timing.
Evidenzmatrix: bestätigt vs. Gerücht
| Behauptung | Status | Was sie widerlegen würde |
|---|---|---|
| gpt-5.6 in Codex-Rollout-Logs | Gemeldet, kurz reproduzierbar | OpenAI-Leugnung + keine weiteren Sichtungen |
| Interner Codename iris-alpha | Community-Zuordnung — nicht in OpenAI-Docs | Offizielle Karte nutzt anderen internen Namen |
| 1,5M-Token-Kontextfenster | Gerücht aus Pro-OAuth-Probes | System Card listet niedrigeres Limit |
| ember-alpha / beacon-alpha Varianten | Gerücht — mehrere Checkpoint-Tags | Nur ein öffentlicher SKU beim Launch |
| Juni-2026-Ship-Fenster | Spekulation (Polymarket + Blogs) | Verzug nach 30. Juni ohne Ankündigung |
| Schnellerer Zyklus durch Goblin-RL-Fix | Analysten-Inferenz | GPT-5.6-Karte schweigt zu Reward-Audit |
Behandeln Sie Nicht-OpenAI-Zahlen als Hypothese, bis eine System Card erscheint.
Wie Codex-Canary-Routing Modellnamen leakt
OpenAI Codex routet Inferenz über eine Rollout-Mapping-Schicht — Produktionstraffic kann gesplittet werden, sodass ein kleiner Prozentsatz experimentelle Builds trifft.
User prompt (Codex CLI / IDE / OAuth)
→ Codex API gateway
→ Rollout mapper (e.g. 99.9% → gpt-5.5, 0.1% → gpt-5.6-canary)
→ Inference cluster
→ Response + internal session logs (mapping visible to operators/debuggers)
Enthalten Session-Exports Mapper-Ausgabe, legt eine einzelne geloggte Canary-Zeile ein unveröffentlichtes SKU offen — Haider nannte es „eher ein Bug“ als Marketing. Spätere Logs nur mit gpt-5.5 deuten auf Canary-Rückzug oder Log-Redaktion.
Nutzen Sie bei OpenAI-kompatiblen Endpoints Hermes Agent Mehrgeräte-Gateway-Einrichtung oder Lokale Open WebUI-Wissensbasis, pinnen Sie explizite Modell-IDs (gpt-5.5, nicht -latest), damit stille Promotion die Produktion nicht über Nacht umschreibt.
Der Goblin-Vorfall: warum der Zyklus komprimiert sein kann
Am 30. April 2026 dokumentierte OpenAI ein Reward-Shaping-Versagen bei GPT-5.5: Die „Nerdy“-Persona (~2,5 % des ChatGPT-Traffics) verursachte einen Goblin-Erwähnungs-Spike von +3.881 % vs. Baseline in Eval-Slices, kontaminierte Rollouts wurden in SFT-Daten recycelt.
Analysten (inkl. WaveSpeed) argumentieren, dass Canary-Traffic zu gpt-5.6 drei Wochen nach 5.5 Reward-Audit-Pipeline-Fixes anvisiert — kein Foundation-Rebuild. Das ist Analysten-Inferenz, keine OpenAI-Bestätigung.
| Metrik | Wert | Referenz |
|---|---|---|
| Nerdy-Persona-Traffic | ~2,5 % | OpenAI-Post-Mortem 30. Apr. |
| Goblin-Erwähnungs-Spike | +3.881 % | Dasselbe |
| Codex-Mitigation | Vierfacher System-Block auf Kreaturwörter | Notfall-Patch |
| GPT-5.6-Canary-Deutung | Reward-Audit, keine neue Foundation | WaveSpeed — Gerücht |
| Aktion heute | gpt-5.5 pinnen; Modell-ID pro Turn loggen | Leitplanke |
| Nicht vertrauen | Polymarket 89 % als Insider-Info | Nur Sentiment |
Was iris-alpha liefern könnte (geerdete Erwartungen)
- Wenn Sie stabiles Codex-CI brauchen, bleiben Sie auf gepinntem
gpt-5.5, bis eine System Cardgpt-5.6listet. - Wenn Sie Canary-Qualität evaluieren, behalten Sie ein GPT-5.5-Holdout-Benchmark — keine Vibe-Checks.
- Wenn iris-alpha Persona-Kontrollen wiederherstellt, behandeln Sie das als strukturelle RL-Fixes, nicht nur Prompt-Patches.
| Bereich | Geerdete Erwartung | Hype ignorieren |
|---|---|---|
| Coding / Agents | Inkrementell über GPT-5.5 | „100× besser“-Titel |
| Kontext | Offizielles Limit abwarten | 1,5M bis bestätigt |
| UI-Codegen | Sauberere Layouts (Berichte) | Einzelne Screenshots |
| Preis | Wahrscheinlich kleiner Anstieg | Free-Tier-Upgrade-Gerüchte |
| Architektur | Gleiche Familie, strafferes RL | „Neues Paradigma“-Rhetorik |
Builder-Runbook: vor dem Wechsel verifizieren
1
Produktions-Modell-ID pinnen — exaktes gpt-5.5 aus dem Dashboard, keine -latest-Aliase.
curl https://api.openai.com/v1/chat/completions \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-d '{"model":"gpt-5.5","messages":[{"role":"user","content":"ping"}]}'
2
Codex-Sitzungslogs archivieren und Rollout-Mappings greppen. Datum, Datei-Hash und Persistenz dokumentieren — Haider-Zeile war ephemer.
grep -E 'gpt-5\.[56]|iris-alpha|ember-alpha|beacon-alpha' ~/.codex/logs/*.json 2>/dev/null || true
3
Goblin-Frequenz-Baseline auf GPT-5.5 — N≥500 Completions sampeln; Kreaturwort-Rate >0,5 % deutet Patch-Leakage; bei gpt-5.6-GA wiederverwenden.
4
Eval-Harness vorbereiten — GPT-5.5-Prompts + JSON-Schema-Outputs speichern; am Tag eins von gpt-5.6 unverändert rerun. Mit Hermes Subagenten-Delegation für Solopreneure Modellversion pro Subagent loggen.
5
Offizielle Oberflächen beobachten — Modellverzeichnis, System-Card-PDF, Codex-Changelog, API-Release-Notes.
6
Prognosemärkte skeptisch verfolgen — Polymarket 89 % bis 30. Juni ist Crowd-Sentiment, keine Insider-Bestätigung.
7
Rollback-Policy setzen — bei Fehlerrate oder Token-Kosten >15 % innerhalb 24 h nach stiller Promotion zurückrollen.
8
Kein Produktionstraffic auf Gerüchte-Endpoints — Pro-OAuth-Probes sind ToS-sensitiv; offizielle Beta abwarten.
Eval auf einem Always-on-Mac oder Linux — Log-Grep braucht keine Cloud-GPU. Mac-mini-Spezifikationen listen 16 GB Unified Memory für Remote-API-Orchestrierung.
Fehlinformationen zu Leaks beheben
Screenshot zeigt gpt-5.6, API liefert model not supported
Symptom: Social Post behauptet Zugang; Ihr Call scheitert.
Fix: Canary-Slots sind konto- und zeitgebunden. HTTP-Antwort, Zeitstempel, OAuth-Scope erfassen — ein Nutzer ist nicht GA.
Widersprüchliche Kontextlimits (400K vs. 1,05M vs. 1,5M)
Symptom: Threads widersprechen sich.
Fix: GPT-5.5 unterscheidet sich je Oberfläche. Nur die offizielle Modellkarte Ihrer Oberfläche vertrauen.
Jedes Gerücht zitiert iris-alpha als bestätigt
Symptom: Blogs nennen Codename als Fakt.
Fix: iris-alpha ist Community-Mapping — nicht OpenAI-veröffentlicht. Als „gemeldeter interner Tag“ zitieren.
Signale bis Juni 2026 beobachten
- Wiederholte Canary-Log-Zeilen — einmalige Bugs wiederholen sich selten.
- Zweiter OpenAI-Alignment-Post nach dem Goblin-Post-Mortem.
- System Card + Deployment-Hub-Eintrag gemeinsam für GPT-5.5 veröffentlicht.
- Codex-CLI-
--model-Default-String ändert sich. - Dev Day oder offizieller Blog schlägt jeden Leak-Aggregator.
Weiterführende Lektüre
Modelle lokal pinnen, dann Eval auf einem Always-on-Host automatisieren:
- Hermes Agent Mehrgeräte-Gateway-Einrichtung
- Lokale Open WebUI-Wissensbasis
- Hermes Subagenten-Delegation für Solopreneure
Brauchen Sie einen Always-on-Mac für Eval-Harnesses bei neuen Model-Drops? NodeMac bietet optionale dedizierte Apple-Silicon-Hosts für SSH-Benchmark-Replay — Log-Grep erfordert keine Miete.
FAQ
Hat OpenAI GPT-5.6 oder iris-alpha bestätigt?
Keine offizielle Bestätigung zum 3. Juni 2026. Belege beschränken sich auf gemeldete Codex-Routing-Logs, Community-Probes und Presse — keine Modellkarte.
Wer ist Haider und warum dem 28.-April-Log vertrauen?
Haider veröffentlichte zuerst die gpt-5.6-Mapping-Anomalie in Codex-Rollout-Logs und nannte sie wahrscheinlich einen Canary oder Bug. Vertrauen Sie der Methode (grep + Reproduzierbarkeitsfenster), nicht Heldenverehrung.
Was ist der Unterschied zwischen iris-alpha und gpt-5.6?
Die Community ordnet iris-alpha einem internen Checkpoint-Namen zu und gpt-5.6 der SKU in Routing-Maps. OpenAI hat die Benennung nicht dokumentiert.
Ersetzt GPT-5.6 GPT-5.5 still über -latest-Aliase?
Rolling-Aliase haben schon Minor-Versionen ohne explizites Opt-in befördert. Pinnen Sie Versionsstrings in der Produktion bis die Evaluierung abgeschlossen ist.
Bedeutet der Goblin-Bug, dass GPT-5.6 nur ein Patch ist?
Der Goblin-Vorfall zeigt Reward-Kontamination über SFT-Zyklen. Ein schneller GPT-5.6-Canary kann Reward-Audit-Fixes anvisieren, aber OpenAI hat den Inhalt nicht genannt — keine magischen Benchmark-Verdopplungen.