AI 뉴스 2026년 6월 3일

Codex 유출 해부: 유령 모델 GPT-5.6과 iris-alpha 카나리

NodeMac 팀

약 12분

2026년 4월 GPT-5.5 출시 약 3주 후, 개발자들이 OpenAI Codex 백엔드 로그를 검토하다 이상 징후를 발견했다. 대부분의 rollout 매핑은 gpt-5.5를 가리키지만, 최소 한 항목은 gpt-5.6으로 라우팅되었다. 연구자 Haider4월 28일경 이상을 보고했고, 해당 항목은 이후 세션 파일에서 사라졌다. 커뮤니티는 체크포인트를 내부 코드명 iris-alpha와 연결했다(ember-alpha, beacon-alpha 등의 소문 태그 포함). OpenAI는 GPT-5.6을 공식 확인하지 않았다.

이것은 제품 출시가 아니라 카나리 유출이다. 실험 빌드가 Codex rollout 인프라에 존재했고 잠시 실제 트래픽을 받았다는 증거다. 미출시 모델 라우팅을 추적하는 인디 해커에게 핵심은 오늘 재현 가능한 로그 라인과 소문의 구분이다. 본 트래커는 확인된 신호와 Polymarket 과장을 분리하고, WaveSpeed 유출 요약을 인용하며 검증 런북을 제공한다——NodeMac 홍보는 최소화.

GPT-5.6 iris-alpha Codex 라우팅 유출 트래커 2026
공개: NodeMac은 Mac 자동화 가이드를 발행한다. 본 문서는 공개 보도된 유출 신호를 분석한다. 이름·한도·날짜는 OpenAI가 system card를 게시할 때까지 변경될 수 있다. 소문 라벨: openai.com/index에 없는 내용은 보도·커뮤니티·추측으로 표시. Polymarket은 시장 기대일 뿐이며 공식 확인이 아니다.

유출 타임라인: 2026년 4–6월

날짜(2026)이벤트출처 등급
~4월 23일GPT-5.5 공개 출시; Codex가 최강 에이전트 코딩 표면OpenAI 공식
4월 28일Haider가 Codex 라우팅에서 1건 → gpt-5.6 확인; 이후 소실개발자 보고
4월 30일GPT-5.5 보상 셰이핑 사후 분석(goblin)OpenAI 공식
5월 초Pro OAuth가 gpt-5.6 프로브; 1.5M 컨텍스트 주장커뮤니티——미확인
5월 13일Polymarket 6월 30일까지 공개 GPT-5.6 확률 약 89%예측 시장——사실 아님
6월 3일공개 model card 없음; 디렉터리에 gpt-5.6 없음오늘 관측 가능

인용 가능: 단일 라우팅 맵 문자열은 Codex rollout에 실행 가능 아티팩트가 있었음을 증명한다——파라미터 수·가격·GA 시점이 아니다.

증거 매트릭스: 확인 vs 소문

주장상태반증 조건
gpt-5.6이 Codex rollout 로그에 등장보도됨, 잠시 재현 가능OpenAI 부인 + 추가 목격 없음
내부 코드명 iris-alpha커뮤니티 귀속——OpenAI 문서 없음공식 card가 다른 내부명 사용
150만 토큰 컨텍스트 창Pro OAuth 프로브 소문system card가 더 낮은 한도 기재
ember-alpha / beacon-alpha 변종소문——다중 체크포인트 태그출시 시 단일 공개 SKU
2026년 6월 출시 창추측(Polymarket + 블로그)6월 30일 이후에도 공지 없음
goblin RL 수정으로 단축된 주기애널리스트 추론GPT-5.6 card가 보상 감사 침묵

system card가 나올 때까지 비-OpenAI 숫자는 가설로 취급한다.

Codex 카나리 라우팅이 모델명을 유출하는 방식

OpenAI Codex는 rollout 매핑 계층으로 추론을 라우팅한다——프로덕션 트래픽의 일부가 실험 빌드로 분기될 수 있다.

User prompt (Codex CLI / IDE / OAuth)
    → Codex API gateway
    → Rollout mapper (e.g. 99.9% → gpt-5.5, 0.1% → gpt-5.6-canary)
    → Inference cluster
    → Response + internal session logs (mapping visible to operators/debuggers)

세션보내기에 매퍼 출력이 포함되면 단일 카나리 로그가 미출시 SKU를 노출한다——Haider는 마케팅보다 「버그에 가깝다」고 했다. 이후 로그가 gpt-5.5만 보이면 카나리 철수 또는 로그 편집 가능성.

OpenAI 호환 엔드포인트와 함께 Hermes Agent 멀티디바이스 게이트웨이 설정 또는 Open WebUI 로컬 지식 베이스 설정를 사용한다면 명시적 모델 ID(gpt-5.5, -latest 아님)를 고정해 조용한 승격이 하룻밤에 프로덕션을 바꾸지 못하게 한다.

goblin 사건: 주기가 압축될 수 있는 이유

2026년 4월 30일, OpenAI는 GPT-5.5 보상 셰이핑 실패를 기록했다. 「Nerdy」 페르소나(ChatGPT 트래픽 약 2.5%)가 평가 슬라이스에서 goblin 언급을 기준선 대비 +3,881% 급증시켰고, 오염 rollout이 SFT 데이터로 재활용되었다.

애널리스트(WaveSpeed 포함)는 5.5 출시 3주 후 gpt-5.6 카나리가 보상 감사 파이프라인 수정을 겨냥할 수 있다고 본다——기반 재구축이 아니다. 이는 애널리스트 추론이며 OpenAI 확인이 아니다.

지표참고
Nerdy 페르소나 트래픽~2.5%OpenAI 4월 30일 사후 분석
Goblin 언급 급증+3,881%동일
Codex 완화생물어 사중 system block긴급 패치
GPT-5.6 카나리 해석보상 감사, 신규 기반 아님WaveSpeed——소문
오늘의 조치gpt-5.5 고정; 턴마다 모델 ID 기록가드레일
신뢰 금지Polymarket 89%를 내부 정보로센티먼트만

iris-alpha가 출시할 수 있는 것(현실적 기대)

  • 안정적인 Codex CI가 필요하면 system card에 gpt-5.6이 나올 때까지 gpt-5.5를 고정해야 한다.
  • 카나리 품질을 평가한다면 GPT-5.5 홀드아웃 벤치마크를 유지해야 한다——감으로 판단하지 말 것.
  • iris-alpha가 페르소나 제어를 복구한다면 prompt 패치가 아닌 구조적 RL 수정으로 취급해야 한다.
영역현실적 기대무시할 과장
코딩 / 에이전트GPT-5.5 대비 점진적 개선「100배 더 좋다」 제목
컨텍스트공식 한도 대기확인 전 1.5M
UI 코드 생성더 깔끔한 레이아웃(보도)단일 스크린샷
가격소폭 인상 가능무료 티어 업그레이드 소문
아키텍처동일 계열, 더 엄격한 RL「새 패러다임」 수사

빌더 런북: 전환 전 검증

1

프로덕션 모델 ID 고정——대시보드의 정확한 gpt-5.5 사용, -latest 별칭 금지.

curl https://api.openai.com/v1/chat/completions \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -d '{"model":"gpt-5.5","messages":[{"role":"user","content":"ping"}]}'

2

Codex 세션 로그 아카이브 후 rollout 매핑 grep. 날짜·파일 해시·지속성 기록——Haider 라인은 일시적이었다.

grep -E 'gpt-5\.[56]|iris-alpha|ember-alpha|beacon-alpha' ~/.codex/logs/*.json 2>/dev/null || true

3

GPT-5.5에서 goblin 빈도 기준선 실행——N≥500 완성 샘플; 생물어 비율 >0.5%는 패치 누출 시사; gpt-5.6 GA 시 재사용.

4

평가 하네스 준비——GPT-5.5 프롬프트와 JSON schema 출력 저장; gpt-5.6 첫날 동일하게 재실행. 솔로프레너를 위한 Hermes 서브에이전트 위임와 함께 서브에이전트별 모델 버전 기록.

5

공식 채널 모니터링——모델 디렉터리, system card PDF, Codex changelog, API 릴리스 노트.

6

예측 시장을 회의적으로 추적——6월 30일까지 Polymarket 89%는 군중 센티먼트이지 내부 확인이 아니다.

7

롤백 정책 설정——조용한 승격 후 24시간 내 오류율 또는 토큰 비용 >15% 급증 시 즉시 되돌림.

8

소문 엔드포인트에서 프로덕션 트래픽 금지——Pro OAuth 프로브는 ToS 민감; 공식 beta 대기.

상시 가동 Mac 또는 Linux에서 평가 실행——로그 grep에 클라우드 GPU 불필요. Mac mini 사양은 16 GB 통합 메모리를 기재하며 원격 API 오케스트레이션에 적합하다.

유출 오정보 문제 해결

스크린샷은 gpt-5.6인데 API는 model not supported

증상: 소셜 게시물은 접근 가능 주장; 호출은 실패.

해결: 카나리 슬롯은 계정·시간 종속. HTTP 응답, 타임스탬프, OAuth scope 기록——한 사용자가 GA가 아니다.

컨텍스트 한도 충돌(400K vs 1.05M vs 1.5M)

증상: 스레드마다 의견 상이.

해결: GPT-5.5는 표면마다 다름. 사용 표면의 공식 model card만 신뢰.

모든 소문이 iris-alpha를 확정으로 인용

증상: 블로그가 코드명을 사실로 기재.

해결: iris-alpha는 커뮤니티 매핑——OpenAI 미공개. 「보도된 내부 태그」로 인용.

2026년 6월까지 주시할 신호

  1. 카나리 로그 라인 반복——일회성 버그는 드물게 반복된다.
  2. goblin 사후 분석 이후 두 번째 OpenAI 정렬 게시.
  3. GPT-5.5 system card와 deployment hub 항목 동시 게시.
  4. Codex CLI --model 기본 문자열 변경.
  5. Dev Day 또는 공식 블로그가 어떤 유출 집계보다 우선.

로컬에서 모델을 고정한 뒤 상시 가동 호스트에서 평가 자동화:

새 모델 drop에 대해 상시 가동 Mac에서 평가 하네스를 실행하려면? NodeMac은 SSH 벤치마크 재생용 전용 Apple Silicon 호스트를 선택 제공——로그 grep에 렌탈 불필요.

FAQ

OpenAI가 GPT-5.6 또는 iris-alpha를 공식 확인했나요?

2026년 6월 3일 기준 공식 확인은 없습니다. 증거는 보고된 Codex 라우팅 로그, 커뮤니티 탐색, 언론 집계에 한정되며 model card가 아닙니다.

Haider는 누구이며 4월 28일 로그를 왜 신뢰하나요?

Haider는 Codex 롤아웃 로그의 gpt-5.6 매핑 이상을 최초로 공개했으며 카나리 또는 버그일 가능성이 높다고 했습니다. 방법(grep + 재현 윈도우)을 신뢰하고 개인 숭배는 피하세요.

iris-alpha와 gpt-5.6의 차이는?

커뮤니티는 iris-alpha를 내부 체크포인트 코드명, gpt-5.6을 라우팅 맵의 사용자 SKU로 매핑합니다. OpenAI가 명명을 문서화할 때까지 동일 빌드인지 불명확합니다.

GPT-5.6이 -latest 별칭으로 GPT-5.5를 조용히 대체하나요?

롤링 별칭은 명시적 옵트인 없이 마이너 버전을 승격시킨 전례가 있습니다. 평가 완료 전까지 프로덕션에서 명시적 버전 문자열을 고정하세요.

고블린 버그는 GPT-5.6이 단순 패치라는 뜻인가요?

고블린 사건은 SFT 주기 전반의 보상 오염을 보여줍니다. 빠른 gpt-5.6 카나리는 보상 감사 수정을 겨냥할 수 있으나 OpenAI는 출시 내용을 밝히지 않았습니다.

새 모델 drop 시 eval harness용 상시 Mac이 필요하신가요?

Optional dedicated Apple Silicon Macs with SSH for benchmark replay—log grep works anywhere.

NM
NodeMac Cloud Mac
5-min deployment

Rent a dedicated Apple Silicon Mac. SSH/VNC, HK·JP·SG·KO·US nodes.

Get Started