內網日誌意外流出!代號 iris-alpha:OpenAI 悄悄測試的 GPT-5.6 藏了什麼?(2026)
OpenAI Codex 後端路由日誌裡的一行記錄,行銷效果勝過一场發布会:幾乎所有請求都映射到 gpt-5.5,却有一段會話短暂映射到 gpt-5.6。開發者 Haider 約在 2026 年 4 月 28 日 發現;之後日誌中该條目消失。二次報稱內部代號如 iris-alpha(另有傳聞 ember-alpha、beacon-alpha)及 150 萬 token 探测——OpenAI 公開模型頁均未確認。
本文面向關注 API 路由、預測市场與對齊事後分析的開發者,區分日誌事實與發布炒作——而非產品發布稿。
为何一行路由日誌对 API 獵手重要
Codex 是 OpenAI 的智慧體程式入口——與 CLI 會話、OAuth 开发工具及決定線上流量的 rollout 映射同属一族。灰度名出现在此处通常意味著:
- 存在可運行檢查點(不僅是訓練运行名)
- 已接入生产 rollout 機制
- 評測流量在真实程式提示上测行為
这與傳聞推文不同,也不是發布公告。Haider 将首次 gpt-5.6 目擊形容为更接近故障或灰度滑漏,而非有意披露 (WaveSpeed 摘要)。
若你以跟蹤模型为生,请結合 Codex CLI 定價,弄清在 gpt-5.5 上今日成本,再面對可能的静默升級。
可引用定義:Codex 灰度洩露是路由表中短暂将一小部分線上或半線上流量指向未發布檢查點以作測量——映射糾正后即消失的條目。
Codex 路由日誌洩露解剖
| 信號 | 觀察到的內容 | 置信度 |
|---|---|---|
| 模型 ID | 灰度映射中出現 gpt-5.6,與主流 gpt-5.5 並存 | 高(多名開發者報告;曾短暫可復現) |
| 持續性 | 後續會話日誌中該條目被移除 | 高 |
代號 iris-alpha | 出現在二次洩露彙總(36Kr、TestingCatalog、AIScroll) | 中(OpenAI 文件未載) |
| 上下文 150 萬 | 開發者透過 Codex OAuth / OpenCode 探測聲稱 | 中(社群測量,非系統卡) |
| 2026 年 6 月發布 | Polymarket 約 89% 押注 6 月 30 日前(引自 2026-05-13) | 低–中(市場情緒,非 OpenAI 日程) |
ember-alpha / beacon-alpha | 部落客 Leo / WinCentral 摘要中的額外內部標籤 | 低(單源鏈條) |
時間線(公開重建)
- 2026 年 4 月下旬 — Haider 在 Codex 日誌中發現一处
gpt-5.6映射;视为灰度噪音。 - 2026 年 5 月上旬 — 更多開發者报告 OAuth 调用;部分先见
model is not supported,后用 Pro token 成功(社群报告)。 - 2026 年 5 月中旬 — 預測市场押注 6 月發布;科技媒體放大
iris-alpha代號。 - 2026 年 6 月(觀察視窗) — Dev Day / 夏季發布傳聞高峰;截至發稿無公開 OpenAI 模型卡。
外部參考:WaveSpeed 洩露梳理、TestingCatalog 150 萬上下文探测。
iris-alpha:代號可能意味著什么
OpenAI 很少評論內部代號。将 iris-alpha 视为灰度通道標籤,而非產品名:
- Iris — 光学/感知隐喻;或暗示多模態或“看見”代码/UI 上下文(推測)。
- Alpha — 预發布訓練线,非 GA 質質門檻。
- 並列標籤(
ember-alpha、beacon-alpha)— 若屬實,或表示程式/推理/长上下文配置的 A/B 灰度——非三个消費級 SKU。
何种信号可官方確認 iris-alpha?
- OpenAI 模型目錄出现
gpt-5.6 - 系統卡 + 部署安全中心頁面(GPT-5.5 曾一併發布)
- Codex CLI 默认版本升級并在發布說明中點名檢查點
在此之前,grep 日誌勝過標題黨。
哥布林背景:GPT-5.6 为何可能加速
洩露时点距 GPT-5.5 约三周,但動機故事更早。2026 年 4 月 30 日,OpenAI 發布 Where the Goblins Came From——关于 Nerdy 人格奖励塑形污染的復盤:
| 指標(OpenAI 事後分析) | 數值 |
|---|---|
| Nerdy 人格中 goblin 提及 vs GPT-5.2 基線 | +3,881% |
| 來自 Nerdy 人格的 goblin 提及占比 | 66.7% |
| 使用 Nerdy 人格的 ChatGPT 流量 | 2.5% |
| GPT-5.1 之後 goblin 提及增長 | +175% |
| RL 對 goblin/gremlin 輸出打更高分的資料集占比 | 76.2% |
機制:极小人格切片塑造奖励信号;高分“生物隐喻”补全回灌 SFT;行為在模型中全球化。OpenAI 于 2026 年 3 月 下架 Nerdy,并緊急在 Codex 系統提示中四次重複禁 goblin 规则。
開發者为何要關心: GPT-5.6 灰度流量或在测奖励稽核修復與人格隔離——不僅是 Terminal-Bench 多 5 分。路由字串看不見这些,却更能解釋壓縮的發布節奏,勝過“行銷要 6 月頭條”。
證據矩陣:真发货还是煙霧
| 說法 | 較可能為真 | 仍為傳聞 |
|---|---|---|
Codex 基礎設施中的實驗性 gpt-5.6 檢查點 | ✓ | |
| 2026 年 5 月公開 API GA | ✓ | |
| 首日所有用戶 150 萬上下文 | ✓(探測 ≠ 產品承諾) | |
| iris-alpha 是唯一內部名稱 | ✓(多標籤報告衝突) | |
| 三週內重大架構重寫 | ✓(節奏更像增量) | |
| 因 Polymarket 而 6 月 30 日發布 | ✓(預測市場常失誤) |
独立開發者: 在你信任的基准动起来之前,假定增量程式/智慧體提升——而非推特截圖。
構建者清单:GPT-5.6 GA 前六步
步骤 1 — 生产環境钉死显式模型 ID
在 Codex CLI 與 API 中使用 gpt-5.5(或你稽核过的版本串),勿用浮动 -latest 別名。静默升到灰度檢查點即洩露变故障。
步骤 2 — 本地記錄路由元数据
在 Codex 或兼容客户端开启详细/偵錯日誌。按請求保存 model、system_fingerprint 與路由头——你自己的灰度探测器。
步骤 3 — 对 GPT-5.5 做 goblin 频率稽核
抽样 500+ 条與奇幻無关的生产补全。若 goblin/gremlin/troll 密度超 0.5%,說明系統提示补丁后仍有可测漂移——供日后对比 GPT-5.6。
步骤 4 — 准备留出評測,而非体感
保留 20–50 个带通过/失败测试的真实倉庫任务。新模型上线首日重跑同一 harness——见 8B 智慧體调优,结构化評測勝過聊天截圖。
步骤 5 — 盯官方渠道,不只 X
關注:OpenAI 模型文档、系統卡、Codex 發布說明、奖励稽核第二篇博文(哥布林之後)。
步骤 6 — 設置 2026 年 6 月提醒栈
日历提醒 OpenAI Dev Day / 夏季活动;Polymarket 仅作情绪參考,非 CI 觸發器。
2026 年 6 月值得關注的信号
- 重複出现的灰度映射(評測常态化后洩露会疊加)
- 系統卡出现“奖励校准”或人格隔離新表述
- CLI
--version中 Codex 默认版本抬升 - 定價页变化(OpenAI 很少立刻為小版本調價——不变也是信号)