OpenAI 預覽 GPT-5.6 Sol、Terra、Luna——存取權卡在美國政府審查之後
為什麼值得讀 模型已就緒,政策卻還沒跟上。前沿模型發布卡在政府審批而非 OpenAI 產能上,這是開發者該預期會再次看到的新治理模式。
OpenAI 於 6 月 26 日發布 GPT-5.6 Sol/Terra/Luna——Sol 在 Terminal-Bench 2.1 拿下 91.9%,但存取權僅限約 20 家獲美國政府核准的合作夥伴。
為什麼值得讀 模型已就緒,政策卻還沒跟上。前沿模型發布卡在政府審批而非 OpenAI 產能上,這是開發者該預期會再次看到的新治理模式。
OpenAI 於 6 月 26 日發布 GPT-5.6 Sol/Terra/Luna——Sol 在 Terminal-Bench 2.1 拿下 91.9%,但存取權僅限約 20 家獲美國政府核准的合作夥伴。
為什麼值得讀 代理式編程的競爭,重心已從模型品質轉向執行環境。OpenAI 買下的是那些枯燥而困難的基礎設施——持久性、沙箱、稽核——它們才能把聰明的代理變成可部署的代理。
OpenAI 收購 Ona——前身為 Gitpod 的雲端開發環境公司——讓 Codex 代理能在持久、由客戶掌控、可稽核的環境中執行更長時間的任務。
為什麼值得讀 一個大型平台擁有者推出自家推理模型,並公開將其框定為少付 OpenAI 費用的途徑,這是一個結構性的故事,而不只是一次產品發布——它為整個前沿模型供應鏈重新定價。
在 6 月 2 日的 Build 2026 上,微軟發布七款從零打造的 MAI 模型,由推理模型 MAI-Thinking-1 領銜,以降低成本並減少對 OpenAI 的依賴。
為什麼值得讀 機密 S-1 是上路引道,而非承諾。但在跨越約 500 億美元年化營收的同一年遞件,已把 Anthropic 從研究實驗室重新定位為公開市場規模的企業軟體廠商,與 OpenAI 競逐掛牌窗口。
Anthropic 於 2026 年 6 月 1 日以 9,650 億美元估值向 SEC 機密遞交 S-1 草案,年化營收逼近 500 億美元。
為什麼值得讀 標題是「AI 會做數學」。真正的訊號是:它出自一個通用推理模型,而非數學專用系統——並以建構出 80 年來無人找到的反例來推翻舊有信念。一個結果不算革命,但「通用性」才是重點。
OpenAI 表示一個內部推理模型自主推翻了 Erdős 1946 年的單位距離猜想(5/20)——AI 首例,並經數學家獨立驗證。
為什麼值得讀 「小國作為中立地」是浮現中的劇本。新加坡同時從 OpenAI 與 Google 收集承諾,靠的是成為「美國實驗室能在亞洲擴張、又無中國曝險陰影」的司法管轄區。預期更多中型國家競逐這個角色。
ATxSummit:OpenAI 簽首份新加坡 MoU —— 約 $2.34 億設美國外首個應用 AI 實驗室,團隊擴至 200+。Google 升級為 National AI Partnership。
為什麼值得讀 Codex 不再與 Claude Code 比模型品質——比的是 agent 人因。行動端介面是 2026 年第一個真正新的開發工具 UX。
ChatGPT 手機 app 現可連到跑 Codex 的 Mac,檔案、憑證、外掛、技能同步。Hooks 進入 GA,新 Access Tokens 上線。
OpenAI Deployment Company(DeployCo)5/11 推出 — $40 億合資公司,TPG、Advent、Bain、Brookfield 領投,$100 億投後估值。收購 Tomoro(倫敦約 150 名 FDE)負責企業推展。
GPT-5.5 與 GPT-5.5 Pro 4/23 在 ChatGPT 與 Codex 上線,4/24 釋出 API。OpenAI 列 Terminal-Bench 2.0 82.7%,並在 FrontierMath 超越 Opus 4.7。