GPT-5.6 Sol/Terra/Luna 完整解讀

:三版本差在哪?你該用哪個?
一句話總結: OpenAI 在 7/9 正式推出 GPT-5.6 系列,捨棄過去單一模型策略,改為三個定位明確的版本——Sol(旗艦)、Terra(日常)、Luna(輕量)。Terra 效能逼近上一代 GPT-5.5 但價格砍半,Luna 是最便宜的選擇。這篇幫你搞懂三者的差別。
GPT-5.6 是什麼?為什麼一次出三個版本?
GPT-5.6 是 OpenAI 在 7/9 正式發布的新一代模型系列。最大的變化不是「變得更聰明」,而是 OpenAI 第一次在同一代號下推出三個定位不同的版本。
過去 OpenAI 的命名方式很混亂:GPT-5.5、GPT-5.4、o1、o3 各自獨立。這次他們統一了規則——數字代表世代,名字代表能力等級,以後 Sol、Terra、Luna 各自獨立進化。
三個版本從強到弱:
| 版本 | 命名由來 | 定位 | 一句話 |
|---|---|---|---|
| Sol | 太陽 | 旗艦級 | 最強推理 + Agent 任務,適合複雜工程 |
| Terra | 地球 | 日常平衡型 | 效能接近 GPT-5.5,價格只要一半 |
| Luna | 月亮 | 輕量快速 | 最快、最便宜,適合簡單任務 |
(來源:OpenAI 官方公告、OpenAI Community)

三版本的 Benchmark 表現如何?
根據 OpenAI 官方公布的數據:
| 測試項目 | Sol Ultra | Sol | Terra | Claude Fable 5 | Claude Opus 4.8 |
|---|---|---|---|---|---|
| Terminal-Bench 2.1 | 91.9% | 88.8% | 84.3% | — | 78.9% |
| AI 智能指數 | — | 接近 Fable 5 | — | 基準 | — |
| Agents' Last Exam | 53.6 | — | — | 40.5 | — |
| ExploitBench token 效率 | 省 80% | — | — | — | — |
重點解讀:
- Sol Ultra 在 Terminal-Bench 2.1 拿到 91.9%,是當前所有模型最高分(來源:DataNorth)
- Agents' Last Exam(55 領域的長期專業工作流程評估)中,Sol 拿下 53.6,超越 Claude Fable 5 的 40.5 多達 13 分(來源:Simon Willison)
- Sol 的 max 推理模式和 ultra 多代理模式是獨家功能,後者會調度多個子代理平行處理複雜任務
不過有一項 Sol 落後:SWE-Bench Pro 上 Fable 5 拿到 80%,Sol 只有 64.6%——沒有模型是全面贏家。
(來源:OpenAI 官方公告、Simon Willison、DataNorth)
GPT-5.6 的價格跟 GPT-5.5 比差多少?
| 模型 | 輸入 / M tokens | 輸出 / M tokens | 跟 GPT-5.5 比 |
|---|---|---|---|
| GPT-5.6 Sol | 待官方公布 | 待官方公布 | 旗艦定價 |
| GPT-5.6 Terra | 約 GPT-5.5 一半 | 約 GPT-5.5 一半 | 🏆 最佳 CP 值 |
| GPT-5.6 Luna | 最低 | 最低 | 最快最便宜 |
| GPT-5.5(上一代) | $5 | $30 | 比較基準 |
| Claude Opus 4.8 | $5 | $25 | 競品 |
| Claude Fable 5 | $10 | $50 | 最強競品 |
Terra 的定價策略很關鍵: 效能接近 GPT-5.5,但成本只要一半。如果你目前還在用 GPT-5.5,直接換 Terra 就能省下一半的 API 費用。
Luna 則是輕量任務的最佳選擇——簡單問答、摘要、改寫這類工作,不需要出動旗艦模型,用 Luna 又快又省。
(來源:OpenAI Community、Simon Willison)
Sol 的 Ultra 模式是什麼?跟一般模式差在哪?
Sol 引入了兩種新的推理模式:
Max 模式: 給 Sol 更多時間深度思考,適合困難任務。類似過去的「思考鏈」但更強。
Ultra 模式: Sol 會自動調度多個「子代理(sub-agent)」平行作業,像是一個小團隊分頭處理複雜任務。這在 Codex 和 ChatGPT Work 中使用時特別有感——交付一個複雜任務,它自己拆解分工。
不過這些模式主要出現在 ChatGPT Work、Codex 和 API 場景,一般 ChatGPT 對話中不一定會用到。
(來源:OpenAI 官方公告、Marie Claire 整理)
ChatGPT Work 和 Codex 合併後有什麼不同?
跟 GPT-5.6 同時推出的還有兩個重要更新:
ChatGPT Work: 一個由 GPT-5.6 驅動的代理工作區。你可以直接交付一個任務(「幫我產出這季的銷售報告」),它自己規劃步驟、連接檔案、產出文件/試算表/簡報。跟 Claude Cowork 的設計哲學類似——你說目標,AI 規劃執行。
Codex 併入 ChatGPT 桌面版: 原本是獨立應用的 Codex,7/9 起整合進 macOS 和 Windows 的 ChatGPT 桌面版。在同一個 App 裡就能編輯程式碼、審查 GitHub、操作電腦。搭載 GPT-5.6 後,電腦操作(Computer Use)速度也明顯提升。
(來源:Marie Claire、OpenAI 官方)
你該用哪個版本?
幾個簡單的判斷原則:
- 如果你寫程式、做研究、需要深度推理 → Sol(需要 ChatGPT Pro 或 API 資格)
- 如果你每天用 ChatGPT 寫信、整理資料、一般分析 → Terra(最佳平衡點)
- 如果你只需要快速問答、摘要、改寫 → Luna(最快最省)
- 如果你還在用 GPT-5.5 → 直接升級到 Terra(省一半錢)
- 如果你是免費用戶 → 目前 Sol 不對免費用戶開放
GPT-5.6 的爭議:為什麼會有政府審查?
GPT-5.6 的發布有個小插曲。由於模型能力的大幅提升,特別是涉及網路安全層面的能力,美國政府要求 OpenAI 先向少數政府審查過的組織開放約兩週的限量預覽,才於 7/9 正式全面推出。
這在 AI 產業中並不多見,但也反映出新一代 AI 的能力與風險都需要更審慎的評估。
(來源:Fello AI、Marie Claire)
GPT-5.6 值得升級嗎?
GPT-5.6 不是單純的「變強了」,而是 OpenAI 第一次用三個定位明確的版本取代單一模型策略。對多數人來說,Terra 才是最值得關注的版本——效能接近 GPT-5.5,價格只要一半。
如果你還在用舊版的 ChatGPT,打開模型選單看看,可能已經可以切換到 Terra 了。
你開始用 GPT-5.6 了嗎?留言告訴我你用哪個版本 👇
延伸閱讀
5 個省錢策略,從月費 NT$2,200 → NT$660 👇
🔒 填寫即訂閱雙週報,可隨時退訂。下載連結將寄到你的信箱。