GPT-5.6 Sol/Terra/Luna 完整解讀

GPT-5.6 Sol Terra Luna

:三版本差在哪?你該用哪個?

一句話總結: OpenAI 在 7/9 正式推出 GPT-5.6 系列,捨棄過去單一模型策略,改為三個定位明確的版本——Sol(旗艦)、Terra(日常)、Luna(輕量)。Terra 效能逼近上一代 GPT-5.5 但價格砍半,Luna 是最便宜的選擇。這篇幫你搞懂三者的差別。


GPT-5.6 是什麼?為什麼一次出三個版本?

GPT-5.6 是 OpenAI 在 7/9 正式發布的新一代模型系列。最大的變化不是「變得更聰明」,而是 OpenAI 第一次在同一代號下推出三個定位不同的版本

過去 OpenAI 的命名方式很混亂:GPT-5.5、GPT-5.4、o1、o3 各自獨立。這次他們統一了規則——數字代表世代,名字代表能力等級,以後 Sol、Terra、Luna 各自獨立進化。

三個版本從強到弱:

版本命名由來定位一句話
Sol太陽旗艦級最強推理 + Agent 任務,適合複雜工程
Terra地球日常平衡型效能接近 GPT-5.5,價格只要一半
Luna月亮輕量快速最快、最便宜,適合簡單任務

(來源:OpenAI 官方公告OpenAI Community


GPT-5.6 Benchmark 對比

三版本的 Benchmark 表現如何?

根據 OpenAI 官方公布的數據:

測試項目Sol UltraSolTerraClaude Fable 5Claude Opus 4.8
Terminal-Bench 2.191.9%88.8%84.3%78.9%
AI 智能指數接近 Fable 5基準
Agents' Last Exam53.640.5
ExploitBench token 效率省 80%

重點解讀:

  • Sol Ultra 在 Terminal-Bench 2.1 拿到 91.9%,是當前所有模型最高分(來源:DataNorth
  • Agents' Last Exam(55 領域的長期專業工作流程評估)中,Sol 拿下 53.6,超越 Claude Fable 5 的 40.5 多達 13 分(來源:Simon Willison
  • Sol 的 max 推理模式ultra 多代理模式是獨家功能,後者會調度多個子代理平行處理複雜任務

不過有一項 Sol 落後:SWE-Bench Pro 上 Fable 5 拿到 80%,Sol 只有 64.6%——沒有模型是全面贏家。

(來源:OpenAI 官方公告Simon WillisonDataNorth


GPT-5.6 的價格跟 GPT-5.5 比差多少?

模型輸入 / M tokens輸出 / M tokens跟 GPT-5.5 比
GPT-5.6 Sol待官方公布待官方公布旗艦定價
GPT-5.6 Terra約 GPT-5.5 一半約 GPT-5.5 一半🏆 最佳 CP 值
GPT-5.6 Luna最低最低最快最便宜
GPT-5.5(上一代)$5$30比較基準
Claude Opus 4.8$5$25競品
Claude Fable 5$10$50最強競品

Terra 的定價策略很關鍵: 效能接近 GPT-5.5,但成本只要一半。如果你目前還在用 GPT-5.5,直接換 Terra 就能省下一半的 API 費用

Luna 則是輕量任務的最佳選擇——簡單問答、摘要、改寫這類工作,不需要出動旗艦模型,用 Luna 又快又省。

(來源:OpenAI CommunitySimon Willison


Sol 的 Ultra 模式是什麼?跟一般模式差在哪?

Sol 引入了兩種新的推理模式:

Max 模式: 給 Sol 更多時間深度思考,適合困難任務。類似過去的「思考鏈」但更強。

Ultra 模式: Sol 會自動調度多個「子代理(sub-agent)」平行作業,像是一個小團隊分頭處理複雜任務。這在 Codex 和 ChatGPT Work 中使用時特別有感——交付一個複雜任務,它自己拆解分工。

不過這些模式主要出現在 ChatGPT Work、Codex 和 API 場景,一般 ChatGPT 對話中不一定會用到。

(來源:OpenAI 官方公告Marie Claire 整理


ChatGPT Work 和 Codex 合併後有什麼不同?

跟 GPT-5.6 同時推出的還有兩個重要更新:

ChatGPT Work: 一個由 GPT-5.6 驅動的代理工作區。你可以直接交付一個任務(「幫我產出這季的銷售報告」),它自己規劃步驟、連接檔案、產出文件/試算表/簡報。跟 Claude Cowork 的設計哲學類似——你說目標,AI 規劃執行。

Codex 併入 ChatGPT 桌面版: 原本是獨立應用的 Codex,7/9 起整合進 macOS 和 Windows 的 ChatGPT 桌面版。在同一個 App 裡就能編輯程式碼、審查 GitHub、操作電腦。搭載 GPT-5.6 後,電腦操作(Computer Use)速度也明顯提升。

(來源:Marie ClaireOpenAI 官方


你該用哪個版本?

幾個簡單的判斷原則:

  • 如果你寫程式、做研究、需要深度推理 → Sol(需要 ChatGPT Pro 或 API 資格)
  • 如果你每天用 ChatGPT 寫信、整理資料、一般分析 → Terra(最佳平衡點)
  • 如果你只需要快速問答、摘要、改寫 → Luna(最快最省)
  • 如果你還在用 GPT-5.5 → 直接升級到 Terra(省一半錢)
  • 如果你是免費用戶 → 目前 Sol 不對免費用戶開放

GPT-5.6 的爭議:為什麼會有政府審查?

GPT-5.6 的發布有個小插曲。由於模型能力的大幅提升,特別是涉及網路安全層面的能力,美國政府要求 OpenAI 先向少數政府審查過的組織開放約兩週的限量預覽,才於 7/9 正式全面推出。

這在 AI 產業中並不多見,但也反映出新一代 AI 的能力與風險都需要更審慎的評估。

(來源:Fello AIMarie Claire


GPT-5.6 值得升級嗎?

GPT-5.6 不是單純的「變強了」,而是 OpenAI 第一次用三個定位明確的版本取代單一模型策略。對多數人來說,Terra 才是最值得關注的版本——效能接近 GPT-5.5,價格只要一半。

如果你還在用舊版的 ChatGPT,打開模型選單看看,可能已經可以切換到 Terra 了。

你開始用 GPT-5.6 了嗎?留言告訴我你用哪個版本 👇


延伸閱讀