OpenAI 傳推出 GPT-5.6 預覽版 效能創新高卻遭美國政府暫緩公開

人工智慧龍頭 OpenAI 傳出推出號稱「史上最強」的新一代大型語言模型 GPT-5.6 預覽版,並首次採用多層級產品架構與平行代理(Agent)運算模式,在程式開發、科學研究及資安測試等領域展現大幅提升的效能。然而,由於美國政府擔憂其潛在的國安與網路攻擊風險,OpenAI 已同意暫緩向一般大眾公開 GPT-5.6,僅開放部分受信任合作夥伴使用,預計數週後才可能正式全面釋出。
GPT-5.6 採三階產品架構 「Sol」成最強旗艦模型
根據公開資訊,GPT-5.6 預覽版共推出 Sol(旗艦級模型)、Terra(中階模型)、Luna(入門級)模型。
其中,最高階的 Sol 模型定價為每百萬輸入 Token 收費 5 美元、每百萬輸出 Token 收費 30 美元;Terra 價格約為 Sol 的一半,分別為 2.5 美元與 15 美元;Luna 則進一步降至 1 美元與 6 美元,價格較 Sol 低逾八成。
此外,GPT-5.6 全系列新增兩項 GPT-5.5 未具備的運算模式,包括 Max 模式及 Ultra 模式,前者可延長推理時間以提升答案品質,後者則是透過多個子代理(Sub-agents)同步運算,大幅提高推理效率與複雜任務處理能力。
Ultra 模式導入多代理架構 程式能力超越競爭對手
OpenAI 指出,Ultra 模式採用平行代理架構,各子代理負責不同任務,再由主代理整合輸出結果,相較傳統序列推理模式,能更快完成大型複雜工作流程。
在程式能力測試方面,GPT-5.6 Sol 模型於 TerminalBench-2.1 基準測試中獲得 88.8% 成績,略高於競爭對手 Anthropic 最新模型 Mithos 5 的 88%;若啟用 Ultra 模式,成績更進一步提升至 91.9%。
TerminalBench-2.1 主要評估 AI 模型在 89 項複雜命令列(CLI)工作流程中的規劃能力、工具協調能力及反覆執行能力,被視為目前最具代表性的 AI 程式開發基準測試之一。
生物研究、資安能力同步躍升 Token 消耗大幅下降
除了程式能力外,GPT-5.6 在科學研究領域也展現突破。在 OpenAI 自行開發的基因研究評測平台 GeneBench v1 中,GPT-5.6 能以較前代模型更少的 Token 消耗,完成相同品質的基因體分析與生物統計研究工作。
GeneBench 主要測試 AI 是否能獨立完成原始資料的品質檢查、探索性分析、選擇統計模型、研究診斷及推導最終科學結論。
此外,在資安測試平台 ExploitBench 中,GPT-5.6 的能力與 Anthropic 最新資安模型相當,但 Token 使用量僅約三分之一。ExploitBench 主要評估 AI 對真實軟體漏洞發現及攻擊程式撰寫能力。
強化安全防護 GPT-5.6 歷經 70 萬 GPU 小時紅隊測試
由於 GPT-5.6 被定位為前沿 AI(Frontier Model),OpenAI 同步導入史上最嚴格的安全防護架構。
OpenAI 表示,GPT-5.6 具備 Jailbreak(越獄攻擊)防護機制、惡意意圖辨識系統,以及過濾即時生成內容、監控帳戶行為、差異化權限管理、持續性安全的測試等功能。
此外,公司還投入相當於 70 萬小時輝達(NVIDIA)A100 GPU 運算資源進行紅隊(Red Team)攻防測試,以驗證模型在網路攻擊、惡意程式設計及國安風險上的安全性。
OpenAI 表示,若主模型產生潛在危險內容,將由專門的大型推理安全模型即時攔截,避免輸出至使用者端。
美國政府介入審查 GPT-5.6 暫不對外全面開放
值得注意的是,GPT-5.6 此次未能立即全面公開,主要與美國政府最新 AI 監管制度有關。
根據美國川普政府於本月 2 日正式生效的《促進先進人工智慧創新與安全行政命令》(Promoting Advanced Artificial Intelligence Innovation and Security),所有符合「Covered Frontier Models」標準的先進 AI 模型,須在公開前 30 天提交政府進行預先審查。
美國政府將評估模型是否具備高階的網路攻擊能力、生化武器的研發輔助能力、軍事應用風險及遭敵對國家濫用的可能性。
目前,GPT-5.6 已納入該監管框架,僅允許部分經政府認可的合作夥伴優先使用。
AI 競賽進入監管時代 Frontier Model 將成未來關鍵戰場
分析人士指出,GPT-5.6 延後公開,反映全球 AI 軍備競賽已從單純追求模型效能,正式進入「安全與監管並重」的新階段。
未來,不僅模型效能將成為競爭焦點,能否通過政府安全審查、建立可信任的治理機制,也將成為 AI 企業爭奪下一代人工智慧市場主導權的重要關鍵。