OpenAI 上週二才推出 GPT-6 Sol 和 GPT-6 Luna,結果短短一週,GPT-6 Sol 就迎來升級版。OpenAI 稍早在 DevDay 2026 開發者大會上發表 GPT-6.1 Sol,價格跟 GPT-6 Sol 一模一樣,但寫程式、操作電腦和處理專業文件的能力,已經快要追上最強的 GPT-6 Astra。
GPT-6.1 Sol 登場:價格不變、效能逼近 GPT-6 Astra,寫程式、電腦操作與科學研究全面升級
GPT-6.1 Sol 是 GPT-6 Sol 的重大升級版,也是目前率先登場的 GPT-6.1 模型。目前已經在 ChatGPT Work 模式、Codex 和 OpenAI API 上線。而 GPT-6.1 Sol 的 API 價格維持每百萬輸入 Token 2 美元、輸出 10 美元,僅是 Astra 的五分之一,OpenAI 形容它是「以 Sol 的價格,提供接近 Astra 的效能」。
GPT-6.1 Sol 這次改進的地方,大致落在六個方向。
- 寫程式:寫程式和除錯上的表現比 GPT-6 Sol 大幅提升,而且是在更低的推理強度下就做到。
- 專業文件和業務流程:更會看報表和跑完一整套工作流程。
- 電腦操作:在需要跨多個應用程式、耗時比較長的電腦操作流程上進步明顯,和 GPT-6 Astra 的差距縮到只剩 2.1 個百分點。
- 科學研究:包括資料分析、跑模擬和定理證明這類要一邊寫程式、一邊在終端機裡操作的研究工作,這是 GPT-6.1 Sol 進步幅度最大的一項,分數直接變成 GPT-6 Sol 的兩倍以上。
- 事實正確性:在回答容易出錯的問題時,GPT-6.1 Sol 講錯事實的比例比 GPT-6 Sol 低,開低推理強度時最明顯。
- 更聽話、更老實:OpenAI 表示 GPT-6.1 Sol 更願意坦白說明自己做不到什麼,例如搜尋工具壞掉時會老實跟你講,而不是自己亂猜一個答案。在代理任務中遇到明確的限制時,也比較不會想辦法繞過去。
GPT-6.1 Sol 的上下文長度是 105 萬 Token,最多可以輸出 12.8 萬 Token,支援文字和圖片輸入、文字輸出,知識截止日期是 2026 年 4 月 30 日。推理強度可選低、中(預設)、高、特高和 Max 五段。
跑分部分,以 DeepSWE v1.1 來說,兩款都開低推理強度時,GPT-6 Sol 只有 37.2%,GPT-6.1 Sol 拿到 64.4%,每項任務成本幾乎一樣(0.16 美元對 0.17 美元)。中推理強度也是 56.6% 對 73.0%。GPT-6 Sol 要到 Max、花 2.74 美元才拿到 68.8%,GPT-6.1 Sol 開高推理強度、花 0.65 美元就拿到 75.2%,也就是官方說的「以更低的推理強度和成本,比 GPT-6 Sol 最佳成績高出 6.4 個百分點」:
電腦操作的 OSWorld 2.0,兩款都開 Max 時,GPT-6.1 Sol 拿到 71.4%,GPT-6 Sol 是 64.4%,提升了 7%,每項任務成本卻從 3.37 美元降到 1.27 美元。對比 GPT-6 Astra 的 Max 成績 73.5%,只領先 2.1%,但每項任務要 9.44 美元,大約是 GPT-6.1 Sol 的七倍,可說省非常多:
科學研究的 Terminal-Bench Science 0.1, GPT-6.1 Sol 開 Max 拿到 57.0%,GPT-6 Sol 只有 27.6%,成本也從 12.18 美元降到 5.47 美元:
讀複雜 PDF 的 GDP.pdf, GPT-6.1 Sol 最好的成績是 32.0%,GPT-6 Sol 是 28.0%,GPT-6 Astra 是 32.2%,幾乎打平。Claude Opus 5.5 最好成績是 28.8%:
下方表格是官方分享的測試數據:
| 測試項目(各模型最佳成績) | GPT-6 Sol | GPT-6.1 Sol | GPT-6 Astra | Claude Opus 5.5 |
|---|---|---|---|---|
| DeepSWE v1.1(寫程式) | 68.8% (Max,$2.74) |
75.2% (高,$0.65) |
74.1% (特高,$4.43) |
未列入 |
| OSWorld 2.0(電腦操作) | 64.4% (Max,$3.37) |
71.4% (Max,$1.27) |
73.5% (Max,$9.44) |
未列入 |
| Terminal-Bench Science 0.1(科學研究) | 27.6% (Max,$12.18) |
57.0% (Max,$5.47) |
68.1% (Max,$23.80) |
63.3% (Max,$23.21) |
| GDP.pdf(讀專業 PDF) | 28.0% (高,$0.35) |
32.0% (高,$0.35) |
32.2% (特高,$1.91) |
28.8% (高,$0.83) |
| AutomationBench 1.0.6(業務流程) | 33.2% (特高,$0.27) |
36.1% (Max,$0.30) |
41.4% (Max,$1.73) |
42.5% (Max,$1.44) |
GPT-6.1 Sol 即日起開放給 ChatGPT Plus、Pro、Business、Enterprise 和 Edu 用戶,可以在 ChatGPT 的 Work 模式和 Codex 中使用,在模型選單裡選 GPT-6.1 Sol 就可以。要注意的是,一般的 ChatGPT「對話」目前還沒有提供,免費版和 Go 方案這次也不在名單內。
開發者則可以透過 OpenAI API 來呼叫 gpt-6.1-sol 模型。價格如下表,跟 GPT-6 Sol 比,輸入和輸出價格不變,但快取輸入從每百萬 Token 0.20 美元降到 0.10 美元,直接砍半:
| 模型 | 輸入 | 快取輸入 | 輸出 | 知識截止 |
|---|---|---|---|---|
| GPT-6 Astra | $10 | $1 | $50 | — |
| GPT-6.1 Sol | $2 | $0.10 | $10 | 2026 年 4 月 30 日 |
| GPT-6 Sol | $2 | $0.20 | $10 | 2026 年 4 月 20 日 |
| GPT-6 Luna | $0.10 | $0.01 | $0.50 | — |











