SpaceXAI(原 xAI)在美國時間 8 月 12 日正式發布 Grok 4.6,官方推文寫道:「Grok 4.6 帶來前沿智慧,是對 Grok 4.5 的顯著提升,維持相同價格。」,Grok 4.6 擁有 1.5 兆參數,上下文視窗為 50 萬 token,支援文字與圖片輸入,並提供低、中、高與極高四種推理強度。這是 Grok 4.5 發布不到一個月後的快速迭代,產品重心明確指向長時間執行的 AI Agent 與程式碼開發任務。
Grok 4.6 API 定價:比 Fable 5 便宜 85%
Grok 4.6 的 API 定價如下(每百萬 token):
- 輸入:$2.00(快取命中 $0.50)
- 輸出:$6.00
Grok 4.6 is faster than comparable models and can handle much more challenging tasks than Grok 4.5.
It’s half the price of other frontier models at $2/M input and $6/M output tokens.
— SpaceXAI (@SpaceXAI) August 12, 2026
與主要競爭者相比,Grok 4.6 的價格優勢非常明顯,Grok 4.6 的效能接近 Fable 5 Max,但成本便宜約 85%,其中輸入便宜 80%、輸出便宜 88%。相較之下,GPT-5.6 Sol Max 的定價更高,而 DeepSeek V4-Pro 雖然更便宜但部分基準落後。
官方文件特別建議開發者設定 `prompt_cache_key`,將同一段對話的請求路由到同一台伺服器,以確保快取命中率。沒有設定的話,經常會在快取冷啟動的伺服器上支付全額輸入費用。
跑分成績:三項基準拿下第一
根據 SpaceXAI 公布的基準測試數據,Grok 4.6(High 推理強度)與 GPT-5.6 Sol Max、Fable 5 Max 及前代 Grok 4.5 的比較如下:
Grok 4.6 拿下最高分的項目:
- GDPVal-AA v2(綜合智慧指標):1,753 Elo,勝過 Fable 5 Max(1,741)和 GPT-5.6(1,728)
- AA-Briefcase(工具使用與代理任務):1,577 Elo,勝過 Fable 5 Max(1,574)和 GPT-5.6(1,502)
- Harvey LAB(推理驗證):15.8%,大幅領先 Fable 5 Max(11.3%)和 GPT-5.6(2.5%)
Grok 4.6 表現出色但未拿第一的項目:
- AA Intelligence Index:61 分,與 GPT-5.6 並列,落後 Fable 5 Max(62)
- CursorBench v3.2(IDE 程式碼表現):69.9%,落後 Fable 5 Max(70.5%)
- APEX-Agents(代理能力):57.5%,落後 Fable 5 Max(59.2%)
Grok 4.6 落後的項目:
- DeepSWE v1.1(軟體工程):65.9%,落後 GPT-5.6(73%)和 Fable 5 Max(70%)
- Terminal-Bench v3.0(終端機操作):26%,落後 GPT-5.6(34.6%)和 Fable 5 Max(34.1%)
- FrontierCode v1.1(進階程式碼):61.3%,落後 Fable 5 Max(64.9%)
Grok 4.6 相較前代 Grok 4.5 在每一項基準上都有明顯進步,特別是 GDPVal-AA 從 1,526 跳升到 1,753,Harvey LAB 從 12.9% 提升到 15.8%。
技術規格與功能
Grok 4.6 的完整技術規格如下:
- 參數規模:1.5 兆
- 上下文視窗:50 萬 token
- 知識截止日:2026 年 2 月 1 日
- 輸入模態:文字與圖片
- 輸出限制:無文字輸出上限
- 推理強度:低、中、高(預設)、極高
- 支援 API:Responses API、Chat Completions
- 工具:Function Calling、網頁搜尋、X 搜尋、程式碼執行
知識截止日為 2026 年 2 月 1 日,代表模型對之後發生的事件沒有直接知識,需要透過工具呼叫或網頁搜尋來補足。這對需要即時資訊的 Agent 任務來說是標準做法,Grok 4.6 內建的網頁搜尋和 X 搜尋功能正好能填補這個缺口。在平台支援方面,Grok 4.6 已上線 xAI API、Grok Build(預設模型)、Cursor(所有方案)、OpenRouter、Vercel 和 Cloudflare。Cursor 用戶無需額外設定即可使用。
推理強度的設計特別值得一提。開發者可以根據任務複雜度在四個等級之間切換:日常對話用「低」或「中」就能快速回應,複雜的程式碼審查或長鏈條 Agent 任務則可調到「高」或「極高」讓模型花更多時間推理。這種彈性讓同一個模型能同時服務輕量級查詢和重度工作負載,不需要在不同模型之間來回切換。
與 DeepSeek V4-Pro 的同日較量
Grok 4.6 的發布時間點頗具意味。就在同一天,DeepSeek 的 V4-Pro-0813 也出現在官方 API 文件頁面上,兩家公司在 Agent 能力上的角力正式浮上檯面。這是 AI 產業少見的「同日發布」場景,兩家不同陣營的前沿模型在同一天搶佔新聞版面。在 DeepSWE 基準上,Grok 4.6(65.9%)略勝 DeepSeek V4-Pro(62.7%),但兩者都落後 GPT-5.6 的 73%。
價格方面,Grok 4.6($2/$6)比 DeepSeek V4-Pro($0.435/$0.87)貴了將近七倍,但 DeepSeek 即將大幅漲價,這個差距可能在短期內縮小。對開發者來說,選擇哪個模型取決於工作場景:需要最便宜的推理成本選 DeepSeek,需要更強的 Agent 協作與 Cursor 整合選 Grok。
另一個值得觀察的面向是生態整合。Grok 4.6 已經深度嵌入 Cursor 的所有方案,而 Cursor 正在與 SpaceXAI 進行合併。這意味著 Grok 4.6 不只是一個 API 端點,而是 Cursor 工作流的預設引擎。DeepSeek 則走開放路線,在 OpenRouter、Together 等多個第三方平台上架,開發者的選擇彈性更大。
路線圖:Grok 4.7 與 Grok 5
馬斯克在 SpaceX 第二季法說會上透露了後續計畫:Grok 4.7 預計在 Grok 4.6 發布後三到四週推出,參數規模將進一步擴大至 2.1 兆。Grok 5 則規劃在 2026 年底前問世。Grok 4.6 的快速迭代節奏反映了 SpaceXAI 的競爭策略:在 Cursor 合併尚未完成交割之前,先用產品實力證明技術能力。從 Grok 4.5 到 4.6 不到一個月,從 4.6 到 4.7 預計也僅三到四週,這種密集發布節奏在主要 AI 廠商中並不多見。
馬斯克同時暗示,Grok 4.7 將是一個「大得多的模型」,結合 Cursor 的程式碼能力與 SpaceXAI 的基礎設施優勢。如果 Grok 4.6 是用 CP 值搶市,Grok 4.7 可能會試圖在絕對效能上追上甚至超越 GPT-5.6 和 Fable 5。

