不得不說,GPT-6 Astra 真的猛,不只是幫玩家解決《世紀帝國 IV》Mac 版的效能瓶頸,連自主玩全程遊戲也都沒問題。最近開發者 CozyBlaze 做了一項有趣實驗,他將讓 GPT-6 Astra 自主玩 Valve 的經典解謎遊戲《傳送門》,由 AI 自己觀察畫面、控制角色並破解一道道關卡,沒想到最後真的一路破關,整趟挑戰花了約 23 小時 43 分鐘。

GPT-6 Astra 自主破關《傳送門》:不到 24 小時走到結局,但遊戲會在 AI 思考時暫停
《傳送門》是 Valve 在 2007 年推出的單人 3D 解謎遊戲。玩家手上的傳送門槍可以在特定牆面建立入口與出口,不只要找出正確位置,還得利用墜落速度、空間方向與場景機關,前往原本碰不到的平台。
圖片來源:Steam
根據 CozyBlaze 公開的 Portal Agent 專案,他這次測試是從美國舊金山時間 2026 年 9 月 4 日下午 5 點開始,並在隔日下午 4 點 43 分走到片尾字幕,完成時間約為 23 小時 43 分鐘。執行時使用的是 `gpt-6-astra` 與最高推理強度。不過期間曾因為服務容量問題而中斷,恢復工作階段後就切換到 Fast 模式。
CozyBlaze 表示,他一開始只告訴 GPT-6 Astra 完成《傳送門》這個目標,沒有提供任何攻略、解謎提示,也沒有代替模型控制角色。只有在遊戲結束後,追加一個讓片尾字幕繼續播放的指示。此外,公開說明也提到,網路搜尋以及一般 Shell/瀏覽器工具都被關閉,因此 AI 只能自主摸索與操作,難度不低。
真正讓這次挑戰順利完成的關鍵,是一套「暫停、思考、執行」的控制方式。CozyBlaze 透過 MCP 將 Codex/GPT-6 Astra 接到本機控制器,再由修改版 SourcePauseTool 把指令送進《傳送門》。代表說每一輪開始時,模型會收到遊戲截圖、角色所在座標與鏡頭角度,接著決定要轉動多少視角、按住方向鍵多久,以及何時跳躍、蹲下、搬起物品或發射傳送門。
AI 排好一連串動作後,遊戲才會解除暫停,照著指令正常運作幾秒。當動作執行完畢後,遊戲再次暫停,並把最新畫面傳回給模型。因此過程中會不斷思考暫停、繼續遊戲。
人在玩遊戲時,看畫面就能知道角色站在哪裡,但 Astra 不同,除了截圖,還要讀到角色的精確位置與視角方向,其資料量很大,自動回傳的截圖會縮小到 360 像素高,每份操作計畫最多包含 1,000 個步驟、涵蓋約 99 秒的遊戲時間。此外,AI 也不是逐幀按鍵,而是先寫好一段動作計畫,讓角色實際跑過之後再檢查結果。
整個過程最終共進行 3,336 次工具呼叫,意味著 Astra 不是幾十次操作就一路破關,而是在接近一天的時間裡持續觀察、規劃、執行,再根據結果修正下一步。最後回報的累積用量約為 4.348 億 Token,其中超過 4.264 億屬於快取輸入。
如果按照 API 使用量換算,整個測試的等值成本約為 571.18 美元。不過 CozyBlaze 後續也澄清,他沒有真的為這次遊戲另外支付 571 美元,而是由每月 200 美元的 Codex Pro 訂閱涵蓋這次使用量。
CozyBlaze 已將控制器、SourcePauseTool 修改內容、測試設定與清理過的工作階段紀錄公開在 GitHub,有興趣的人可以瀏覽看看,甚至可以按照教學在 Windows 上嘗試重現。



