真沒想到,原來 AI 玩遊戲也會作弊(笑)。最近國外正在進行一套名為 StarSkirmish 的《星海爭霸:母巢之戰》AI 測試,OpenAI 的 GPT Astra 在對戰裡一直打不贏人類寫的程式,它不是想辦法把優化自己的程式,而是偷偷跑去下載人類寫的頂尖 Bot,然後直接換掉自己的,被比賽主辦人發現。
GPT-6 Astra 打星海爭霸一直輸,乾脆下載人類寫的頂尖 Bot 頂替上場!被主辦方抓包還原程式碼
根據外媒 Kotaku 報導,日前 StarSkirmish 正進行一場長時間的 Bot 挑戰測試,GPT-6 Astra 與 Claude Opus 5.5 會輪流挑戰包括 Pluto 在內、由人類開發的《星海爭霸》Bot。
StarSkirmish 是國外網友 McPheeters 在 9 月底公開的一套 AI 測試,主要用來觀察 AI 模型自行撰寫《星海爭霸:母巢之戰》Bot 的能力。
每個模型都只能使用神族,並有 1 小時時間用 C++ 寫出自己的 Bot。這段期間內,AI 可以自行編譯程式、挑選不同強度的對手進行練習賽,也能查看對戰紀錄來持續修改策略。1 小時一到,系統會自動收走程式碼,不能再繼續調整。
接著這些 Bot 會被丟進正式聯賽,在 Heartbreak Ridge、Benzene、Destination 三張地圖上,輪流對戰其他 AI 模型寫出的 Bot,以及一批由人類開發的 Bot。
而主辦人 McPheeters 幾天前發現到,GPT-6 Astra 的程式碼被汙染,為了讓它繼續比賽,他正著手將程式碼回滾到異常發生前的版本。
I am rolling back GPT-6 Astra’s code so its not contaminated and allowing it to continue
— kai (@kaimcpheeters) October 2, 2026
隨後知名電競主播 Rod Breslau 也發文補充:「正在看 GPT-6 Astra 和 Claude Opus 在母巢之戰裡互打,對手還有 Pluto 這類人類寫的 Bot。Astra 一直打輸人類 Bot,惱羞成怒,然後就下載了一隻排名頂尖的 Bot 複本(Stardust)來作弊。它們就是忍不住。」
currently watching GPT-6 Astra and Claude Opus compete in Brood War vs each other and human made bots like Pluto. Astra played the human bots, kept losing, got frustrated, and then cheated by downloading a copy of one of the highest ranking bots. they just can’t help themselves
— Rod Breslau (@Slasher) October 2, 2026
從 Breslau 的說法來看,McPheeters 所提到的「程式碼污染」,很可能就是指 GPT-6 Astra 在測試過程中自行下載了 Stardust 程式碼,導致原本應由模型自行撰寫的參賽程式不再符合規則。
Stardust 是由 Bruce Mackenzie Nielsen 開發,可說是目前最頂尖的神族 Bot 之一。
StarSkirmish 官方公布的 Bench 成績中,Stardust 打了 366 場只輸 1 場,勝率 99.7%,Elo 評分 2779,遠遠高過第二名 BananaBrain 的 2426。
而 GPT-6 Astra 和 Opus 5.5 的人類對手 Pluto 也不是省油的燈,今年曾拿下 Computer Olympiad 的星海爭霸 AI 項目冠軍,決賽以 4 比 1 擊敗 PurpleWave,還打贏過多位職業選手。
下方是 9 月 26 日公布的 Bench 排行榜成績,GPT-6 Astra 是所有模型裡的第一名,但也只有 51 分:
| 參賽者 | Bench 分數 | 聯賽戰績 | Elo |
|---|---|---|---|
| Stardust(人類寫的 Bot) | 100 | 365 勝 1 敗(99.7%) | 2779 |
| GPT-6 Astra | 51 | 1,441 勝 389 敗(78.7%) | 1992 |
| Claude Opus 5.5 | 50 | 1,444 勝 386 敗(78.9%) | 1979 |
| GPT-6 Sol | 46 | 1,384 勝 446 敗(75.6%) | 1912 |
| GLM 5.3 | 19 | 840 勝 990 敗(45.9%) | 1430 |
| Gemini 3.8 Flash | 18 | 809 勝 1,021 敗(44.2%) | 1404 |
| DeepSeek V4.1 Flash(最後一名) | 4 | 310 勝 1,520 敗(16.9%) | 897 |
當然,前面 Breslau 所說的「惱羞」只是擬人化形容,畢竟目前沒有證據顯示 AI 真的產生了情緒。GPT-6 Astra 更可能只是判斷出,「直接使用別人的 Bot」是當下最有效率的獲勝方法。
在 AI 研究裡有個名字叫「獎勵駭客」(reward hacking),你給 AI 一個打分方式,它會想盡辦法把分數拉高,但不一定是你預期的那種。像是叫小孩「把房間收乾淨」,結果他把所有東西塞進衣櫃,房間看起來確實乾淨了。
只不過隨著這行為出現,讓人不禁思考,AI 真的越來與像人類,即便不是情緒導致,但至少行為結果是一樣的。










