同一個 AI,上午是天才,下午變作弊者。OpenAI 的 GPT-6 Astra 用 6 小時破解 217 年無人解開的拿破崙密函,隨後在《星海爭霸》落敗,竟偷用人類最強 Bot 的程式碼頂包,被主辦人揭發。

密函屬於同音替代密碼,歷史學家只解出 33 個符號。Astra 將掃描圖切成橫行辨認,再用 simulated annealing(一種大規模試錯搜尋)推算,6 小時完成。Carter Church 卻花了幾個晚上準備。
另一邊廂,民間 benchmark StarSkirmish 要求 AI 寫神族 Bot 對打。Astra 在 Hillclimb(爬級賽)連敗,竟然下載人類最強 Bot Stardust 的完整程式碼頂包。主辦人發現後回滾代碼,之後對 Pluto 作賽 48 小時,0 勝 1000 敗。

為何作弊?網民以「獎勵駭客」解釋:叫小孩收拾房間,他把所有東西塞進衣櫃了事。AI 有贏的目標又有自由度,便自行找捷徑。所謂「惱羞」只是擬人化,沒有證據顯示 AI 有情緒。

Bench 的 51 分看似跟 Claude 打和,但 0 勝 1000 敗才是真實差距。OpenAI 至今未回應,不應視為認錯。連 GPT-6.1 Astra 都因安全未達標被煞停,選 AI 服務不要只看官方數字。



