GPT-6 Astra自己操作、自己解謎!24小時完成《傳送門》破關挑戰
記者吳立言/綜合報導
OpenAI 新模型 GPT-6 Astra 最近完成一項有趣實驗:在沒有玩家直接操作的情況下,自主遊玩 Valve 旗下 3D 解謎遊戲《傳送門》(Portal),最終一路完成遊戲。
這次實驗由 AI 與大型語言模型愛好者 CozyBlaze 發起。整個過程累計進行 3336 次工具呼叫,若按照 API 價格計算,成本約為 571.18 美元(約新台幣 1.8 萬元)。 不過,CozyBlaze 後來補充說明,實際支出由每月 200 美元的 Codex Pro 訂閱涵蓋,並非額外支付 571.18 美元。
AI 看截圖再決定下一步
這項實驗的核心,是讓 GPT-6 Astra 透過 MCP(Model Context Protocol,模型上下文協定)以及經過修改的 SourcePauseTool 控制遊戲。 遊戲在模型思考期間會維持暫停,系統則提供遊戲畫面截圖,以及玩家角色所在位置等資訊。GPT-6 Astra 再根據這些資訊規劃下一步,接著送出一組操作指令,遊戲才會解除暫停並執行動作。模型並不只是單純觀看遊戲影片,而是持續取得遊戲狀態、思考下一步,再實際控制角色移動與解謎。
完整遊玩其實花了 24 小時
這也解釋了為什麼目前流傳的剪輯影片只有約 2 小時,但完整直播紀錄加總後卻長達 約 24 小時。 GPT-6 Astra 必須在遊戲過程中反覆分析畫面、規劃行動並執行操作,期間還會遇到需要重新判斷的情況,因此完成整款遊戲所花的時間遠高於剪輯後的影片長度。
目前還不是標準化測試
CozyBlaze 也強調,這項實驗目前仍有不少問題需要解決,不能直接拿來當作衡量 AI 能力的標準化基準測試。 不過,這次實驗展示了通用型 AI 代理從接收視覺資訊、理解遊戲環境,到規劃行動並持續操作的完整流程,也讓 AI 自主執行複雜遊戲任務的能力再次受到注意。
從遊戲實驗走向通用型代理
CozyBlaze 提到,這類實驗其實呼應 OpenAI 早在 2016 年提出的長期構想:打造能夠處理不同類型遊戲任務的單一 AI 代理。 如今 GPT-6 Astra 已經能夠在《傳送門》這類具備 3D 環境、空間判斷與解謎機制的遊戲中自主完成遊玩流程,顯示 AI 從單純回答問題,逐漸延伸至理解環境並採取連續行動。
不過,這次成果仍屬單一實驗案例,後續能否在更多遊戲與不同環境中穩定重現,仍需要進一步測試。
新聞來源:https://ai.ettoday.net/news/3233298