GPT-6 Astra自主通关《传送门》
The Decoder··作者 Matthias Bastian
关键信息
该智能体通过 MCP 和修改版 SourcePauseTool 控制《传送门》,在思考时暂停游戏,然后根据截图、玩家位置和镜头角度选择输入,再继续运行。按 Astra 的标价计算,这次运行的 token 成本至少为 570 美元,不过 cozyblaze 表示实际使用的是 200 美元的 Codex 订阅。
资讯摘要
根据开发者 cozyblaze 的说法,GPT-6 Astra 在只给出最初目标之后,就自主完成了整部《传送门》的通关过程。整次运行大约持续了 23 小时 43 分钟,最终以进入制作人员名单而结束。该方案使用了 MCP 以及修改过的 SourcePauseTool:模型在思考时会先暂停游戏,等它选好下一步输入后再继续执行。每次暂停期间,智能体都能看到截图、玩家位置和镜头角度,从而获得继续推进所需的状态信息。
公开视频把这些暂停片段剪掉了,因此看起来并不能直接反映真实的实时思考—执行过程。cozyblaze 还表示,如果按 Astra 的标价计算,这次运行的 token 成本至少是 570 美元,不过实际是通过 200 美元的 Codex 订阅完成的。cozyblaze 还把这次演示与 OpenAI 在 2016 年提出的、希望用单一智能体解决多种游戏的目标联系起来,认为这次通关算是对那个愿景的一次小小预演。整体来看,这更像是一段令人印象深刻的单次演示,而不是正式的基准测试结果。

资讯正文
GPT-6 Astra 在无人帮助下于不到 24 小时内从头到尾击败了《Portal》
GPT-6 Astra 已经独自通关了整个《Portal》。开发者 cozyblaze 在 X 上发帖称,在最初设定目标后,该模型在没有任何人类帮助的情况下完成了整款游戏并看到了制作名单。整个过程耗时约 23 小时 43 分钟。按 Astra 的标价计算,token 用量至少相当于 570 美元,尽管 cozyblaze 使用的是 200 美元的 Codex 订阅。该模型通过 MCP 以及一个经过修改的 SourcePauseTool 来控制《Portal》,后者会在模型思考时暂停游戏。在每次暂停期间,智能体会查看截图、玩家位置和镜头角度,选择输入操作,然后让游戏继续运行。下面的视频已将这些暂停片段剪掉。
代码和文档都在 GitHub 上。cozyblaze 指出,OpenAI 在 2016 年设定过一个目标:用单一智能体解决许多不同的游戏。问题仍然存在,但看着一个智能体独立击败一整款游戏,至少能让人略窥这一最初愿景。cozyblaze 还补充说,GPT-6 Astra 是“我们将来能得到的最差模型”。
来源与参考
收录于 2026-09-08