23小时43分,GPT-6 Astra独自通关《传送门》

一个AI模型,在没有人工干预的情况下,把《传送门》从头打到了通关字幕。开发者cozyblaze在X上发布了这次运行记录:设定初始目标之后,模型全程自主导航、解谜、推进关卡,直到游戏结束。 这次通关耗时约 23小时43分钟 。按Astra的标价计算,令牌消耗至少 570美元 ,不过cozyblaze实际使用的是 200美元 的Codex订阅。 模型如何控制游戏 GPT-6 Astra通过MCP和一个修改过的SourcePauseTool来操控《传送门》。这个工具会在模型“思考”时暂停游戏,每次暂停期间,智能体获取截图、玩家位置和摄像机角度,选定输入指令,然后让游戏继续运行。公开的视频里,这些暂停片段已经被剪掉。 代码和文档都放在GitHub上。cozyblaze提到,OpenAI在2016年就设定过一个目标:用单一智能体解决多种不同的游戏。现在问题依然存在,但看着一个智能体独自打通完整游戏,已经能窥见那个最初设想的一角。 “最差的模型” cozyblaze还补了一句:GPT-6 Astra是“我们未来能用到的最差模型”。这句话放在这次通关的语境里,更像是对后续迭代空间的判断——如果当前版本已经能独立完成一款经典解谜游戏,后续模型的边界显然还会继续外扩。 从技术拆解来看,这次运行的关键不在于通关本身,而在于控制链路的设计:游戏暂停、感知输入、决策输出、恢复运行,四个环节构成一个闭环。模型不需要实时反应,而是用“停下来想”的方式弥补推理延迟,这让它在需要空间解谜的《传送门》里也能稳定推进。 23小时43分钟的总时长,意味着模型经历了大量试错和路径调整。相比人类玩家的通关速度,这个数字并不快,但全程零人工接管这一点,才是这次实验真正想验证的东西。 特别

about image
提前解雇了商业经理,这是伦纳德没有像快船一样遭遇重罚的原因?

提前解雇了商业经理,这是伦纳德没有像快船一样遭遇重罚的原因?

“每次在这里锻炼,我都能感受到自己的身体在不断变化,越来越强壮,真心推荐给大家!”...

[无下一篇]

[无下一篇]

“每次在这里锻炼,我都能感受到自己的身体在不断变化,越来越强壮,真心推荐给大家!”...

订阅