
■ 和「大模型玩游戏」的区别 现在能看到的 AI 玩尖塔,基本都是把模型放在决策链路里:把手牌、敌人、地图序列化成文本喂给大模型,模型返回一个动作,然后等下一次调用。做得好的也能赢,问题是慢。同一篇论文实测:单局中位数 80 分钟,其中 96% 的时间是在等模型返回。 我也用大模型,但用在别处:用它来迭代 bot 的策略——分析上万局的日志、提出改动、设计对照实验。策略定下来之后,编译进 bot,运行时一次模型调用都不发。所以这一局只花了 4 分 39 秒。 一句话:大模型在训练场上,不在赛场上。 ■ bot 遵守的规则 只用玩家在屏幕上看得到的信息:敌人意图、四个牌堆的内容、地图上画出来的节点、本幕 Boss。RNG 状态、隐藏意图、下一张抽什么,一律不读。出牌走游戏自己的点击路径,和你按鼠标是同一条代码。没改任何游戏逻辑,没有无敌 buff,速度只用游戏设置里自带的 Instant Mode。 ■ 后续 当前 A0 通关率 3.5%,打到最终 Boss 的比例 29.6%,平均活到第 33 层;第三章的通过率只有 11%,绝大多数局死在那里。下一阶段的目标是把通关率推到 20%。 后续计划是这样:A0通关率达到20% => 开启A1挑战 => A1通关率达到20% => 开启A2挑战 …… 每次升阶,BOT的策略都需要微调,这部分人尽量不干预,但是会大概指出优化的大方向。例如:先优化战斗模拟器,再优化局内出牌顺序,然后优化其它策略。 敬请期待! ■ 片尾 最后 5 秒是这一局的最终卡组与遗物:20 张牌、12 个遗物,按攻击/技能/诅咒分组。