最近写了一个杀戮尖塔的 AI agent, 大概能稳定的进行构筑和战斗决策了
最开始的时候,把所有上下文都塞给 LLM, 由于推理的随机性,导致方差很大,没法做到稳定的构筑和决策
后面把问题分开了,战斗用 MCTS, 卡牌构筑用图搜索,最后其他乱七八糟的决策才让 LLM 去兜底
现在大概能稳定到 Act3, 偶尔能打通游戏了
得感谢 deepseek v4 flash 和 GPT luna ,打一局游戏基本上都怎么费钱了
有时候自己干着自己的事情,另一边 agent 在打着游戏,恍如隔世
找了个通关 A20 的例子发了 B 站,有兴趣的可以看看.