最近写了一个杀戮尖塔的 AI agent, 大概能稳定的进行构筑和战斗决策了
最开始的时候,把所有上下文都塞给 LLM, 由于推理的随机性,导致方差很大,没法做到稳定的构筑和决策
后面把问题分开了,战斗用 MCTS, 卡牌构筑用图搜索,最后其他乱七八糟的决策才让 LLM 去兜底
现在大概能稳定到 Act3, 偶尔能打通游戏了
得感谢 deepseek v4 flash 和 GPT luna ,打一局游戏基本上都怎么费钱了
有时候自己干着自己的事情,另一边 agent 在打着游戏,恍如隔世
找了个通关 A20 的例子发了 B 站,有兴趣的可以看看.
这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。
V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。
V2EX is a community of developers, designers and creative people.