一种靠反复模拟来选择行动的搜索方法。
像下棋时先在脑内偷演几步:这手走下去是送子还是将军,试得多了就更敢落子。
常用于多步规划,在分支很多时靠模拟逐步选出更优路径。
Graph Search它是在树结构上展开分支并反复评估的搜索方法。
Heuristic Search启发式搜索靠规则估价,它更依赖模拟结果选路。
Reinforcement Learning它常为强化学习提供更强的动作选择与规划能力。
Markov Decision Process它可用于序列决策中近似寻找更优行动路径。