从观测—动作闭环定义理性、效用、任务分布和安全边界。
7 讲从问题形式化走到BFS、DFS、UCS、迭代加深和图搜索不变量。
7 讲推导A*、可采纳性、一致性、内存受限和随机局部优化。
7 讲从minimax、alpha-beta走到随机博弈、MCTS和棋力评测。
7 讲用传播、变量/值启发式和局部修复解决排课与调度。
7 讲从语义、CNF和归结走到Horn推理、DPLL与证明解释。
7 讲处理量词、合一、前后向链、一阶归结与知识库工程。
7 讲从STRIPS、状态空间与规划图走到部分序、重规划和项目评价。
7 讲用联合分布、贝叶斯网、变量消元、采样和HMM表示不确定性。
7 讲从期望效用、Bellman方程走到策略计算、信念决策与鲁棒评价。
7 讲从老虎机、MC和TD走到Q学习、SARSA、探索与离线安全边界。
7 讲连接博弈机制、状态估计、定位建图、运动控制和责任验收。
7 讲