强化学习的核心算法,Q-table,应用动作值函数对动作的Q值进行更新来找到最优策略。
资源文件列表
Q-learning/RandomPermutation.m , 1677
Q-learning/ReinforcementLearning.m , 2593
2021-4-15
强化学习的核心算法,Q-table,应用动作值函数对动作的Q值进行更新来找到最优策略。
Q-learning/RandomPermutation.m , 1677
Q-learning/ReinforcementLearning.m , 2593