- 博客(1)
- 收藏
- 关注
翻译 强化学习(reinforcement learning)教程
前一阵研究强化学习,发现中文的资料非常少,实例就更少。于是翻译一篇q学习算法的教程,供需要的人学习。 原文链接:http://mnemstudio.org/path-finding-q-learning-tutorial.htm 正文: Q学习算法是一种用来解决马尔可夫决策过程中最优化问题的方法。Q学习算法最大的特点是它具有选择瞬时奖励和延迟奖励的能力。在每一步中,agent通过观察状态
2013-07-11 22:15:10 34543 5
空空如也
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人