Model for OpenAI gym‘s Lunar Lander not converging

营赢盈英

于 2024-09-14 09:28:33 发布

阅读量1.1k

点赞数 18

分类专栏： AI 文章标签： ai deep learning neural network keras openai q learning

本文链接：https://blog.csdn.net/suiusoar/article/details/142245109

版权

AI 专栏收录该内容

362 篇文章 3 订阅 ¥19.90 ¥99.00

订阅专栏

超级会员免费看

题意：OpenAI Gym 的 Lunar Lander 模型未收敛

问题背景：

I am trying to use deep reinforcement learning with keras to train an agent to learn how to play the Lunar Lander OpenAI gym environment. The problem is that my model is not converging. Here is my code:

我正在尝试使用 Keras 深度强化学习训练一个智能体，学习如何在 OpenAI Gym 环境中玩 Lunar Lander。问题是我的模型没有收敛。以下是我的代码：

import numpy as np
import gym

from keras.models import Sequential
from keras.layers import Dense
from keras import optimizers

def get_random_action(epsilon):
    return np.random.rand(1) < epsilon

def get_reward_prediction(q, a):
    qs_a &#