AI实战，用Python玩个自动驾驶！

荀经纶

已于 2024-04-28 03:18:09 修改

阅读量400

点赞数 5

分类专栏：程序员文章标签： python 人工智能自动驾驶

于 2024-04-28 03:18:08 首次发布

本文链接：https://blog.csdn.net/2301_76224593/article/details/138263675

版权

本文介绍了如何在highway-env环境中使用DQN（DeepQ-Network）进行驾驶模拟，包括构建模型（使用状态表示法Kinematics）、定义动作和奖励机制，以及通过训练和学习策略来控制车辆。作者强调了持续学习在IT行业的重要性，尤其是对于编程人员保持竞争力的关键作用。

摘要由CSDN通过智能技术生成

生成一张W*H的灰度图像，W代表图像宽度，H代表图像高度

Occupancy grid

生成一个WHF的三维矩阵，用W*H的表格表示ego vehicle周围的车辆情况，每个格子包含F个特征。

(2) action

highway-env包中的action分为连续和离散两种。连续型action可以直接定义throttle和steering angle的值，离散型包含5个meta actions：

ACTIONS_ALL = {
        0: 'LANE_LEFT',
        1: 'IDLE',
        2: 'LANE_RIGHT',
        3: 'FASTER',
        4: 'SLOWER'
    }

(3) reward

highway-env包中除了泊车场景外都采用同一个reward function：

这个function只能在其源码中更改，在外层只能调整权重。

（泊车场景的reward function原文档里有）

2、搭建模型

DQN网络，我采用第一种state表示方式——Kinematics进行示范。由于state数据量较小（5辆车*7个特征），可以不考虑使用CNN，直接把二维数据的size[5,7]转成[1,35]即可，模型的输入就是35，输出是离散action数量，共5个。

import torch
import torch.nn as nn
from torch.autograd import Variable
import torch.nn.functional as F
import torch.optim as optim
import torchvision.transforms as T
from torch import FloatTensor, LongTensor, ByteTensor
from collections import namedtuple
import random 
Tensor = FloatTensor

EPSILON = 0    # epsilon used for epsilon greedy approach
GAMMA = 0.9
TARGET_NETWORK_REPLACE_FREQ = 40       # How frequently target netowrk updates
MEMORY_CAPACITY = 100
BATCH_SIZE = 80
LR = 0.01         # learning rate

class DQNNet(nn.Module):
    def __init__(self):
        super(DQNNet,self).__init__()

最低0.47元/天解锁文章

荀经纶

关注

5
点赞
踩
5

收藏

觉得还不错? 一键收藏
0
评论
AI实战，用Python玩个自动驾驶！

在结束之际，我想重申的是，学习并非如攀登险峻高峰，而是如滴水穿石般的持久累积。尤其当我们步入工作岗位之后，持之以恒的学习变得愈发不易，如同在茫茫大海中独自划舟，稍有松懈便可能被巨浪吞噬。然而，对于我们程序员而言，学习是生存之本，是我们在激烈市场竞争中立于不败之地的关键。一旦停止学习，我们便如同逆水行舟，不进则退，终将被时代的洪流所淘汰。因此，不断汲取新知识，不仅是对自己的提升，更是对自己的一份珍贵投资。让我们不断磨砺自己，与时代共同进步，书写属于我们的辉煌篇章。需要完整版PDF学习资源私我。
复制链接

扫一扫

专栏目录