tf. np. 两类函数的坑。。。

举个例子先:

我要得到一组概率的数据中最大值出现的位置,利用argmax()函数可以解决。

但是坑在于,numpy(以下简称np了。。。)和 tensorflow (以下简称tf )都有这个函数

然后要是直接用的tf.argmax()去处理,得到的就是个tensor(张量)save成图像就报错。。。。

 改用np.argmax(),让输出结果的形式变成numpy,然后存成.npy 或者存成图像就都行了~~~

类似的错误还有很多(如tf.squeeze() 和 np.mean() 都可以用来压缩维度,但是得到的数据类型有差别)

所以要正确选择到底是用np的函数,还是tf的函数。

  • 2
    点赞
  • 2
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
这段代码定义了一个Actor类,它是一个神经网络模型,用于预测在给定的状态下应该采取什么样的动作。具体地,这个Actor类包含以下几个成员变量和函数: - 成员变量state_dim:表示状态(state)的维度; - 成员变量action_dim:表示动作(action)的维度; - 成员变量max_action:表示动作的最大值; - 函数__init__:初始化Actor类,它定义了神经网络的结构,包括三个全连接层(layer1、layer2、mean)和一个用于输出动作的全连接层(log_std)。这些层分别包含256个神经元,其中前两个层采用ReLU激活函数,最后一个输出动作的层采用双曲正切函数(tanh)作为激活函数; - 函数call:接收一个状态作为输入,返回一个动作和与该动作相关的概率值。该函数首先将输入状态通过前两个全连接层进行处理,然后使用mean层输出动作的均值,再使用log_std层输出动作的标准差的对数。这里采用双曲正切函数作为激活函数是因为它的输出范围是[-1,1],这样乘以self.max_action就可以得到[-self.max_action, self.max_action]之间的动作值。然后通过标准差和均值构建一个正态分布,并从中采样得到一个动作值。根据采样得到的动作值,计算该动作的概率,并使用一个公式对概率进行调整,最后将动作值通过tanh函数映射到[-1,1]之间。函数最终返回该动作值和对应的概率值的自然对数。

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值