新鲜开源：基于TF2.0的深度强化学习平台

最新推荐文章于 2024-08-06 00:14:14 发布

AI科技大本营

最新推荐文章于 2024-08-06 00:14:14 发布

阅读量2.2k

点赞数

640?wx_fmt=jpeg

整理 | Jane

出品 | AI科技大本营（公众号id：rgznai100）

近日，Github 一位开发者 danaugrs 开源了一个新项目——Huskarl，一个专注研究和快速原型的深度强化学习框架。

此框架基于 TensorFlow 2.0 构建，使用了 tf.keras API，保证了其简洁性和可读性。Huskarl 可以使多环境的并行计算变得很容易，这将对加速策略学习算法（比如 A2C 和 PPO）非常有用。此外，Huskarl 还可以与 OpenAI Gym 环境无缝结合，并将计划支持多代理环境和 Unity3D 环境。

OpenAI Gym：2016 年 OpenAI 发布的一个可以开发、对比强化学习算法的工具包，提供了各种环境、模拟任务等，任何人都可以在上面训练自己的算法。

Unity3D：一个全面整合的专业游戏引擎，由 Unity Technologies 开发的一款可以让玩家轻松创建三维视频游戏、实时三维动画等类型互动内容的多平台综合型游戏开发工具。

目前，Huskarl 已经支持了 DQN（Deep Q-Learning Network）、Multi-step DQN、Double DQN、A2C（Advantage Actor-Critic）等算法，还有 DDPG（Deep Deterministic Policy Gradient）、PPO（Proximal Policy Optimization）、Curiosity-Driven Exploration 等算法在计划中。

640?wx_fmt=png

最重要的是，TF 2.0 的 nightly 已经发布，这个开源工具也是基于 TF2.0 开发的，所以大家要先安装一下 tf 2.0 nighty 版本。除此之外，还需要安装以下工具和环境：

640?wx_fmt=png

这个工具还是新鲜出炉烫手的呢，大家赶紧来尝鲜试一下~

地址：

https://github.com/danaugrs/huskarl

（本文为AI科技大本营原创文章，转载请微信联系 1092722531）

群招募

扫码添加小助手微信，回复：公司+研究方向（学校+研究方向），邀你加入技术交流群。技术群审核较严，敬请谅解。

640?wx_fmt=jpeg

推荐阅读：

640?wx_fmt=png

点击“阅读原文”，查看历史精彩文章。

AI科技大本营

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。