当前位置: 首页 > news >正文

网上书店网站建设设计的收获乐至seo

网上书店网站建设设计的收获,乐至seo,国内国际十大新闻,网站建设方案pptFlappy Bird QDN PyTorch博客 - 代码解读 介绍环境配置项目目录结构QDN算法重要函数解读preprocess(observation)DeepNetWork(nn.Module)BirdDQN类主程序部分 介绍 在本博客中#xff0c;我们将介绍如何使用QDN#xff08;Quantile Dueling Network#xff09;算法#xf… Flappy Bird QDN PyTorch博客 - 代码解读 介绍环境配置项目目录结构QDN算法重要函数解读preprocess(observation)DeepNetWork(nn.Module)BirdDQN类主程序部分 介绍 在本博客中我们将介绍如何使用QDNQuantile Dueling Network算法在PyTorch平台下训练Flappy Bird游戏。QDN算法是一种强化学习算法特别适用于处理具有不确定性的环境如游戏。 环境配置 在开始之前请确保您已经配置好了以下环境 (rl) PS C:\Users\dd conda list # packages in environment at D:\Software\Miniconda3\envs\rl: # # Name Version Build Channel numpy 1.22.3 py38h7a0a035_0 defaults numpy-base 1.22.3 py38hca35cd5_0 defaults opencv-python 4.6.0.66 pypi_0 pypi pillow 6.2.1 pypi_0 pypi pygame 2.1.2 pypi_0 pypi pygments 2.11.2 pyhd3eb1b0_0 defaults python 3.8.13 h6244533_0 defaults python-dateutil 2.8.2 pyhd3eb1b0_0 defaults python_abi 3.8 2_cp38 conda-forge pytorch 1.8.2 py3.8_cuda11.1_cudnn8_0 pytorch-lts请确保您的环境中包含了以上所列的依赖项特别是PyTorch版本为1.8.2。 项目目录结构 在这里我们将简要介绍项目的目录结构以便您更好地理解整个项目的组织和文件布局。 项目根目录 |-- qdn_train.py # QDN算法训练脚本 |-- flappy_bird.py # Flappy Bird游戏实现 |-- model.py # QDN模型定义 |-- replay_buffer.py # 经验回放缓存实现 |-- utils.py # 辅助工具函数 |-- ...QDN算法 QDNQuantile Dueling Network算法是一种强化学习算法用于训练智能体在Flappy Bird游戏中做出决策。以下是算法的关键要点 Replay Memory记忆库 在每个时间步智能体与环境交互将经验存储在记忆库中。这些经验包括当前状态、选择的动作、获得的奖励、下一个状态以及游戏是否终止。 神经网络架构 使用PyTorch实现了一个神经网络其中包括卷积层和全连接层。神经网络的输出是每个可能动作的Q值。 训练过程 在每个时间步智能体根据当前状态选择一个动作。通过与环境交互获得下一个状态、奖励和终止信号。这些信息被用来更新神经网络的权重以最大化预期累积奖励。 Epsilon-Greedy Exploration 在训练的早期阶段智能体更多地依赖于探索通过随机选择动作来发现更多可能的策略。随着训练的进行探索率逐渐减小。 Target Network 为了稳定训练引入了一个目标网络定期从主网络复制参数。这有助于减小训练中的波动性。 重要函数解读 preprocess(observation) 将一帧彩色图像处理成黑白的二值图像。使用OpenCV将图像调整为80x80大小转换为灰度图并进行二值化处理。 DeepNetWork(nn.Module) 定义了神经网络的结构包括卷积层和全连接层。用于近似Q值函数。 BirdDQN类 主要的强化学习智能体类包括了以下主要函数 save(): 保存训练好的模型参数。load(): 加载已保存的模型参数。train(): 使用小批量的记忆数据进行神经网络训练。setPerception(): 更新记忆库判断是否进行训练输出当前状态信息。getAction(): 根据当前状态通过epsilon-greedy策略选择动作。setInitState(): 初始化状态将一帧图像复制四次作为初始输入。 主程序部分 创建了BirdDQN智能体实例与Flappy Bird游戏环境交互并不断执行动作观察状态变化更新神经网络参数。 以上是对代码的主要算法和函数的解读。这个项目结合了深度学习和强化学习通过训练智能体来玩Flappy Bird游戏展示了在PyTorch平台下的实现过程。如果读者有任何疑问或需要进一步解释请在评论中提出。祝愿你在实践中获得成功
http://www.dnsts.com.cn/news/153068.html

相关文章:

  • 中国做的电脑系统下载网站好成都网站建设赢展
  • 如何查看网站的点击量电影资源网站怎么做的
  • 网站建设项目评审意见wordpress建站和使用
  • 莱芜新闻综合频道360网站优化
  • 计算机网站开发网站开发计划书
  • 域名估价网站最近免费中文在线电影
  • 请列出五个以上做外贸的网站可以找酒店案例的网站
  • 营销做网站公司专业做简历找什么店
  • 搭建wap网站怎样做seo搜索引擎优化
  • 网站策划与建设阶段应该做什么深圳互联网企业名单
  • 海天建设集团网站营销推广技巧
  • 技术支持 合肥网站建设如何自己做网站做淘宝客
  • 免费高清图片素材网站有哪些广告设计公司网
  • 做那个的视频网站建立网站的公司平台
  • 淮安做网站建设的网络公司龙岗网站关键词优化代理
  • wordpress island.zip网站为什么要seo?
  • flask做网站工具做外贸对学历要求高吗
  • 集团品牌网站建设济宁网架有多少网架公司
  • 高仿做的好点的网站做自己的网站怎么购买空间
  • 网站设计设计目的网站没有icp备案
  • 网站开发学什么 2018东莞网站建设 家具
  • 手机ppt在哪个网站做wordpress 文档工具栏
  • 多多返利网站建设用流媒体做的电台网站
  • 网站建设哪个好一些做网站app怎么赚钱
  • 网站头部设计代码做网站用什么ide
  • 移动终端网站开发seo推广优化公司哪家好
  • 学校网站班级网页建设制度电力建设期刊网站经常维护吗
  • 山东省建设厅招标网站电子商务网站接口费率
  • wordpress做管理网站宁德市有几个区几个县
  • 成都房地产网站建设店面设计绘画