当前位置: 首页 > news >正文

国外哪个网站是做批发的独立网站怎么做

国外哪个网站是做批发的,独立网站怎么做,ps做网站字体大小,网站建设免费域名这是篇NIPS2023的 world model 论文文章提出,WM的误差会在训练过程中积累从而影响policy的训练,向WM中加噪声可以改善这一点。其他的流程和IRIS差不多,差别在以下几点: image encoder,IRIS用的VQVAE, 本文用的是VAE&am…

在这里插入图片描述

  • 这是篇NIPS2023的 world model 论文
  • 文章提出,WM的误差会在训练过程中积累从而影响policy的训练,向WM中加噪声可以改善这一点。
  • 其他的流程和IRIS差不多,差别在以下几点:
    • image encoder,IRIS用的VQVAE, 本文用的是VAE,用VAE的采样方式来生成zt,从而为zt加噪声。
    • sequence model,IRIS用GPT循环输出image的每个token,本文直接用MLP把生成的 z t z_t zt 和动作 a t a_t at 输出成一个token,这样GPT只需要在时序上循环而不需要在同一个 t 内的不同 token 上循环。换句话说,IRIS的一个图片是GPT中的16个token,而STORM的一个图片是GPT中的一个token。
    • hidden state,IRIS直接从 z 1 : t z_{1:t} z1:t 预测 z t + 1 z_{t+1} zt+1,相当于RNN,而 STORM先从 z 1 : t z_{1:t} z1:t 预测 h t h_{t} ht,也就是说上面的sequence model输出的不是 z ,而是hidden state h,再用一个MLP从 h t h_t ht来预测 z t + 1 z_{t+1} zt+1,这点是用了Dreamerv3的思路
    • loss function,用的也是dreamerv3的loss function
  • 完整公式和损失函数如下:
    在这里插入图片描述
    在这里插入图片描述
    在这里插入图片描述
    在这里插入图片描述

Agent learning

  • 强化学习的部分和dreamerv3一样,不过强调了下value函数用的是移动平均:
    在这里插入图片描述
http://www.shuangfujiaoyu.com/news/17167.html

相关文章:

  • 利用淘宝视频服务做视频网站知识营销案例
  • b站推广网站mmm不安装互联网项目推广是什么
  • 如何在电脑上建立网站亚马逊的免费网站
  • wordpress调用特定分类文章智推教育seo课程
  • 做外贸单网上都做的那些网站优化关键词排名
  • 做外贸网站多少钱百度直接打开
  • 重庆网站建设公司排名天津网站建设公司
  • 四川省建设厅网站网上营销策略有哪些
  • 国外被动收入网站做的好的轻饮食网络推广方案
  • 网站建设 推广信息网站权重什么意思
  • 网站上不去的原因上海网站排名推广
  • 国内b2b免费网站平台谷歌推广外包
  • 如何利用js来做网站表单优化大师免费版下载
  • wordpress好看的编辑器深圳企业seo
  • 品牌营销型网站建设企业老板培训课程
  • 单网页网站扒站工具品牌宣传如何做
  • 网站建设 福州百度建站多少钱
  • 国内知名的网站建设app拉新接单平台
  • 怎么在国外网站做推广海外市场推广做什么的
  • 网游手游排行榜前十名承德seo
  • wordpress+商会+模版东莞做网站排名优化推广
  • 高清效果图网站互联网推广好做吗
  • 公司网站建设步骤网店推广方式有哪些
  • 网站建设长春网络推广计划方案
  • 虾皮购物网站怎么做站长之家工具高清
  • 用记事本做网站怎么让字体靠右常见的搜索引擎有哪些
  • 手机网站制作优化市场营销案例
  • 网站如何做长尾词排名如何营销
  • 成都丁香人才网官网专区seo难不难学
  • 做一婚恋网站多少钱成都专业seo公司