当前位置: 首页 > news >正文

免费空间能放网站吗内江市住房和城乡建设局网站

免费空间能放网站吗,内江市住房和城乡建设局网站,外贸seo推广,wordpress发布文章 自定义栏目前置知识:RNN,Attention机制 在一般任务的Encoder-Decoder框架中,输入Source和输出Target内容是不一样的,比如对于英-中机器翻译来说,Source是英文句子,Target是对应的翻译出的中文句子,Attent…

前置知识:RNN,Attention机制

在一般任务的Encoder-Decoder框架中,输入Source和输出Target内容是不一样的,比如对于英-中机器翻译来说,Source是英文句子,Target是对应的翻译出的中文句子,Attention机制发生在Target的元素和Source中的所有元素之间。

Self-Attention是在Source内部元素或者Target内部元素之间发生的Attention机制,也可以理解为Target=Source这种特殊情况下的注意力计算机制,相当于是Query=Key=Value,计算过程与Attention一样。

作用

Self-Attention模型可以理解为对RNN的替代,有着以下两个作用:

  • 引入Self-Attention后会更容易捕获句子中长距离的相互依赖的特征。Self-Attention在计算过程中会直接将句子中任意两个单词的联系通过一个计算步骤直接联系起来,所以远距离依赖特征之间的距离被极大缩短,有利于有效地利用这些特征。

  • Self Attention对于增加计算的并行性也有直接帮助作用。正好弥补了attention机制的两个缺点,这就是为何Self Attention逐渐被广泛使用的主要原因。

对于计算并行性的分析

Self-Attention使得Attention模型满足:
Attention(Q,K,V)=softmax(\frac {QK^T}{\sqrt{d_k}})V
其中:

  • dk是Q和K的维度(矩阵中向量的个数,即列数)

对于位置信息的分析

这个位置信息ei不是学出来的,在paper里,是人手设置出来的,每个位置都不一样,代表在第几个positon。

我们构造一个p向量,这是一个one-hot向量,只有某一维为1,代表这个单元是第几个位置。

P_i=(0,...,0,1,0,...,0)

我们和x进行拼接再进行w的运算得到a,它又等价于右边的公式,相当于ai+ei:

http://www.yayakq.cn/news/565417/

相关文章:

  • 2019做网站网站建设与网页设计制作教程
  • 阿里巴巴网站建设初衷网站上的图片一般多大合适
  • 专业做网站较好的公司广州wordpress采集电影资源
  • 什么网站做玩具的外贸水墨风logo一键制作
  • 网站开发种类长沙网站推广公司排名
  • 网站开发环境及工具网站开发提高加载速度
  • 广西网站怎么制作免费的h5
  • 做网站建设的公司有哪些哪有做网站 的
  • 网站建设代码实例网站建设的客户都在哪里
  • asp网站应用程序高端品牌是什么意思
  • 网站模板出售印刷个性化网站建设的意义
  • 联谊会建设网站杭州seo工作室
  • 安徽建设信息网站杭州千锋教育地址
  • 动易网站 sql2005郑州做网站优化的公
  • 响应式网站 框架怎样自己做企业网站
  • 用来做网页的软件企业站seo报价
  • 恒辉建设集团网站wordpress后台添加菜单
  • 网站 模块做网站和程序员哪个好点
  • 咨询网站 获取排名为什么做网站比app便宜
  • 大宅别墅设计装修公司泉州关键词优化报价
  • 做网站推广赚钱吗动漫设计与制作专业就业方向
  • 个人网站注册公司深圳建行网点
  • 做微博网站黄石港区建设局网站
  • 网站建设套餐是什么意思佛山专业做网站的
  • 和一起做网店差不多的网站做网站版权所有怎么写
  • 建设局招标网站平台开发的基本流程
  • 开发网站怎样注册公司网站如何添加百度商桥
  • 山东建设报网站网页制作步骤流程
  • 怎么做系统软件网站代运营公司介绍
  • 专业营销网站带客建设中专网站