当前位置: 首页 > news >正文

北京市建设部网站网页设计代码动漫

北京市建设部网站,网页设计代码动漫,广州市住房和城乡建设局官方网站,网站建设可行性方案模板CenterMask是一个anchor free的实例分割模型, 来自paper: CenterMask: Real-Time Anchor-Free Instance Segmentation 提起anchor free, 会想到FCOS模型,是用来目标检测的, 那么这里就用到了FCOS, 不过换了backbone, 在FCOS检测出目标框后&…

CenterMask是一个anchor free的实例分割模型,
来自paper: CenterMask: Real-Time Anchor-Free Instance Segmentation

提起anchor free, 会想到FCOS模型,是用来目标检测的,
那么这里就用到了FCOS, 不过换了backbone,

在FCOS检测出目标框后,提取目标框内的特征,用了一个SAG Mask, 这是一个spatial attention module,
这个attention的输出会和输入端相乘,再上采样,过1x1 conv, 就得到了每个class的mask,

具体见下面的结构图:

在这里插入图片描述

backbone的改进

backbone用的是VoVNetV2, 改进自VoVNet(paper),这篇paper没有看,就不在这里展开了,但是有几个改进的点如下。

1.OSA模块添加residual connection

把OSA模块叠加之后,发现效果是下降的,比如VoVNetV1-99, 作者联想到和ResNet的原理有关,于是在每个OSA模块中都添加了residual connection, 提升了效果。

2.eSE channel attention

VoVNet中用的是SE(Squeeze-Excitation)channel attention, 作者发现FC layer会减少channel size, 引起channel信息的损失。所以将两个FC layer换成了一个,保持了channel的维度,防止信息的损失,提升了效果。
改进后成为effective SE (eSE).

在这里插入图片描述

前面说了,CenterMask是在FCOS预测的目标框基础上提取mask,
类似Mask R-CNN,
ROI是根据FPN中不同层的feature中预测的,所以ROI Align也应该从FPN的不同层中提取特征。
至于在哪个层中提取,有一个函数。

Adaptive RoI Assignment Function的改进

直觉上来说,大尺寸的ROI对应的感受野大,应该从FPN的高层中提取feature,反之同样。
在Mask R-CNN中,FPN的层数是这样指定的:
在这里插入图片描述
k0是4,w,h是每个ROI的宽和高。
224是imageNet的输入,这个是写S的。
也就是说,看ROI和input size的比例,以4层为中心移动,
如果刚好w和h都是224, 那么log项为0,就从第4层提取,如果w和h都是112,log项为-1,k=3。

但是这个公式不适用于FCOS,想必你们也能看出来,首先224写S的这一项就不符合,
如果input size变了呢。
另外,公式(1)中中心层设的是4,以第4层为中心移动,这个是two-stage detector适用的,
因为two-stage用的是P2~P5层。
但是one-stage用的是P3~P7层。

所以作者做了如下改进:
在这里插入图片描述
直接用了input size和ROI size的比例,用最大层去减,就不存在几个写S的问题。
这样做可以提高小目标的AP。
作者设kmaxk_{max}kmax为P5,kmink_{min}kmin为P3.

SAG Mask

这个是从ROI region中提取attention feature的部分。
再来看下结构图。

在这里插入图片描述
在object detection领域,attention被广泛应用,其中,
channel attention强调了注意哪个channel, 强调的是"what",
而spatial attention强调的是"where", 注意哪个region.

所以这里用的是spatial attention. 强调的是注意哪些pixel.

上面图中,ROI区域内的feature被ROI Align (14x14)提取,然后送给4个conv和SAG Mask。
设SAM的输入为XiX_iXi, size为C x W x H,
可以看到SAM结构中,先把Xi分别过max pooling 和 avg pooling, 注意是沿channel进行pooling,
所以它们得到的结果都是1 x W x H, 把它们concatenate到一起,
再过一个3x3 conv, 再过一个sigmoid.
对应paper的如下部分:

在这里插入图片描述
当然了,现在得到的是一个attention map, 相当于一个权重map.
还需要和input的Xi相乘,会得到一个attention guided feature map.
在这里插入图片描述
然后这个feature map 会过一个2x2的deconv, 上采样到28x28.
最后过一个1x1 conv得到每个class对应的mask.

实现细节

FCOS的超参调整,positive score 阈值从0.05降到0.03, 因为在初始训练时positive ROI产生不是太好。
还用了mask score来进一步过滤mask。

Lite版本把FPN的channel从256降到128以提升效率。
centerness branch是被box branch shared.
conv layer 和 channel的削减。

训练

FCOS的detection box个数设为100个,其中score最高的放进SAG mask branch作为训练.
mask target选择和gt mask的ROI较大的。

损失函数加上LmaskL_{mask}Lmask, 也就是BCE loss。
在这里插入图片描述

Ablation study

SAM和Mask score.
在这里插入图片描述
Feature level的选取,
所以前面的kmaxk_{max}kmax取5,kmink_{min}kmin取3。
在这里插入图片描述

各种method比较

在这里插入图片描述

http://www.yayakq.cn/news/108696/

相关文章:

  • 网站托管网站建设竞价托管成都十大著名景点
  • 网站建设捌金手指花总八佛山网站建设外包
  • 可信赖的购物网站建设电商网站报价
  • 湛江网站制作公司社交网站盈利吗
  • 网站关键字如何设置拖式网站建设
  • 哈尔滨做网站哪家好强平价建网站格
  • 网络认证网站泸州公司做网站
  • h5 技术做健康类网站c 网站开发需要的技术
  • 网站推广文章怎么写广州小程序设计
  • 网站备案名称重复打开网站图片弹入指定位置代码
  • 山东省工程建设信息官方网站设计师网站介绍
  • 运动鞋官方网站建设计划书淘宝官网首页登录入口电脑版
  • 网站开发公司模版建筑用模板多少钱一块
  • 手机网站建设流程 知乎网站建设这一行业怎样
  • 物流网站建设计划书渝东建设工程造价信息网
  • 厦门市住房和城乡建设局网站首页做农家乐农产品旅游的网站
  • 饭店网站建设策划方案小白如何制作微信小程序
  • 淘宝网站wordpress安装 不了
  • 西安电脑网站建设创建网址链接
  • 网站的ico图标做多大怎么重新网站做301
  • 网站的数据库怎么做男女做暧暧试看网站
  • 会议网站定制软件开发交易平台
  • 各省备案网站温岭市市住房和城乡建设规划局网站
  • 海宁高端高端网站设计深圳坪山站
  • 设计企业品牌商标苏州seo公司 翼好
  • 湖北省建设厅七大员报名网站做百科需要参考的网站
  • 南山-网站建设信科网络上海工程招标网招标公告
  • 怎样用dw做网站主页查网站排名
  • 嘉峪关市网站建设设计wordpress有插件
  • 福田住房和建设局网站在线阅读小说网站怎么做