当前位置: 首页 > news >正文

济宁市精神文明建设委员会网站什么是论坛推广

济宁市精神文明建设委员会网站,什么是论坛推广,哪些做靠谱兼职网站有哪些,大型外贸网站建设CenterMask是一个anchor free的实例分割模型, 来自paper: CenterMask: Real-Time Anchor-Free Instance Segmentation 提起anchor free, 会想到FCOS模型,是用来目标检测的, 那么这里就用到了FCOS, 不过换了backbone, 在FCOS检测出目标框后&…

CenterMask是一个anchor free的实例分割模型,
来自paper: CenterMask: Real-Time Anchor-Free Instance Segmentation

提起anchor free, 会想到FCOS模型,是用来目标检测的,
那么这里就用到了FCOS, 不过换了backbone,

在FCOS检测出目标框后,提取目标框内的特征,用了一个SAG Mask, 这是一个spatial attention module,
这个attention的输出会和输入端相乘,再上采样,过1x1 conv, 就得到了每个class的mask,

具体见下面的结构图:

在这里插入图片描述

backbone的改进

backbone用的是VoVNetV2, 改进自VoVNet(paper),这篇paper没有看,就不在这里展开了,但是有几个改进的点如下。

1.OSA模块添加residual connection

把OSA模块叠加之后,发现效果是下降的,比如VoVNetV1-99, 作者联想到和ResNet的原理有关,于是在每个OSA模块中都添加了residual connection, 提升了效果。

2.eSE channel attention

VoVNet中用的是SE(Squeeze-Excitation)channel attention, 作者发现FC layer会减少channel size, 引起channel信息的损失。所以将两个FC layer换成了一个,保持了channel的维度,防止信息的损失,提升了效果。
改进后成为effective SE (eSE).

在这里插入图片描述

前面说了,CenterMask是在FCOS预测的目标框基础上提取mask,
类似Mask R-CNN,
ROI是根据FPN中不同层的feature中预测的,所以ROI Align也应该从FPN的不同层中提取特征。
至于在哪个层中提取,有一个函数。

Adaptive RoI Assignment Function的改进

直觉上来说,大尺寸的ROI对应的感受野大,应该从FPN的高层中提取feature,反之同样。
在Mask R-CNN中,FPN的层数是这样指定的:
在这里插入图片描述
k0是4,w,h是每个ROI的宽和高。
224是imageNet的输入,这个是写S的。
也就是说,看ROI和input size的比例,以4层为中心移动,
如果刚好w和h都是224, 那么log项为0,就从第4层提取,如果w和h都是112,log项为-1,k=3。

但是这个公式不适用于FCOS,想必你们也能看出来,首先224写S的这一项就不符合,
如果input size变了呢。
另外,公式(1)中中心层设的是4,以第4层为中心移动,这个是two-stage detector适用的,
因为two-stage用的是P2~P5层。
但是one-stage用的是P3~P7层。

所以作者做了如下改进:
在这里插入图片描述
直接用了input size和ROI size的比例,用最大层去减,就不存在几个写S的问题。
这样做可以提高小目标的AP。
作者设kmaxk_{max}kmax为P5,kmink_{min}kmin为P3.

SAG Mask

这个是从ROI region中提取attention feature的部分。
再来看下结构图。

在这里插入图片描述
在object detection领域,attention被广泛应用,其中,
channel attention强调了注意哪个channel, 强调的是"what",
而spatial attention强调的是"where", 注意哪个region.

所以这里用的是spatial attention. 强调的是注意哪些pixel.

上面图中,ROI区域内的feature被ROI Align (14x14)提取,然后送给4个conv和SAG Mask。
设SAM的输入为XiX_iXi, size为C x W x H,
可以看到SAM结构中,先把Xi分别过max pooling 和 avg pooling, 注意是沿channel进行pooling,
所以它们得到的结果都是1 x W x H, 把它们concatenate到一起,
再过一个3x3 conv, 再过一个sigmoid.
对应paper的如下部分:

在这里插入图片描述
当然了,现在得到的是一个attention map, 相当于一个权重map.
还需要和input的Xi相乘,会得到一个attention guided feature map.
在这里插入图片描述
然后这个feature map 会过一个2x2的deconv, 上采样到28x28.
最后过一个1x1 conv得到每个class对应的mask.

实现细节

FCOS的超参调整,positive score 阈值从0.05降到0.03, 因为在初始训练时positive ROI产生不是太好。
还用了mask score来进一步过滤mask。

Lite版本把FPN的channel从256降到128以提升效率。
centerness branch是被box branch shared.
conv layer 和 channel的削减。

训练

FCOS的detection box个数设为100个,其中score最高的放进SAG mask branch作为训练.
mask target选择和gt mask的ROI较大的。

损失函数加上LmaskL_{mask}Lmask, 也就是BCE loss。
在这里插入图片描述

Ablation study

SAM和Mask score.
在这里插入图片描述
Feature level的选取,
所以前面的kmaxk_{max}kmax取5,kmink_{min}kmin取3。
在这里插入图片描述

各种method比较

在这里插入图片描述

http://www.tj-hxxt.cn/news/119259.html

相关文章:

  • 如何在别人网站挂黑链百度seo服务方案
  • 做网站尺寸一般都多大微信crm系统软件
  • 茶叶批发 技术支持 东莞网站建设百度指数分是什么
  • 专业建站是什么电脑培训班价目表
  • 山东省 安全双体系建设网站武汉seo全网营销
  • 怎样做instergram网站营销推销产品的万能句子
  • 代刷网站app制作教程百度识图找原图
  • wordpress 无广告视频网站网络广告策划流程有哪些?
  • 建设网站不会写代码成都seo培
  • wordpress 链接 插件属于seo网站优化
  • 六安论坛网最新疫情消息优化设计三年级下册数学答案
  • 淘宝网网站开发网站运营及推广方案
  • 互联网架构师合肥关键词排名优化
  • 如何优化wordpress网站灰色关键词排名
  • 昆山做网站价格seo搜索是什么意思
  • 做图网站地图站长申论
  • 做网站的是什么免费html网页模板
  • 秦皇岛网站建设报价大型集团网站建设公司
  • 学ps做兼职的网站有哪些站长工具网站
  • 天津网站建设服务好搜索引擎收录查询工具
  • 深圳外贸网站建设口报关新东方烹饪培训学校
  • 用ps怎么做网站步骤什么是seo技术
  • win8安装wordpress500安徽百度seo公司
  • 网站设计制作电话多少爱站权重
  • 怎么做网页?太原seo网站排名
  • 苏宁易购网站建设的思路seo扣费系统源码
  • 哪个网站diy做宝宝衣服宁波网站推广优化公司电话
  • 网站友情链接怎么样做友情链接格式
  • 上海金山区建设局网站网络建站
  • 海南网站建设推广公司网站源码平台