算法笔记(六)多尺度特征融合之FPN/PANet
前言
最近论文快deadline了,一直没空更新…今天复习一下多尺度特征融合的常用操作。
1. FPN 特征金字塔
论文:feature pyramid networks for object detection 论文链接
设计思路:
- 底层的特征语义信息比较少,但是目标位置准确。
- 高层的特征
语义信息
比较丰富,但是目标位置比较粗略。
模型设计:自底向上Bottom-up,自顶向下Top-down,横向连接Lateral connection。
- 自底向上:特征图随着左半部分的网络的加深,尺寸会不断变小,语义信息会更加丰富,这里是将每个stage(尺寸不变的网络集合为一个stage)的最后一个特征图构成特征金字塔。
- 自顶向下:通过upsampling的方法,不断放大特征图,使得低层特征也包含丰富的语义信息。
- 横向连接:将上采样的结果和自底向上生成的相同大小的特征图进行融合。即:从左边过来的特征图,先经过1*1的卷积操作,然后与上面下来的特征图相加(element-wise addition),之后再经过3*3的卷积能得到本层的特征输出(消除上采样产生的混叠效应aliasing effect:插值生成的图像灰度不连续,在灰度变化的地方可能出现明显的锯齿状)。
FPN+RPN
原先的RPN网络,输入的是经过主干网络提取的特征图(单尺度),设置的anchor有3种尺寸,3种宽高比,故有9种anchor:
加入了FPN后,RPN的输入是多尺度特征图,也就是每一层特征图后连接一个RPN head,因为已经有多尺度特征图了,就不需要设置另外3种尺寸,故有15种anchor:
FPN+ROI
ROI的作用是将输入的(检测框,整特征图)进行pooling,得到相同尺寸的目标特征图。使用了FPN之后,就有了多尺度特征图,考虑到实际目标有大有小,所以使用下公式判断将哪一层的特征图输入到ROI中:
k = ⌊ k 0 + l o g 2 ( w ∗ h 224 ) ⌋ k=\lfloor{k_0+log_2(\frac{\sqrt{w*h}}{224})}\rfloor k=⌊k0+log2(224w∗h )⌋
其中, k k k代表特征图的层数编号。
2. PANet
Pyramid Attention Networks for Image Restoration
论文地址
PANet是FPN(图a)的拓展,PANet创新点在于:
- 加入了自底向上路线增强;
- 加入了自适应特征池化。
Bottom-up Path Augmentation
可以看到图(a)的FPN是自顶向下路线,通过侧向连接,将高层的强语义特征传递下来,只增强了特征金字塔的语义信息。例如,当底层特征到到P5时(红线),中间经过非常多层的网络(100+),此时底层的目标信息已经非常模糊了,因此扩展了FPN,加入了自底向上的路线(绿色路线,底层->P2->N2~N5,其中经过的路径少于10层),弥补并加强了定位信息。Adaptive Feature Pooling
前文中,使用FPN+ROI的方法是使用公式来选择FPN的特征图(P2~P5)的其中之一(例如小尺寸选择P2,大尺寸选择了P5)作为ROI的输入,而这种方法实际上也是单层的特征图。在这里,作者对多个特征图(N2~N5)和目标框进行ROI,然后对多个ROI结果(4个),分别经过全连接(fc1)后,再进行融合(sum、max、product等),如图所示:
参考
https://zhuanlan.zhihu.com/p/62604038
算法笔记(六)多尺度特征融合之FPN/PANet相关推荐
- 多尺度特征融合的目标检测算法-论文解读
1.论文声称的创新点 论文中的创新点主要体现在网络结构的创新上,作者提出了一种基于SSD多尺度特征融合(Multi-scale Feature Fusion Single Shot Detecto ...
- MATLAB算法实战应用案例精讲-【深度学习】多尺度特征融合-图像识别(论文篇三)
目录 基于多尺度特征融合的眼底图像分割算法研究 相关理论知识及技术 2.1 眼底医学图像知识
- 多尺度特征融合的知识蒸馏异常检测方法文献笔记
多尺度特征融合的知识蒸馏异常检测方法 期刊:计算机辅助设计与图形学学报 学校:南京信息工程大学计算机学院 时间:2022 关键词:异常检测;知识蒸馏;一分类问题;特征融合 背景 异常检测一般是指判断并 ...
- CVPR2020论文笔记——EfficientDet---双尺度特征融合BiFPN目标检测
代码:https://github.com/google/automl/tree/ master/efficientdet. 摘要:提出了提高效率的几个关键优化 提出了一种加权的双向特征金字塔网络,它 ...
- MATLAB算法实战应用案例精讲-【深度学习】多尺度特征融合-工程应用(论文篇四)
目录 基于多尺度特征融合与残差收缩网络的齿轮箱故障诊断研究 卷积神经网络 2.1 引言
- MATLAB算法实战应用案例精讲-【深度学习】多尺度特征融合-目标检测(论文篇五)
目录 基于多尺度特征融合的行人检测 技术研究 行人检测相关基础理论 2.1 基于传统方法的行人检测
- MATLAB算法实战应用案例精讲-【深度学习】多尺度特征融合(论文篇二)
目录 基于多尺度特征融合的图像语义分割方法研究 知识储备 2.1 神经网络理论
- 深度学习——day9(外 Q1 2021)基于多尺度特征融合的深度监督卷积神经网络路面裂缝检测
基于多尺度特征融合的深度监督卷积神经网络路面裂缝检测 导图和笔记资源下载 三级目录# (外 Q1 2021)基于多尺度特征融合的深度监督卷积神经网络路面裂缝检测 chap2 传统裂纹检测方法 1)Tr ...
- 知识图谱-生物信息学-医学顶刊论文(Bioinformatics-2021)-MUFFIN:用于DDI预测的多尺度特征融合
2.(2021.3.15)Bioinformatics-MUFFIN:用于DDI预测的多尺度特征融合 论文标题: MUFFIN: multi-scale feature fusion for drug ...
最新文章
- LeetCode简单题之同构字符串
- 学 AI 和机器学习的人必须关注的 6 个领域
- J2EE和Java EE
- “速卖通”店铺3天销量破零运营技巧
- Erlang程序设计
- Fefora17联想笔记本安装无线网卡
- clion中自定义消息msg消息时定义的msg文件有类型提示
- php curl 返回cookie_分享新浪图床上传接口PHP源码
- 计算机网络 互联网的基本知识竞赛,计算机网络知识竞赛复习资料.doc
- 硬盘保修查询网站明细清单希捷硬盘保修查询西数硬盘保修查
- ubuntu20.4上不网、进不了root和编译内核出现:cc1: error: code model kernel does not support PIC mode
- 使用腾讯云轻量应用服务器搭建视频直播服务器
- 离谱!2019年诺奖得主大翻车!被曝54篇论文涉嫌造假,刚撤回4篇PNAS
- UT-FT-ST测试
- 什么是内卷?什么是囚徒困境?故事叙述
- 如何在移动开发者的寒冬中破冰而出?
- 什么是Apple Rosetta 2
- 如何将图片存进SQL数据库中以及从数据库读取照片(解决办法)
- 百度地图InfoWindow信息窗口的自定义和样式修改
- 主板电源开关接口图解_电脑主板上的电源开关插头怎么接啊
热门文章
- 常用 APP URL Scheme
- 微信小程序--小程序及微信生态圈
- 初级计算机信息处理员笔试题,初级信息处理技术员计算机系统基础知识考试卷模拟考试^题...
- 非常详细的hi3559A概念版用户手册
- sql优化和索引常见的面试题(面试总结)
- setInterval()与setTimeout() 详细
- 2017华为实习生招聘机考模拟题——0交换排序
- simplify-js 降低曲线拟合使用的点数
- Buildroot 制作根文件系统
- 基于ALOHA MAC方法的蒙特卡罗模拟(Matlab代码实现)