OpenImage冠军方案：在物体检测中为分类和回归任务使用各自独立的特征图

首发：AI公园公众号

导读

这篇文章来自商汤科技，是OpenImage竞赛的冠军方案，本文对物体检测中的分类和回归任务的冲突问题进行了重新的审视，并给出了一个为不同任务分别生成特征图的方案，取得了很好的效果。

摘要

自从Fast RCNN以来，物体检测中的分类和回归都是共享的一个head，但是，分类和回归实际上是两个不一样的任务，在空间中所关注的内容也是不一样的，所以，共享一个检测头会对性能有伤害。本文提出了一个方法，叫做task-aware spatial disentanglement(TSD)，从一个共享的proposal中生成两个解耦的proposal，在COCO和Open Image上都有3个点的提升，效果非常好。这个方法也是OpenImage 2019比赛的第一名。

1. 介绍

IoUNet首先发现了分类和回归共享一个头会有冲突这个问题，他们发现了有些分类分数特别高的bbox反而在回归上不够准确。为了解决这个问题，他们引入了一个额外的head用来预测IOU，用作位置的置信度，然后把位置置信度和分类得分结合起来作为最终的分数。这在一定程度上缓解了这个问题，在空间上的不对齐的问题依然存在。Double-Head RCNN分别用两个分支来进行分类和回归，这在检测头的方面解决了不对齐的问题，但是由于送到这两个检测头中的是来自同一个RPN的给出的ROI，所以，依然存在特征层面的不对齐的问题。

我们对常用的全连接head进行了空间敏感特征图的可视化，如图1，可以明显看出来，分类和回归关注的区域是不一样的。

因此，我们提出了task-aware spatial disentanglement(TSD)，目的就是在空间上将分类和回归的梯度流解耦。TSD在原来的proposal的基础上，生成了两个解耦的proposal，分别用于分类和回归任务。这个改动在使用原来的backbone的基础上提升了3个点，更进一步，我们提出了progressive constraint (PC)来增大TSD和原始的head之间的margin，这又带来1个点的提升。

总结一下，我们的贡献如下：

深入研究了基于ROI的检测器的性能壁垒，发现了制约其性能的原因。
我们提出了一个简单的操作，叫做task-aware spatial disentanglement (TSD)，用来解决任务间的冲突问题，通过这个操作，可以为不同的任务产生和任务相关的特征表示，从而解决任务间的冲突问题。
进一步提出了一个progressive constraint (PC)来增加TSD和传统的head之间的performance margin。
在COCO和OpenImage数据集上验证了方法的有效性。