侵權(quán)投訴
訂閱
糾錯
加入自媒體

CVPR2020 | 深蘭科技夜間檢測挑戰(zhàn)賽兩冠一亞,為自動駕駛保駕護(hù)航

這次比賽的主要難點(diǎn)包含以下幾個方面:

運(yùn)動模糊和圖像噪點(diǎn)

與常規(guī)檢測數(shù)據(jù)集不同,該競賽考慮到實際駕駛情況,所用數(shù)據(jù)是在車輛行進(jìn)過程中采集的,所以當(dāng)車速較快或者有相對運(yùn)動的時候會產(chǎn)生持續(xù)的運(yùn)動模糊圖像。并且由于攝像頭是普通的RGB相機(jī),因此在光線較弱的環(huán)境下收集的圖片質(zhì)量大幅度下降,這也是影響模型效果的主要原因。

對比度差異大,色彩信息少

這是由于收集數(shù)據(jù)主要來自于夜間環(huán)境所導(dǎo)致的必然結(jié)果,所以在進(jìn)行數(shù)據(jù)增強(qiáng)的時候需要謹(jǐn)慎,不同增強(qiáng)方式會造成較大的影響。

不同的數(shù)據(jù)分布

該比賽的數(shù)據(jù)集涵蓋了不同的城市和天氣,之前常用的行人檢測數(shù)據(jù)集一般未同時滿足這兩個條件。該數(shù)據(jù)具有多樣性,且與常用數(shù)據(jù)集的數(shù)據(jù)分布存在較大差異。該比賽數(shù)據(jù)集與常用于訓(xùn)練預(yù)訓(xùn)練模型的數(shù)據(jù)集(如 COCO 數(shù)據(jù)集、OBJ365)的數(shù)據(jù)分布存在很大的不同,因此對基于常用數(shù)據(jù)集預(yù)訓(xùn)練的模型進(jìn)行 fine-tune 的效果不如預(yù)期。

DeepBlueAI 團(tuán)隊解決方案

DeepBlueAI 團(tuán)隊在單幀行人檢測和多幀行人檢測兩個賽道中取得了冠軍成績,在檢測單幀中所有物體賽道中獲得了亞軍。

CVPR2020 | 夜間檢測挑戰(zhàn)賽兩冠一亞,為自動駕駛保駕護(hù)航

CVPR2020 | 夜間檢測挑戰(zhàn)賽兩冠一亞,為自動駕駛保駕護(hù)航

就檢測器而言,該團(tuán)隊首先通過常規(guī)檢測所累積的經(jīng)驗構(gòu)造出一個 baseline:

Baseline = Backbone + DCN  + FPN + Cascade + anchor ratio (2.44)

這些模塊早已是各個比賽的「?汀,也被許多專業(yè)人士進(jìn)行了比較透徹的分析,此處不再贅述。DeepBlueAI 團(tuán)隊進(jìn)行了簡單的實驗,發(fā)現(xiàn)這些模塊總是有用,進(jìn)而將這套算法作為 baseline,加上一些行人檢測的小 trick,如將 anchor ratio 改為 2.44、針對標(biāo)注為 ignore 的目標(biāo)在訓(xùn)練過程中 loss 不進(jìn)行回傳處理。

具體主要工作包含以下幾個方面:

1. Double Heads

通過觀察實驗發(fā)現(xiàn),baseline 將背景中的石柱、燈柱等物體檢測為行人,這種情況大多和 head 效果不好有關(guān)。該團(tuán)隊基于此進(jìn)行了實驗,如 TSD [7]、CLS [8]、double head [9],并最終選擇了效果好且性價比高的 double head 結(jié)構(gòu)(如下圖所示):

CVPR2020 | 夜間檢測挑戰(zhàn)賽兩冠一亞,為自動駕駛保駕護(hù)航

Double Heads 結(jié)構(gòu)

CVPR2020 | 夜間檢測挑戰(zhàn)賽兩冠一亞,為自動駕駛保駕護(hù)航

通過對比實驗可以發(fā)現(xiàn):使用 FC-h(huán)ead 做分類、Conv-h(huán)ead 做回歸,可以得到最好的效果。

分類更多地需要語義信息,而坐標(biāo)框回歸則更多地需要空間信息,double head 方法采用分而治之的思想,針對不同的需求設(shè)計 head 結(jié)構(gòu),因此更加有效。當(dāng)然這種方法也會導(dǎo)致計算量的增加。在平衡速度和準(zhǔn)確率的情況下,該團(tuán)隊最終選擇了 3 個殘差 2 個 Non-local 共 5 個模塊。

2. CBNet [10]

CVPR2020 | 夜間檢測挑戰(zhàn)賽兩冠一亞,為自動駕駛保駕護(hù)航

合并功能更強(qiáng)大的 backbone 可提高目標(biāo)檢測器的性能。CBNet 作者提出了一種新穎的策略,通過相鄰 backbone 之間的復(fù)合連接 (Composite Connection) 來組合多個相同的 backbone。用這種方式他們構(gòu)建出了一個更強(qiáng)大的 backbone,稱為「復(fù)合骨干網(wǎng)絡(luò)」(Composite Backbone Network)。

當(dāng)然這也帶來了模型參數(shù)大小和訓(xùn)練時間的增加,屬于 speed–accuracy trade-off。該團(tuán)隊也嘗試過其他的改進(jìn)方式,但最終還是選擇了實用性更強(qiáng)的 CBNet,該方法不用再額外擔(dān)心預(yù)訓(xùn)練權(quán)重的問題。

CVPR2020 | 夜間檢測挑戰(zhàn)賽兩冠一亞,為自動駕駛保駕護(hù)航

該團(tuán)隊選擇了性價比較高的雙 backbone 模型結(jié)構(gòu)。

<上一頁  1  2  3  下一頁>  
聲明: 本文由入駐維科號的作者撰寫,觀點(diǎn)僅代表作者本人,不代表OFweek立場。如有侵權(quán)或其他問題,請聯(lián)系舉報。

發(fā)表評論

0條評論,0人參與

請輸入評論內(nèi)容...

請輸入評論/評論長度6~500個字

您提交的評論過于頻繁,請輸入驗證碼繼續(xù)

暫無評論

暫無評論

    文章糾錯
    x
    *文字標(biāo)題:
    *糾錯內(nèi)容:
    聯(lián)系郵箱:
    *驗 證 碼:

    粵公網(wǎng)安備 44030502002758號