色婷婷AⅤ一区二区三区|亚洲精品第一国产综合亚AV|久久精品官方网视频|日本28视频香蕉

"); //-->

博客專欄

EEPW首頁(yè) > 博客 > CVPR21小目標(biāo)檢測(cè)：上下文和注意力機(jī)制提升小目標(biāo)檢測(cè)

CVPR21小目標(biāo)檢測(cè)：上下文和注意力機(jī)制提升小目標(biāo)檢測(cè)

發(fā)布人：CV研究院時(shí)間：2022-04-14 來(lái)源：工程師

加入技術(shù)交流群
- 掃碼加入
  和技術(shù)大咖面對(duì)面交流
  海量資料庫(kù)查詢

發(fā)布文章

CVPR21文章我們也分享了很多最佳的框架，在現(xiàn)實(shí)場(chǎng)景中，目標(biāo)檢測(cè)依然是最基礎(chǔ)最熱門(mén)的研究課題，尤其目前針對(duì)小目標(biāo)的檢測(cè)，更加吸引了更多的研究員和企業(yè)去研究，今天我們“計(jì)算機(jī)視覺(jué)研究院”給大家分享一個(gè)小目標(biāo)檢測(cè)精度提升較大的新框架！

論文：

https://arxiv.org/pdf/1912.06319.pdf

1簡(jiǎn)要

在各種環(huán)境中應(yīng)用目標(biāo)檢測(cè)算法有很多局限性。特別是檢測(cè)小目標(biāo)仍然具有挑戰(zhàn)性，因?yàn)樗鼈兎直媛实?，信息有限?/span>

有研究員提出了一種利用上下文的目標(biāo)檢測(cè)方法來(lái)提高檢測(cè)小目標(biāo)的精度。該方法通過(guò)連接多尺度特征，使用了來(lái)自不同層的附加特征作為上下文。研究員還提出了具有注意機(jī)制的目標(biāo)檢測(cè)，它可以關(guān)注圖像中的目標(biāo)，并可以包括來(lái)自目標(biāo)層的上下文信息。實(shí)驗(yàn)結(jié)果表明，該方法在檢測(cè)小目標(biāo)方面的精度高于傳統(tǒng)的SSD框架。

2 背景

下圖顯示了SSD框架無(wú)法檢測(cè)到小目標(biāo)時(shí)的案例情況。對(duì)小目標(biāo)的檢測(cè)還有很大的改進(jìn)空間。

由于低分辨率低，像素有限，小目標(biāo)檢測(cè)很困難。例如，通過(guò)只看下圖上的目標(biāo)，人類甚至很難識(shí)別這些物體。然而，通過(guò)考慮到它位于天空中的背景，這個(gè)物體可以被識(shí)別為鳥(niǎo)類。因此，我們認(rèn)為，解決這個(gè)問(wèn)題的關(guān)鍵取決于我們?nèi)绾螌⑸舷挛淖鳛轭~外信息來(lái)幫助檢測(cè)小目標(biāo)。

3 新框架分析

新框架將從基線SSD開(kāi)始討論，然后是研究者提出的提高小目標(biāo)檢測(cè)精度的組件。首先，SSD與特征融合，以獲取上下文信息，名為F-SSD；第二，帶有保留模塊的SSD，使網(wǎng)絡(luò)能夠關(guān)注重要部件，名為A-SSD；第三，研究者結(jié)合了特征融合和注意力模塊，名為FA-SSD。

F-SSD: SSD with context by feature fusion

為了為給定的特征圖（目標(biāo)特征圖)在我們想要檢測(cè)目標(biāo)的位置提供上下文，研究者將其與目標(biāo)特征層更高層次的特征圖(上下文特征）融合。例如，在SSD中，給定我們來(lái)自conv4_3的目標(biāo)特性，我們的上下文特征來(lái)自兩層，它們是conv7和conv8_2。

雖然新框架的特征融合可以推廣到任何目標(biāo)特征和任何更高的特征。然而，這些特征圖具有不同的空間大小，因此研究者提出了如上圖所示的融合方法。在通過(guò)連接特征進(jìn)行融合之前，對(duì)上下文特征執(zhí)行反卷積，使它們具有與目標(biāo)特征相同的空間大小。將上下文特征通道設(shè)置為目標(biāo)特征的一半，因此上下文信息的數(shù)量就不會(huì)超過(guò)目標(biāo)特征本身。僅僅對(duì)于F-SSD，研究者還在目標(biāo)特征上增加了一個(gè)額外的卷積層，它不會(huì)改變空間大小和通道數(shù)的卷積層。

此外，在連接特征之前，標(biāo)準(zhǔn)化步驟是非常重要的，因?yàn)椴煌瑢又械拿總€(gè)特征值都有不同的尺度。因此，在每一層之后進(jìn)行批處理歸一化和ReLU。最后通過(guò)疊加特征來(lái)連接目標(biāo)特征和上下文特征。

A-SSD: SSD with attention module

如上圖，它由一個(gè)trunk分支和一個(gè)mask分支組成。trunk分支有兩個(gè)殘差塊，每個(gè)塊有3個(gè)卷積層，如上圖d所示；mask分支通過(guò)使用殘差連接執(zhí)行下采樣和上采樣來(lái)輸出注意圖（圖b為第一階段和圖c為第二階段)，然后完成sigmoid激活。殘差連接使保持下采樣階段的特征。然后，來(lái)自mask分支的注意映射與trunk分支的輸出相乘，產(chǎn)生已參與的特征。最后，參與的特征之后是另一個(gè)殘差塊，L2標(biāo)準(zhǔn)化，和ReLU。

FA-SSD: Combining feature fusion and atten- tion in SSD

研究者提出了以上的兩個(gè)特征的方法，它可以考慮來(lái)自目標(biāo)層和不同層的上下文信息。與F-SSD相比，研究者沒(méi)有在目標(biāo)特征上執(zhí)行一個(gè)卷積層，而是放置了one stage的注意模塊，如下圖所示。

4 實(shí)驗(yàn)

ResNet SSD with feature fusion + attention module (FA- SSD)

紅色框是GT，綠色框是預(yù)測(cè)的

注意力模塊的可視化。有些通道關(guān)注目標(biāo)，有些通道關(guān)注上下文。conv4_3上的注意模塊具有更高的分辨率，因此與conv7上的注意相比，可以關(guān)注更小的細(xì)節(jié)。

*博客內(nèi)容為網(wǎng)友個(gè)人發(fā)布，僅代表博主個(gè)人觀點(diǎn)，如有侵權(quán)請(qǐng)聯(lián)系工作人員刪除。

<a target='_blank'><img src='https://ad.eepw.com.cn/www/delivery/avw.php?zoneid=114&cb=INSERT_RANDOM_NUMBER_HERE&n=a7a83b30' border='0' alt='' /></a>
<a target='_blank'><img src='https://ad.eepw.com.cn/www/delivery/avw.php?zoneid=115&cb=INSERT_RANDOM_NUMBER_HERE&n=a3d98779' border='0' alt='' /></a>
<a target='_blank'><img src='https://ad.eepw.com.cn/www/delivery/avw.php?zoneid=116&cb=INSERT_RANDOM_NUMBER_HERE&n=abca108c' border='0' alt='' /></a>
<a target='_blank'><img src='https://ad.eepw.com.cn/www/delivery/avw.php?zoneid=117&cb=INSERT_RANDOM_NUMBER_HERE&n=a1775170' border='0' alt='' /></a>
<a target='_blank'><img src='https://ad.eepw.com.cn/www/delivery/avw.php?zoneid=118&cb=INSERT_RANDOM_NUMBER_HERE&n=a449048b' border='0' alt='' /></a>

關(guān)鍵詞： AI

相關(guān)推薦

“破局AI開(kāi)發(fā)，釋放邊緣算力開(kāi)發(fā)者訪談”，干貨滿滿！

視頻 intel AI OpenVINO | 2021-06-10

Nvidia的CEO談AI的未來(lái)：“我們將需要三臺(tái)電腦... 一臺(tái)來(lái)創(chuàng)建AI... 一臺(tái)來(lái)模擬AI... 一臺(tái)來(lái)運(yùn)行AI”

智能計(jì)算 AI | 2024-07-31

人工智能是如何幫助阻止造假者的？

謝丫丫 | 2018-08-14

蘋(píng)果表示其AI模型是在谷歌的定制芯片上訓(xùn)練的

智能計(jì)算 AI | 2024-07-30

AI驅(qū)動(dòng)的嵌入式聲音和振動(dòng)識(shí)別

視頻 ADI AI 嵌入式 OtoSense | 2018-10-23

萬(wàn)家樂(lè)JSYZ5-AI燃?xì)鉄崴麟娐穲D

設(shè)計(jì)方案電路圖熱水器 JSYZ5-AI 萬(wàn)家樂(lè) | 2013-01-17

WTC-AI型太陽(yáng)能熱水器電路圖

設(shè)計(jì)方案電子電路圖，WTC-AI 太陽(yáng)能熱水器電路熱水器 | 2012-07-30

iCAN-4017 AI功能模塊

資源下載周立功單片機(jī) 功能模塊 iCAN-4017 AI | 2007-03-30

瑞薩電子AI單元解決方案成功提高GE醫(yī)療（日本）日野工廠的生產(chǎn)力

winni945 | 2018-09-12

iPhone 16將不會(huì)預(yù)裝AI功能？計(jì)劃通過(guò)iOS 18.1發(fā)布

iPhone AI iOS | 2024-07-30

大嘴業(yè)話-AI目前市場(chǎng)分析

視頻人工智能，AI，ChatGPT，互聯(lián)網(wǎng)技術(shù) | 2023-04-25

電子元件培訓(xùn)教材

資源下載 NBA 電子元件識(shí)別電阻識(shí)別電容識(shí)別 AI MI SMT DIP 靜電防護(hù) | 2008-09-20

加大調(diào)整力度，教育部支持高校布局集成電路、AI 等專業(yè)

智能計(jì)算教育 AI 集成電路 | 2024-07-25

EEPW2018年6月刊(5G)

資源下載 5G AI | 2018-06-11

EEPW2018年3月刊(工業(yè)物聯(lián)網(wǎng))

資源下載工業(yè)物聯(lián)網(wǎng) AI | 2018-03-12

繼上次海聯(lián)達(dá)Ai-ap100拆機(jī)之電源改造

zhuwei0710 | 2013-04-03

摩根士丹利：僅 GB200 AI 服務(wù)器業(yè)務(wù)，就為英偉達(dá)創(chuàng)造 2100 億美元年收入

智能計(jì)算 GB200 AI 英偉達(dá) GPU | 2024-07-26

如何快速搭建手寫(xiě)體識(shí)別演示系統(tǒng)

視頻 digikey AI 手寫(xiě)體識(shí)別 | 2022-07-29

AI+機(jī)器視覺(jué)成趨勢(shì)，圖文詳解N大應(yīng)用場(chǎng)景

智能計(jì)算安森美 AI 機(jī)器視覺(jué) | 2024-07-31

蘋(píng)果承認(rèn)：AI模型使用谷歌定制芯片訓(xùn)練

智能計(jì)算蘋(píng)果 AI 谷歌定制芯片 | 2024-07-30

攻擊成功率從 3% 到接近 100%，利用空格鍵可繞過(guò) Meta AI 模型安全系統(tǒng)

智能計(jì)算 Meta AI | 2024-07-31

國(guó)際奧委會(huì)：最大限度發(fā)揮 AI 工具影響力，體育人才選拔方式有望得到革新

智能計(jì)算 AI 奧運(yùn)會(huì) 體育 | 2024-07-26

WTC-AI太陽(yáng)能熱水器電路圖

設(shè)計(jì)方案 WTC-AI 太陽(yáng)能熱水器電路圖 | 2012-07-24

海聯(lián)達(dá)（Aigale）Ai-HD1 無(wú)線全高清套件拆解

zhuwei0710 | 2013-04-28

深圳加快打造 AI 先鋒城市，今年將建成 4000PFLOPS 算力智算中心

智能計(jì)算 AI 智能計(jì)算深圳 | 2024-07-30

CSR8670CSR8675智能語(yǔ)音Alexa藍(lán)牙方案開(kāi)發(fā)

資源下載 AI 智能語(yǔ)音 | 2017-12-14

釋說(shuō)芯語(yǔ)16：硬科技：構(gòu)建企業(yè)未來(lái)之路（附PPT）

jackwang | 2018-10-22

2021春晚黑科技，火爆全網(wǎng)的\"打工牛\"是什么來(lái)頭？

視頻 AI 機(jī)器人 | 2021-02-26

焦點(diǎn)

推薦視頻

更多>>

技術(shù)專區(qū)

<input id="mwoog"></input>