如何使用Python和OpenCV實(shí)現(xiàn)對(duì)象檢測(cè)任務(wù)的數(shù)據(jù)擴(kuò)充過(guò)程?
# Modify annotation
new_boxes=[]
for box in gt_boxes:
obj_name = box[0]
x1 = int(box[1])
y1 = int(box[2])
x2 = int(box[3])
y2 = int(box[4])
x1, x2 = x1-x, x2-x
y1, y2 = y1-y, y2-y
x1, y1, x2, y2 = x1/scale, y1/scale, x2/scale, y2/scale
if (x1<img.shape[1] and y1<img.shape[0]) and (x2>0 and y2>0):
if x1<0: x1=0
if y1<0: y1=0
if x2>img.shape[1]: x2=img.shape[1]
if y2>img.shape[0]: y2=img.shape[0]
new_boxes.a(chǎn)ppend([obj_name, x1, y1, x2, y2])
return resized, new_boxes
CutoutCutout是2017年由Terrance DeVries和Graham W. Taylor在他們的論文中介紹的,是一種簡(jiǎn)單的正則化技術(shù),在訓(xùn)練過(guò)程中隨機(jī)掩蓋輸入的正方形區(qū)域,可以用來(lái)提高卷積神經(jīng)網(wǎng)絡(luò)的魯棒性和整體性能。這種方法不僅非常容易實(shí)現(xiàn),而且表明它可以與現(xiàn)有形式的數(shù)據(jù)擴(kuò)充和其他正則化器一起使用,進(jìn)一步提高模型的性能。論文地址:https://arxiv.org/abs/1708.04552與本文一樣,我們使用了cutout來(lái)提高圖像識(shí)別(分類(lèi))的精度,因此,如果我們將相同的方案部署到目標(biāo)檢測(cè)數(shù)據(jù)集中,可能會(huì)導(dǎo)致丟失目標(biāo)(特別是小目標(biāo))的問(wèn)題。在下圖中,刪除了剪切區(qū)域(黑色區(qū)域)內(nèi)的大量小對(duì)象,這不符合數(shù)據(jù)增強(qiáng)的精神。
為了使這種方式適合對(duì)象檢測(cè),我們可以做一個(gè)簡(jiǎn)單的修改,而不是僅使用一個(gè)遮罩并將其放置在圖像中的隨機(jī)位置,而是隨機(jī)選擇一半的對(duì)象,并將裁剪應(yīng)用于每個(gè)目標(biāo)區(qū)域,效果更佳。增強(qiáng)后的圖像如下圖所示。
Cutout的輸出是一個(gè)新生成的圖像,我們不刪除對(duì)象或改變圖像大小,那么生成的圖像的注釋就是原始注釋。def cutout(img, gt_boxes, amount=0.5):
'''
### Cutout ###
img: image
gt_boxes: format [[obj x1 y1 x2 y2],...]
amount: num of masks / num of objects
'''
out = img.copy()
ran_select = random.sample(gt_boxes, round(amount*len(gt_boxes)))
for box in ran_select:
x1 = int(box[1])
y1 = int(box[2])
x2 = int(box[3])
y2 = int(box[4])
mask_w = int((x2 - x1)*0.5)
mask_h(yuǎn) = int((y2 - y1)*0.5)
mask_x1 = random.randint(x1, x2 - mask_w)
mask_y1 = random.randint(y1, y2 - mask_h(yuǎn))
mask_x2 = mask_x1 + mask_w
mask_y2 = mask_y1 + mask_h(yuǎn)
cv2.rectangle(out, (mask_x1, mask_y1), (mask_x2, mask_y2), (0, 0, 0), thickness=-1)
return out
ColorJitterColorJitter是另一種簡(jiǎn)單的圖像數(shù)據(jù)擴(kuò)充類(lèi)型,我們隨機(jī)改變圖像的亮度、對(duì)比度和飽和度。我相信這個(gè)“家伙”很容易被大多數(shù)讀者理解。

發(fā)表評(píng)論
請(qǐng)輸入評(píng)論內(nèi)容...
請(qǐng)輸入評(píng)論/評(píng)論長(zhǎng)度6~500個(gè)字
最新活動(dòng)更多
-
3月27日立即報(bào)名>> 【工程師系列】汽車(chē)電子技術(shù)在線大會(huì)
-
4月30日立即下載>> 【村田汽車(chē)】汽車(chē)E/E架構(gòu)革新中,新智能座艙挑戰(zhàn)的解決方案
-
5月15-17日立即預(yù)約>> 【線下巡回】2025年STM32峰會(huì)
-
即日-5.15立即報(bào)名>>> 【在線會(huì)議】安森美Hyperlux™ ID系列引領(lǐng)iToF技術(shù)革新
-
5月15日立即下載>> 【白皮書(shū)】精確和高效地表征3000V/20A功率器件應(yīng)用指南
-
5月16日立即參評(píng) >> 【評(píng)選啟動(dòng)】維科杯·OFweek 2025(第十屆)人工智能行業(yè)年度評(píng)選
推薦專(zhuān)題
- 1 UALink規(guī)范發(fā)布:挑戰(zhàn)英偉達(dá)AI統(tǒng)治的開(kāi)始
- 2 北電數(shù)智主辦酒仙橋論壇,探索AI產(chǎn)業(yè)發(fā)展新路徑
- 3 降薪、加班、裁員三重暴擊,“AI四小龍”已折戟兩家
- 4 “AI寒武紀(jì)”爆發(fā)至今,五類(lèi)新物種登上歷史舞臺(tái)
- 5 國(guó)產(chǎn)智駕迎戰(zhàn)特斯拉FSD,AI含量差幾何?
- 6 光計(jì)算迎來(lái)商業(yè)化突破,但落地仍需時(shí)間
- 7 東陽(yáng)光:2024年扭虧、一季度凈利大增,液冷疊加具身智能打開(kāi)成長(zhǎng)空間
- 8 地平線自動(dòng)駕駛方案解讀
- 9 封殺AI“照騙”,“淘寶們”終于不忍了?
- 10 優(yōu)必選:營(yíng)收大增主靠小件,虧損繼續(xù)又逢關(guān)稅,能否乘機(jī)器人東風(fēng)翻身?