AI-For-Beginners/translations/et/lessons/4-ComputerVision/11-ObjectDetection
localizeflow[bot] 22b9d24a81 chore(i18n): sync translations with latest source changes (chunk 1/1, 201 changes) 2026-01-30 02:58:31 +00:00
..
lab chore(i18n): sync translations with latest source changes (chunk 1/1, 201 changes) 2026-01-30 02:58:31 +00:00
ObjectDetection.ipynb 🌐 Update translations via Co-op Translator 2025-10-11 13:07:31 +00:00
README.md chore(i18n): sync translations with latest source changes (chunk 1/1, 201 changes) 2026-01-30 02:58:31 +00:00

README.md

Objektide tuvastamine

Pildiklassifikatsiooni mudelid, millega oleme seni tegelenud, vĂ”tsid pildi ja andsid kategoorilise tulemuse, nĂ€iteks klassi 'number' MNIST-probleemis. Kuid paljudel juhtudel ei taha me lihtsalt teada, et pilt kujutab objekte – me tahame mÀÀrata nende tĂ€pse asukoha. Just seda eesmĂ€rki tĂ€idab objektide tuvastamine.

Eelloengu viktoriin

Objektide tuvastamine

Pilt YOLO v2 veebilehelt

Naivne lÀhenemine objektide tuvastamisele

Oletame, et tahame leida kassi pildilt. VÀga naiivne lÀhenemine objektide tuvastamisele oleks jÀrgmine:

  1. Jagame pildi mitmeks vÀiksemaks osaks.
  2. KĂ€ivitame pildiklassifikatsiooni igal osal.
  3. Need osad, mis annavad piisavalt kÔrge aktiveerimise, vÔib pidada objektiks, mida otsime.

Naivne objektide tuvastamine

Pilt harjutuste mÀrkmikust

Kuid see lĂ€henemine pole ideaalne, kuna see vĂ”imaldab algoritmil mÀÀrata objekti piiritleva kasti asukohta vĂ€ga ebatĂ€pselt. TĂ€psema asukoha mÀÀramiseks peame kasutama mingisugust regressiooni, et ennustada piiritlevate kastide koordinaate – ja selleks on vaja spetsiifilisi andmekogumeid.

Regressioon objektide tuvastamiseks

See blogipostitus pakub suurepÀrast sissejuhatust kujundite tuvastamisse.

Andmekogumid objektide tuvastamiseks

Selle ĂŒlesande jaoks vĂ”ite kohata jĂ€rgmisi andmekogumeid:

  • PASCAL VOC – 20 klassi
  • COCO – Tavalised objektid kontekstis. 80 klassi, piiritlevad kastid ja segmentatsioonimaskid

COCO

Objektide tuvastamise mÔÔdikud

Ühisosa ja ĂŒhenduse suhe (Intersection over Union)

Kui pildiklassifikatsiooni puhul on lihtne mÔÔta, kui hĂ€sti algoritm töötab, siis objektide tuvastamise puhul peame mÔÔtma nii klassi Ă”igsust kui ka tuvastatud piiritleva kasti asukoha tĂ€psust. Viimase jaoks kasutame nn ĂŒhisosa ja ĂŒhenduse suhet (IoU), mis mÔÔdab, kui hĂ€sti kaks kasti (vĂ”i kaks suvalist ala) kattuvad.

IoU

Joonis 2 sellest suurepÀrasest blogipostitusest IoU kohta

Idee on lihtne – jagame kahe kujundi ĂŒhisosa pindala nende ĂŒhenduse pindalaga. Kahe identse ala puhul oleks IoU vÀÀrtus 1, samas kui tĂ€iesti eraldatud alade puhul oleks see 0. Muudel juhtudel varieerub see 0 ja 1 vahel. Tavaliselt arvestame ainult neid piiritlevaid kaste, mille IoU ĂŒletab teatud vÀÀrtuse.

Keskmine tÀpsus (Average Precision)

Oletame, et tahame mÔÔta, kui hÀsti tuvastatakse teatud klassi objekte C. Selleks kasutame keskmise tÀpsuse mÔÔdikut, mis arvutatakse jÀrgmiselt:

  1. VÔtame tÀpsuse ja tagasikutsumise kÔvera, mis nÀitab tÀpsust sÔltuvalt tuvastamise lÀve vÀÀrtusest (vahemikus 0 kuni 1).
  2. SÔltuvalt lÀvest tuvastatakse pildil rohkem vÔi vÀhem objekte ning tÀpsuse ja tagasikutsumise vÀÀrtused muutuvad.
  3. KÔver nÀeb vÀlja selline:

Pilt NeuroWorkshopist

Keskmine tĂ€psus klassi C jaoks on selle kĂ”vera alune pindala. TĂ€psemalt jagatakse tagasikutsumise telg tavaliselt 10 osaks ja tĂ€psus keskmistatakse kĂ”igi nende punktide ĂŒle:


AP = {1\over11}\sum_{i=0}^{10}\mbox{Precision}(\mbox{Recall}={i\over10})

AP ja IoU

Arvestame ainult neid tuvastusi, mille IoU ĂŒletab teatud vÀÀrtuse. NĂ€iteks PASCAL VOC andmekogumis eeldatakse tavaliselt \mbox{IoU Threshold} = 0.5, samas kui COCO-s mÔÔdetakse AP-d erinevate \mbox{IoU Threshold} vÀÀrtuste jaoks.

Pilt NeuroWorkshopist

Keskmine keskmine tĂ€psus – mAP

Peamine objektide tuvastamise mÔÔdik on keskmine keskmine tĂ€psus ehk mAP. See on keskmise tĂ€psuse vÀÀrtus, keskmistatud kĂ”igi objektiklasside ja mĂ”nikord ka \mbox{IoU Threshold} ĂŒle. TĂ€psemalt on mAP arvutamise protsess kirjeldatud selles blogipostituses ja siin koos koodinĂ€idetega.

Erinevad objektide tuvastamise lÀhenemised

Objektide tuvastamise algoritme on kahte laia klassi:

  • Piirkonna ettepanekuvĂ”rgud (R-CNN, Fast R-CNN, Faster R-CNN). Peamine idee on genereerida huvipiirkonnad (ROI) ja kĂ€ivitada nende ĂŒle CNN, otsides maksimaalset aktiveerimist. See on natuke sarnane naiivse lĂ€henemisega, vĂ€lja arvatud see, et ROIsid genereeritakse nutikamalt. Üks peamisi puudusi sellistel meetoditel on see, et need on aeglased, kuna vajame CNN klassifikaatori mitut lĂ€bimist pildi ĂŒle.
  • Ühe lĂ€bimise (YOLO, SSD, RetinaNet) meetodid. Nendes arhitektuurides kujundatakse vĂ”rk nii, et see ennustaks nii klasse kui ka ROIsid ĂŒhe lĂ€bimisega.

R-CNN: Piirkonna pÔhine CNN

R-CNN kasutab Selective Search, et genereerida ROI piirkondade hierarhiline struktuur, mis seejÀrel lÀbib CNN-i funktsioonide ekstraktorid ja SVM-klassi mÀÀrajad, et mÀÀrata objekti klass, ning lineaarse regressiooni, et mÀÀrata piiritleva kasti koordinaadid. Ametlik artikkel

RCNN

Pilt van de Sande et al. ICCV’11

RCNN-1

Pildid sellest blogist

F-RCNN – Kiire R-CNN

See lÀhenemine on sarnane R-CNN-iga, kuid piirkonnad mÀÀratakse pÀrast konvolutsioonikihtide rakendamist.

FRCNN

Pilt ametlikust artiklist, arXiv, 2015

Kiirem R-CNN

Selle lĂ€henemise peamine idee on kasutada nĂ€rvivĂ”rku ROIside ennustamiseks – nn piirkonna ettepanekuvĂ”rk. Artikkel, 2016

FasterRCNN

Pilt ametlikust artiklist

R-FCN: Piirkonna pÔhine tÀielikult konvolutsiooniline vÔrk

See algoritm on isegi kiirem kui Faster R-CNN. Peamine idee on jÀrgmine:

  1. Ekstraheerime funktsioonid ResNet-101 abil.
  2. Funktsioone töödeldakse positsioonitundliku skoorikaardiga. Iga objekt klassist C jagatakse k\times k piirkondadeks ja treenime ennustama objektide osi.
  3. Iga osa k\times k piirkondadest hÀÀletavad kÔik vÔrgud objektiklasside eest ja maksimaalse hÀÀlega objektiklass valitakse.

r-fcn pilt

Pilt ametlikust artiklist

YOLO – You Only Look Once

YOLO on reaalajas ĂŒhe lĂ€bimise algoritm. Peamine idee on jĂ€rgmine:

  • Pilt jagatakse S\times S piirkondadeks.
  • Iga piirkonna jaoks ennustab CNN n vĂ”imalikku objekti, piiritleva kasti koordinaate ja usaldusvÀÀrsust=tĂ”enĂ€osust * IoU.

YOLO

Pilt ametlikust artiklist

Muud algoritmid

✍ Harjutused: Objektide tuvastamine

JÀtkake Ôppimist jÀrgmises mÀrkmikus:

ObjectDetection.ipynb

KokkuvÔte

Selles tunnis tegite kiirĂŒlevaate erinevatest viisidest, kuidas objektide tuvastamist saab teostada!

🚀 VĂ€ljakutse

Lugege lÀbi need artiklid ja mÀrkmikud YOLO kohta ning proovige neid ise:

JĂ€relloengu viktoriin

Ülevaade ja iseseisev Ă”ppimine

Ülesanne: Objektide tuvastamine


LahtiĂŒtlus:
See dokument on tĂ”lgitud, kasutades AI tĂ”lketeenust Co-op Translator. Kuigi pĂŒĂŒame tagada tĂ€psust, palun arvestage, et automaatsed tĂ”lked vĂ”ivad sisaldada vigu vĂ”i ebatĂ€psusi. Algne dokument selle algses keeles tuleks lugeda autoriteetseks allikaks. Olulise teabe puhul on soovitatav kasutada professionaalset inimtĂ”lget. Me ei vastuta selle tĂ”lke kasutamisest tulenevate arusaamatuste vĂ”i valesti tĂ”lgenduste eest.