En semantisk beskrivning av mÀnniskan i bild och video Àr ett av de fundamentala problemen inom datorseende med en lÄng rad applikationer.
Datorseende
Exempel pÄ applikationer finns inom visuell övervakning, ansiktsigenkÀnning, hÀlsovÄrd, sökmotorer för bild och video, taggning och inte minst för interaktionen mellan mÀnniska och maskin.
MÀnniskor har en enastÄende förmÄga nÀr det kommer till att upptÀcka olika sÀrdrag pÄ en mÀnniska, som (1) Älder, kön, frisyr, klÀdstil (2) aktiviteter som ridning, klÀttring, löpning eller promenad liksom (3) ansiktsuttryck som ilska, skratt eller leende.
Vi utvecklar en helt ny lösning för djupinlÀrning för det utmanande problemet att semantiskt tolka en mÀnniska pÄ bilder och videor.
Tonvikten lÀggs pÄ att undersöka ett antal delproblem som exempelvis effektiv bild- och videobeskrivning, automatiskt inlÀrning frÄn visuella modeller, lÀrande frÄn text och visuella data liksom att fÄ fram robusta metoder som fungerar med minimal övervakning.
Externa partner
Rao Muhammad Anwer
Ett urval av tre publikationer
- Bertil Grelsson, Michael Felsberg, Folke Isaksson (2016), , Journal of Field Robotics
- Kristoffer ĂfjĂ€ll, Michael Felsberg, Andreas Robinson (2016), , Intelligent Vehicles Symposium (IV)
- Michael Felsberg (2018),Â