Código QR

OmDet: Large‐scale vision‐language multi‐dataset pre‐training with multimodal detection network

Abstract The advancement of object detection (OD) in open‐vocabulary and open‐world scenarios is a critical challenge in computer vision. OmDet, a novel language‐aware object detection architecture and an innovative training mechanism that harnesses continual learning and multi‐dataset vision‐langua...

Descrición completa

Gardado en:
Detalles Bibliográficos
Principais autores: Tiancheng Zhao, Peng Liu, Kyusong Lee
Formato: Artigo
Idioma:Inglês
Publicado: Wiley 2024-08-01
Series:IET Computer Vision
Assuntos:
Acceso en liña:https://doi.org/10.1049/cvi2.12268
Tags: Engadir etiqueta
Sen Etiquetas, Sexa o primeiro en etiquetar este rexistro!