Multiple object detection and tracking in autonomous vehicles: A survey on enhanced affinity computation and its multimodal applications☆

Citations

WEB OF SCIENCE

13
Citations

SCOPUS

15

초록

Three-dimensional (3D) object tracking is crucial in computer vision applications, particularly in autonomous driving, robotics, and surveillance. Despite advancements, effectively utilizing multimodal data to improve multi-object detection and tracking (MODT) remains challenging. This study introduces ACMODT, an affinity computation-based multi-object detection and tracking framework that integrates camera (2D) and LiDAR (3D) data for enhanced MODT performance in autonomous driving. This approach leverages EPNet as a backbone, utilizing 2D–3D feature fusion for accurate proposal generation. A deep neural network (DNN) extracts robust appearance and geometric features, while an improved affinity computation module combines Refined Boost Correlation Features (RBCF) and 3D-Extended Geometric IoU (3D-XGIoU) for precise object association. Motion prediction is refined using a Kalman filter (KF), and Gaussian Mixture Model (GMM)-based data association ensures consistent tracking. Experiments on the KITTI car tracking benchmark for quantitative analysis and the RADIATE dataset for visualization demonstrate that our method achieves superior tracking accuracy and precision compared to state-of-the-art multi-object tracking (MOT) approaches, proving its effectiveness for real-time object tracking.

키워드

Deep neural network; Gaussian mixture model-based data association; Affinity computation; Autonomous driving; Multi-object tracking; 3D MULTIOBJECT TRACKING
제목
Multiple object detection and tracking in autonomous vehicles: A survey on enhanced affinity computation and its multimodal applications☆
저자
Altaf, Muhammad Adeel; Kim, Min Young
DOI
10.1016/j.icte.2025.06.005
발행일
2025-08
유형
Article
저널명
ICT Express
권
11
호
4
페이지
809 ~ 818