SpaRC: Sparse Radar-Camera Fusion for 3D Object Detection

Philipp Wolters, Johannes Gilg, Torben Teepe, Fabian Herzog, Felix Fent, Gerhard Rigoll

2024-11-29Autonomous Driving Object Localization Depth Estimation 3D Multi-Object Tracking object-detection 3D Object Detection Object Detection

Paper PDF

Abstract

In this work, we present SpaRC, a novel Sparse fusion transformer for 3D perception that integrates multi-view image semantics with Radar and Camera point features. The fusion of radar and camera modalities has emerged as an efficient perception paradigm for autonomous driving systems. While conventional approaches utilize dense Bird's Eye View (BEV)-based architectures for depth estimation, contemporary query-based transformers excel in camera-only detection through object-centric methodology. However, these query-based approaches exhibit limitations in false positive detections and localization precision due to implicit depth modeling. We address these challenges through three key contributions: (1) sparse frustum fusion (SFF) for cross-modal feature alignment, (2) range-adaptive radar aggregation (RAR) for precise object localization, and (3) local self-attention (LSA) for focused query aggregation. In contrast to existing methods requiring computationally intensive BEV-grid rendering, SpaRC operates directly on encoded point features, yielding substantial improvements in efficiency and accuracy. Empirical evaluations on the nuScenes and TruckScenes benchmarks demonstrate that SpaRC significantly outperforms existing dense BEV-based and sparse query-based detectors. Our method achieves state-of-the-art performance metrics of 67.1 NDS and 63.1 AMOTA. The code and pretrained models are available at https://github.com/phi-wol/sparc.

Results

Task	Dataset	Metric	Value	Model
Multi-Object Tracking	nuscenes Camera-Radar	AMOTA	0.631	SpaRC
Object Tracking	nuscenes Camera-Radar	AMOTA	0.631	SpaRC
Object Detection	nuScenes	NDS	0.699	SpaRC
Object Detection	nuScenes	mAP	0.646	SpaRC
Object Detection	nuscenes Camera-Radar	NDS	69.9	SpaRC
Object Detection	TruckScenes	NDS	37.4	SpaRC
Object Detection	TruckScenes	mAP	27.2	SpaRC
3D	nuScenes	NDS	0.699	SpaRC
3D	nuScenes	mAP	0.646	SpaRC
3D	nuscenes Camera-Radar	NDS	69.9	SpaRC
3D	TruckScenes	NDS	37.4	SpaRC
3D	TruckScenes	mAP	27.2	SpaRC
3D Object Detection	nuScenes	NDS	0.699	SpaRC
3D Object Detection	nuScenes	mAP	0.646	SpaRC
3D Object Detection	nuscenes Camera-Radar	NDS	69.9	SpaRC
3D Object Detection	TruckScenes	NDS	37.4	SpaRC
3D Object Detection	TruckScenes	mAP	27.2	SpaRC
3D Multi-Object Tracking	nuscenes Camera-Radar	AMOTA	0.631	SpaRC
2D Classification	nuScenes	NDS	0.699	SpaRC
2D Classification	nuScenes	mAP	0.646	SpaRC
2D Classification	nuscenes Camera-Radar	NDS	69.9	SpaRC
2D Classification	TruckScenes	NDS	37.4	SpaRC
2D Classification	TruckScenes	mAP	27.2	SpaRC
2D Object Detection	nuScenes	NDS	0.699	SpaRC
2D Object Detection	nuScenes	mAP	0.646	SpaRC
2D Object Detection	nuscenes Camera-Radar	NDS	69.9	SpaRC
2D Object Detection	TruckScenes	NDS	37.4	SpaRC
2D Object Detection	TruckScenes	mAP	27.2	SpaRC
16k	nuScenes	NDS	0.699	SpaRC
16k	nuScenes	mAP	0.646	SpaRC
16k	nuscenes Camera-Radar	NDS	69.9	SpaRC
16k	TruckScenes	NDS	37.4	SpaRC
16k	TruckScenes	mAP	27.2	SpaRC

SpaRC: Sparse Radar-Camera Fusion for 3D Object Detection

Abstract

Results

Related Papers

SpaRC: Sparse Radar-Camera Fusion for 3D Object Detection

Abstract

Results

Related Papers