Residual Vision Transformer and Adaptive Fusion Autoencoders for Monocular Depth Estimation

Wei-Jong Yang1, Chih-Chen Wu2, Jar-Ferr Yang2

  • 1Department of Artificial Intelligence and Computer Engineering, National Chin-Yi University of Technology, Taichung 411, Taiwan.

PubMed
Summary

This study introduces a novel autoencoder for monocular depth estimation, enhancing 3D sensing with a single camera. The model achieves superior accuracy and reduced error in depth map prediction, improving applications like autonomous driving.