Leveraging two-dimensional pre-trained vision transformers for three-dimensional model generation via masked

Muhammad Sajid1, Kaleem Razzaq Malik1, Ateeq Ur Rehman2,3,4

  • 1Department of Computer Science, Air University, Islamabad, 44230, Pakistan.

Scientific Reports
|January 25, 2025
PubMed
Summary

This study introduces a novel self-supervised learning method for 3D point clouds, leveraging 2D image pre-training. The approach effectively transfers knowledge from vision transformers to enhance 3D feature learning, achieving high accuracy on downstream tasks.