ECCT: Efficient Contrastive Clustering via Pseudo-Siamese Vision Transformer and Multi-view Augmentation

Xing Wei1, Taizhang Hu2, Di Wu3

  • 1School of Computer and Information, Hefei University of Technology, Hefei, 230601, China; Intelligent Manufacturing Technology Research Institute, Hefei University of Technology, Hefei, 230601, China.

Summary

This study introduces Efficient Contrastive Clustering via Pseudo-Siamese Vision Transformer and Multi-view Augmentation (ECCT) for improved image clustering. ECCT enhances feature representation by integrating global information and semantic continuity, outperforming existing methods.

Related Concept Videos