An Explainable CNN and Vision Transformer-Based Approach for Real-Time Food Recognition.

Kintoh Allen Nfor1, Tagne Poupi Theodore Armand2, Kenesbaeva Periyzat Ismaylovna1

  • 1Department of Computer Engineering, Inje University, Gimhae 50834, Republic of Korea.

Nutrients
|January 25, 2025
PubMed
Summary

This study combines Convolutional Neural Networks (CNNs) and Vision Transformers (ViTs) for advanced food image recognition. The hybrid model achieves superior accuracy in classifying diverse food items, enhancing nutritional analysis.