:CLIP,

Naoki Kato1, Yoshiki Nota2, Yoshimitsu Aoki1

  • 1Department of Electrical Engineering, Faculty of Science and Technology, Keio University, 3-14-1 Hiyoshi, Kohoku-ku, Yokohama 223-8522, Kanagawa, Japan.

PubMed
概括

原始适配器增强了像CLIP这样的大型视觉语言模型的几次拍摄识别. 这种方法使用基于类原型的恒定尺寸适配器,性能优于以前的方法,并使得部署效率高.