본문 바로가기

AI Theory/CV

[Paper Review] BLIP-2: Bootstrapping Language-Image Pre-trainingwith Frozen Image Encoders and Large Language Models