Robuta

https://arxiv.org/abs/2306.06691 [2306.06691] Self-Enhancement Improves Text-Image Retrieval in Foundation Visual-Language Models Abstract page for arXiv paper 2306.06691: Self-Enhancement Improves Text-Image Retrieval in Foundation Visual-Language Models