This is the first large-scale empirical study of 194 publicly available VLMs, including 16 model families, covering a wide range of model sizes, 24 training datasets, and three evaluation benchmarks, namely ImageNet (overall performance), CelebA (typical single-attribute bias), and UrbanCars (complex multi-attribute biases).
Ioannis Sarridis, Ioannis Kompatsiaris, Symeon Papadopoulos· 0 citations
Terminal points Avoidance through Noise Guided Optimization (TANGO) is introduced, which uses the diffusion model as a critic of its own outputs, by predicting one step forward and requiring an isotropic Gaussian noise prediction.
Dimitrios Karageorgiou, Symeon Papadopoulos, Ioannis Kompatsiaris et al.· 0 citations