Visualoverload: Probing visual understanding of vlms in really dense scenes
Autorzy:
Paul Gavrikov, Wei Lin, M. Jehanzeb Mirza, Soumya Jahagirdar, Muhammad Huzaifa, Sivan Doveh, Serena Yeung-Levy, James Glass, Hilde Kuehne
Opublikowane w:
CVPR, 2026
Wydawca:
cvf
CAV-MAE Sync: Improving Contrastive Audio-Visual Mask Autoencoders via Fine-Grained Alignment
Autorzy:
Edson Araujo, Andrew Rouditchenko, Yuan Gong, Saurabhchand Bhati, Samuel Thomas, Brian Kingsbury, Leonid Karlinsky, Rogerio Feris, James R. Glass, Hilde Kuehne
Opublikowane w:
CVPR, 2025
Wydawca:
CVF
LeGrad: An Explainability Method for Vision Transformers via Feature Formation Sensitivity
Autorzy:
Walid Bousselham, Angie Boggust, Sofian Chaybouti, Hendrik Strobelt, Hilde Kuehne
Opublikowane w:
ICCV, 2025
Wydawca:
cvf
DEX-AR: A Dynamic Explainability Method for Autoregressive Vision-Language Models
Autorzy:
Walid Bousselham, Angie Boggust, Hendrik Strobelt, Hilde Kuehne
Opublikowane w:
ECCV, 2026
Wydawca:
Springer
VideoGEM: Training-free Action Grounding in Videos
Autorzy:
Felix Vogel, Walid Bousselham, Anna Kukleva, Nina Shvetsova, Hilde Kuehne
Opublikowane w:
CVPR, 2025
Wydawca:
cvf
MM-TS: Multi-Modal Temperature and Margin Schedules for Contrastive Learning with Long-Tail Data
Autorzy:
Siarhei Sheludzko, Dhimitrios Duka, Bernt Schiele, Hilde Kuehne, Anna Kukleva
Opublikowane w:
WACV, 2026
Wydawca:
cvf
MaskInversion: Localized Embeddings via Optimization of Explainability Maps
Autorzy:
Walid Bousselham, Sofian Chaybouti, Christian Rupprecht, Vittorio Ferrari, Hilde Kuehne
Opublikowane w:
ICLR, 2026
Wydawca:
ICLR