Valentin Gabeff, Marc Rußwurm, Devis Tuia, Alexander Mathis: WildCLIP: Scene and animal attribute retrieval from camera trap data with domain-adapted vision-language models. Zenodo 2024