<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"><channel><title>Lorenzo Vaquero — Publications</title><description>New papers from Lorenzo Vaquero on computer vision, multi-object tracking, human–object interaction, vision–language models, and AI explainability.</description><link>https://vaquero.me/</link><language>en-us</language><item><title>From Weights to Concepts: Data-Free Interpretability of CLIP via Singular Vector Decomposition</title><link>https://vaquero.me/publications/2026-cvpr-from-weights-to-concepts/</link><guid isPermaLink="true">https://vaquero.me/publications/2026-cvpr-from-weights-to-concepts/</guid><description>A data-free, training-free framework that directly analyses CLIP&apos;s vision transformer in weight space, decomposing each attention head into singular vectors linked to textual concepts. (IEEE/CVF Conference on Computer Vision and Pattern Recognition, 2026)</description><pubDate>Thu, 01 Jan 2026 00:00:00 GMT</pubDate><category>Vision-Language Models</category><category>AI Explainability</category><author>Francesco Gentile, Nicola Dall&apos;Asen, Francesco Tonini, Massimiliano Mancini, Lorenzo Vaquero, Elisa Ricci</author></item><item><title>Enabling Efficient Portrait Segmentation on Embedded Devices</title><link>https://vaquero.me/publications/2026-perconai-efficient-portrait-segmentation-embedded-devices/</link><guid isPermaLink="true">https://vaquero.me/publications/2026-perconai-efficient-portrait-segmentation-embedded-devices/</guid><description>SINergy is a scalable portrait segmentation network designed around embedded hardware constraints, reaching real-time segmentation on microcontroller-scale devices. (IEEE International Conference on Pervasive Computing and Communications Workshops, 2026)</description><pubDate>Thu, 01 Jan 2026 00:00:00 GMT</pubDate><category>Embedded Vision</category><category>Efficient Segmentation</category><author>Riccardo Benevelli, Alberto Ancilotto, Lorenzo Vaquero, Elisa Ricci, Elisabetta Farella</author></item><item><title>FineHOI: Part-Aware Dense Representations for Zero-Shot Human-Object Interaction Detection</title><link>https://vaquero.me/publications/2026-acmmm-finehoi/</link><guid isPermaLink="true">https://vaquero.me/publications/2026-acmmm-finehoi/</guid><description>FineHOI detects unseen human-object interactions by reasoning over dense, part-level visual cues, improving fine-grained recognition without LLM or detector features. (ACM International Conference on Multimedia, 2026)</description><pubDate>Thu, 01 Jan 2026 00:00:00 GMT</pubDate><category>Human-Object Interaction</category><category>Vision-Language Models</category><author>Francesco Tonini, Lorenzo Vaquero, Mohammad Mahdi Derakhshani, Cees G. M. Snoek, Elisa Ricci, Cigdem Beyan</author></item><item><title>Humanity&apos;s Last Exam: A Benchmark of Expert-Level Academic Questions to Assess AI Capabilities</title><link>https://vaquero.me/publications/2026-nature-humanitys-last-exam/</link><guid isPermaLink="true">https://vaquero.me/publications/2026-nature-humanitys-last-exam/</guid><description>Humanity&apos;s Last Exam is a multimodal benchmark of 2,500 expert-level closed-ended academic questions designed to measure frontier AI capabilities beyond saturated benchmarks. (Nature, 2026)</description><pubDate>Thu, 01 Jan 2026 00:00:00 GMT</pubDate><category>Benchmarks</category><category>AI Evaluation</category><author>Center for AI Safety, Scale AI, HLE Contributors Consortium</author></item><item><title>Keynote on Overcoming Detector Failures in Online Multi-Object Tracking</title><link>https://vaquero.me/publications/2026-caepia-keynote-lost-and-found/</link><guid isPermaLink="true">https://vaquero.me/publications/2026-caepia-keynote-lost-and-found/</guid><description>This keynote paper summarizes BUSCA, a work published in ECCV&apos;24. BUSCA plugs into online tracking-by-detection systems to recover objects missed by detectors through proposal generation and decision-transformer association. (Conference of the Spanish Association for Artificial Intelligence, 2026)</description><pubDate>Thu, 01 Jan 2026 00:00:00 GMT</pubDate><category>Multi-Object Tracking</category><category>Online Tracking</category><author>Lorenzo Vaquero, Yihong Xu, Xavier Alameda-Pineda, Víctor M. Brea, Manuel Mucientes</author></item><item><title>Keynote on Superpowering Open-Vocabulary Object Detectors for X-ray Vision</title><link>https://vaquero.me/publications/2026-caepia-keynote-superpowering-open-vocabulary-object-detectors-x-ray-vision/</link><guid isPermaLink="true">https://vaquero.me/publications/2026-caepia-keynote-superpowering-open-vocabulary-object-detectors-x-ray-vision/</guid><description>This keynote paper summarizes RAXO, a work published in ICCV&apos;25. RAXO adapts RGB open-vocabulary detectors to X-ray imagery with training-free visual descriptors and introduces DET-COMPASS for large-scale X-ray OvOD evaluation. (Conference of the Spanish Association for Artificial Intelligence, 2026)</description><pubDate>Thu, 01 Jan 2026 00:00:00 GMT</pubDate><category>Open-Vocabulary Detection</category><category>X-ray Vision</category><author>Pablo Garcia-Fernandez, Lorenzo Vaquero, Mingxuan Liu, Feng Xue, Daniel Cores, Nicu Sebe, Manuel Mucientes, Elisa Ricci</author></item><item><title>Towards Unconstrained Human-Object Interaction</title><link>https://vaquero.me/publications/2026-fg-towards-unconstrained-human-object-interaction/</link><guid isPermaLink="true">https://vaquero.me/publications/2026-fg-towards-unconstrained-human-object-interaction/</guid><description>AnyHOI studies human-object interaction detection without a predefined interaction vocabulary, using multimodal LLMs and language-to-graph conversion to recover structured triplets from free-form outputs. (IEEE International Conference on Automatic Face and Gesture Recognition, 2026)</description><pubDate>Thu, 01 Jan 2026 00:00:00 GMT</pubDate><category>Human-Object Interaction</category><category>Multimodal LLMs</category><author>Francesco Tonini, Alessandro Conti, Lorenzo Vaquero, Cigdem Beyan, Elisa Ricci</author></item><item><title>Training-Free Semantic Multi-Object Tracking with Vision-Language Models</title><link>https://vaquero.me/publications/2026-fg-training-free-semantic-multi-object-tracking/</link><guid isPermaLink="true">https://vaquero.me/publications/2026-fg-training-free-semantic-multi-object-tracking/</guid><description>TF-SMOT composes frozen detection, segmentation tracking, video-language generation, and LLM disambiguation modules to produce semantic tracking outputs without task-specific training. (IEEE International Conference on Automatic Face and Gesture Recognition, 2026)</description><pubDate>Thu, 01 Jan 2026 00:00:00 GMT</pubDate><category>Multi-Object Tracking</category><category>Vision-Language Models</category><author>Laurence Bonat, Francesco Tonini, Elisa Ricci, Lorenzo Vaquero</author></item><item><title>Zero-Shot Temporal Action Localization Through Textual Guidance</title><link>https://vaquero.me/publications/2026-fg-zero-shot-temporal-action-localization/</link><guid isPermaLink="true">https://vaquero.me/publications/2026-fg-zero-shot-temporal-action-localization/</guid><description>TeGu compensates for the lack of supervision in zero-shot temporal action localization by exploiting rich textual cues from large language models, distinguishing foreground from background frames without training. (IEEE International Conference on Automatic Face and Gesture Recognition, 2026)</description><pubDate>Thu, 01 Jan 2026 00:00:00 GMT</pubDate><category>Temporal Action Localization</category><category>Vision-Language Models</category><author>Benedetta Liberatori, Alessandro Conti, Lorenzo Vaquero, Paolo Rota, Yiming Wang, Elisa Ricci</author></item><item><title>ConViS-Bench: Estimating Video Similarity Through Semantic Concepts</title><link>https://vaquero.me/publications/2025-neurips-convis-bench/</link><guid isPermaLink="true">https://vaquero.me/publications/2025-neurips-convis-bench/</guid><description>ConViS-Bench evaluates video similarity along semantic concepts, pairing concept-level human scores with free-form descriptions for interpretable video comparison. (Conference on Neural Information Processing Systems Datasets and Benchmarks Track, 2025)</description><pubDate>Wed, 01 Jan 2025 00:00:00 GMT</pubDate><category>Video Understanding</category><category>Benchmarks</category><author>Benedetta Liberatori, Alessandro Conti, Lorenzo Vaquero, Yiming Wang, Elisa Ricci, Paolo Rota</author></item><item><title>Dynamic Scoring with Enhanced Semantics for Training-Free Human-Object Interaction Detection</title><link>https://vaquero.me/publications/2025-acmmm-dynamic-scoring-hoi-detection/</link><guid isPermaLink="true">https://vaquero.me/publications/2025-acmmm-dynamic-scoring-hoi-detection/</guid><description>DYSCO is a training-free HOI detector that combines textual and visual interaction representations in a multimodal registry with dynamic multi-head scoring. (ACM International Conference on Multimedia, 2025)</description><pubDate>Wed, 01 Jan 2025 00:00:00 GMT</pubDate><category>Human-Object Interaction</category><category>Vision-Language Models</category><author>Francesco Tonini, Lorenzo Vaquero, Alessandro Conti, Cigdem Beyan, Elisa Ricci</author></item><item><title>Enhancing Multi-Object Tracking with Segmentation Masks: A Solution for Lost Object Recovery</title><link>https://vaquero.me/publications/2025-ibpria-enhancing-multi-object-tracking-segmentation-masks/</link><guid isPermaLink="true">https://vaquero.me/publications/2025-ibpria-enhancing-multi-object-tracking-segmentation-masks/</guid><description>A lost-track recovery architecture uses segmentation masks and a transformer-based mask selector to preserve tracks when detectors fail in crowded scenes. (Iberian Conference on Pattern Recognition and Image Analysis, 2025)</description><pubDate>Wed, 01 Jan 2025 00:00:00 GMT</pubDate><category>Multi-Object Tracking</category><category>Segmentation</category><author>Manuel Bendaña, Lorenzo Vaquero, Víctor M. Brea, Manuel Mucientes</author></item><item><title>Superpowering Open-Vocabulary Object Detectors for X-ray Vision</title><link>https://vaquero.me/publications/2025-iccv-superpowering-open-vocabulary-object-detectors-x-ray-vision/</link><guid isPermaLink="true">https://vaquero.me/publications/2025-iccv-superpowering-open-vocabulary-object-detectors-x-ray-vision/</guid><description>RAXO adapts RGB open-vocabulary detectors to X-ray imagery with training-free visual descriptors and introduces DET-COMPASS for large-scale X-ray OvOD evaluation. (IEEE/CVF International Conference on Computer Vision, 2025)</description><pubDate>Wed, 01 Jan 2025 00:00:00 GMT</pubDate><category>Open-Vocabulary Detection</category><category>X-ray Vision</category><author>Pablo Garcia-Fernandez, Lorenzo Vaquero, Mingxuan Liu, Feng Xue, Daniel Cores, Nicu Sebe, Manuel Mucientes, Elisa Ricci</author></item><item><title>Lost and Found: Overcoming Detector Failures in Online Multi-Object Tracking</title><link>https://vaquero.me/publications/2024-eccv-lost-and-found/</link><guid isPermaLink="true">https://vaquero.me/publications/2024-eccv-lost-and-found/</guid><description>BUSCA plugs into online tracking-by-detection systems to recover objects missed by detectors through proposal generation and decision-transformer association. (European Conference on Computer Vision, 2024)</description><pubDate>Mon, 01 Jan 2024 00:00:00 GMT</pubDate><category>Multi-Object Tracking</category><category>Online Tracking</category><author>Lorenzo Vaquero, Yihong Xu, Xavier Alameda-Pineda, Víctor M. Brea, Manuel Mucientes</author></item><item><title>AL-GTD: Deep Active Learning for Gaze Target Detection</title><link>https://vaquero.me/publications/2024-acmmm-al-gtd/</link><guid isPermaLink="true">https://vaquero.me/publications/2024-acmmm-al-gtd/</guid><description>AL-GTD reduces gaze target annotation cost by combining supervised and self-supervised signals in an active learning acquisition function with pseudo-labeling. (ACM International Conference on Multimedia, 2024)</description><pubDate>Mon, 01 Jan 2024 00:00:00 GMT</pubDate><category>Gaze Target Detection</category><category>Active Learning</category><author>Francesco Tonini, Nicola Dall&apos;Asen, Lorenzo Vaquero, Cigdem Beyan, Elisa Ricci</author></item><item><title>Live Demonstration: 5-bit signed SRAM-based DNN CIM for Image Recognition</title><link>https://vaquero.me/publications/2024-iscas-live-demonstration-sram-dnn-cim/</link><guid isPermaLink="true">https://vaquero.me/publications/2024-iscas-live-demonstration-sram-dnn-cim/</guid><description>A live mixed-signal compute-in-memory demonstration uses 5-bit signed SRAM weights and PWM-coded images for low-power DNN image recognition. (IEEE International Symposium on Circuits and Systems, 2024)</description><pubDate>Mon, 01 Jan 2024 00:00:00 GMT</pubDate><category>Compute-in-Memory</category><category>Embedded AI</category><author>Ó. Pereira-Rial, D. García-Lesta, Lorenzo Vaquero, P. López, Víctor M. Brea, D. Cabello</author></item><item><title>Real-Time Siamese Multiple Object Tracker with Enhanced Proposals</title><link>https://vaquero.me/publications/2023-pattern-recognition-real-time-siamese-multiple-object-tracker/</link><guid isPermaLink="true">https://vaquero.me/publications/2023-pattern-recognition-real-time-siamese-multiple-object-tracker/</guid><description>SiamMOTION tracks dozens of arbitrary objects in real time through feature-pyramid proposals, attention, inertia, pairwise depthwise RPN matching, and multi-object penalization. (Pattern Recognition, 2023)</description><pubDate>Sun, 01 Jan 2023 00:00:00 GMT</pubDate><category>Multi-Object Tracking</category><category>Real-Time Vision</category><author>Lorenzo Vaquero, Víctor M. Brea, Manuel Mucientes</author></item><item><title>Depth Estimation and Image Restoration by Deep Learning from Defocused Images</title><link>https://vaquero.me/publications/2023-tci-depth-estimation-image-restoration-defocused-images/</link><guid isPermaLink="true">https://vaquero.me/publications/2023-tci-depth-estimation-image-restoration-defocused-images/</guid><description>2HDED:NET jointly estimates depth and restores all-in-focus images from defocused input through a shared encoder and parallel task branches. (IEEE Transactions on Computational Imaging, 2023)</description><pubDate>Sun, 01 Jan 2023 00:00:00 GMT</pubDate><category>Depth Estimation</category><category>Image Restoration</category><author>Saqib Nazir, Lorenzo Vaquero, Manuel Mucientes, Víctor M. Brea, Daniela Coltuc</author></item><item><title>2HDED:NET for Joint Depth Estimation and Image Deblurring from a Single Out-of-Focus Image</title><link>https://vaquero.me/publications/2022-icip-2hded-net/</link><guid isPermaLink="true">https://vaquero.me/publications/2022-icip-2hded-net/</guid><description>2HDED:NET performs depth-from-defocus and all-in-focus image restoration in parallel through a shared encoder and two balanced decoder branches. (IEEE International Conference on Image Processing, 2022)</description><pubDate>Sat, 01 Jan 2022 00:00:00 GMT</pubDate><category>Depth Estimation</category><category>Image Deblurring</category><author>Saqib Nazir, Lorenzo Vaquero, Manuel Mucientes, Víctor M. Brea, Daniela Coltuc</author></item><item><title>Fast Multi-Object Tracking with Feature Pyramid and Region Proposal Networks</title><link>https://vaquero.me/publications/2022-icpr-fast-multi-object-tracking-feature-pyramid-region-proposal-networks/</link><guid isPermaLink="true">https://vaquero.me/publications/2022-icpr-fast-multi-object-tracking-feature-pyramid-region-proposal-networks/</guid><description>SiamFAST brings feature-pyramid ROI extraction, pairwise depthwise RPN matching, and multi-object penalization to real-time arbitrary multi-object tracking. (International Conference on Pattern Recognition, 2022)</description><pubDate>Sat, 01 Jan 2022 00:00:00 GMT</pubDate><category>Multi-Object Tracking</category><category>Real-Time Vision</category><author>Lorenzo Vaquero, Víctor M. Brea, Manuel Mucientes</author></item><item><title>Tracking More Than 100 Arbitrary Objects at 25 FPS Through Deep Learning</title><link>https://vaquero.me/publications/2021-pattern-recognition-tracking-more-than-100-arbitrary-objects/</link><guid isPermaLink="true">https://vaquero.me/publications/2021-pattern-recognition-tracking-more-than-100-arbitrary-objects/</guid><description>SiamMT scales visual object tracking to dozens of arbitrary objects by reusing feature computations and introducing efficient crop-resize and pairwise similarity operators. (Pattern Recognition, 2021)</description><pubDate>Fri, 01 Jan 2021 00:00:00 GMT</pubDate><category>Multi-Object Tracking</category><category>Deep Learning</category><author>Lorenzo Vaquero, Víctor M. Brea, Manuel Mucientes</author></item><item><title>SiamMT: Real-Time Arbitrary Multi-Object Tracking</title><link>https://vaquero.me/publications/2020-icpr-siammt/</link><guid isPermaLink="true">https://vaquero.me/publications/2020-icpr-siammt/</guid><description>SiamMT is a Siamese convolutional architecture for tracking multiple arbitrary objects in real time by sharing frame features and using pairwise cross-correlation. (International Conference on Pattern Recognition, 2020)</description><pubDate>Wed, 01 Jan 2020 00:00:00 GMT</pubDate><category>Multi-Object Tracking</category><category>Siamese Networks</category><author>Lorenzo Vaquero, Manuel Mucientes, Víctor M. Brea</author></item><item><title>Deep Learning for Video Object Detection and Tracking</title><link>https://vaquero.me/publications/2018-wgml-deep-learning-video-object-detection-tracking/</link><guid isPermaLink="true">https://vaquero.me/publications/2018-wgml-deep-learning-video-object-detection-tracking/</guid><description>Brief summary of deep convolutional approaches for small-object detection, real-time multi-object tracking, and integrated traffic monitoring. (Machine Learning Workshop Galicia, 2018)</description><pubDate>Mon, 01 Jan 2018 00:00:00 GMT</pubDate><category>Object Detection</category><category>Multi-Object Tracking</category><author>Brais Bosquet, Mauro Fernández-Sanjurjo, Lorenzo Vaquero, Daniel Cores, Víctor M. Brea, Manuel Mucientes</author></item></channel></rss>