Publication FLAVARS: A Multimodal Foundational Language and Vision Alignment Model for Remote Sensing Isaac Corley, Simone Fobi Nsutezo, Anthony Ortiz, Caleb Robinson, Rahul Dodhia, Juan M. Lavista Ferres, Peyman Najafirad January 2025 Project
Publication Exploring Scalable Medical Image Encoders Beyond Text Supervision Fernando Pérez-García, Harshita Sharma, Sam Bond-Taylor, Kenza Bouzid, Valentina Salvatelli, Maximilian Ilse, Shruthi Bannur, Daniel Coelho de Castro, Anton Schwaighofer, Matthew P Lungren, Noel Codella, Stephanie Hyland, Javier Alvarez-Valle, Ozan Oktay Nature Machine Intelligence | January 2025, Vol 7: pp. 119-130 Access Project
Publication PEACE: Empowering Geologic Map Holistic Understanding with MLLMs Yangyu Huang, Tianyi Gao, Haoran Xu, Qihao Zhao, Yang Song, Zhipeng Gui, Tengchao Lv, Hao Cheng, Lei Cui, Scarlett Li, Furu Wei January 2025 Access
Publication VLM-driven Behavior Tree for Context-aware Task Planning Naoki Wake, Atsushi Kanehira, Jun Takamatsu, Kazuhiro Sasabuchi, Katsushi Ikeuchi January 2025 arXiv | January 2025
Publication TorchGeo: Deep Learning With Geospatial Data Adam J. Stewart, Caleb Robinson, Isaac A. Corley, Anthony Ortiz, Juan M. Lavista Ferres, Arindam Banerjee ACM Transactions on Spatial Algorithms and Systems | January 2025 Project
Publication PGRID: Power Grid Reconstruction in Informal Developments Using High-Resolution Aerial Imagery Simone Fobi Nsutezo, Amrita Gupta, Duncan Kebut, Seema Iyer, Luana Marotti, Rahul Dodhia, Juan M. Lavista Ferres, Anthony Ortiz Proceedings of the Winter Conference on Applications of Computer Vision | January 2025 Project Project Project
Publication Mapping Refugee Camps with AI: A Benchmark Dataset and Baseline Models for Humanitarian Applications Amrita Gupta, Anthony Ortiz, Simone Fobi Nsutezo, Duncan Kebut, Seema Iyer, Rahul Dodhia, Juan M. Lavista Ferres Proceedings of the Winter Conference on Applications of Computer Vision | January 2025
Publication GASP: Gaussian Avatars with Synthetic Priors Jack Saunders, Charlie Hewitt, Yanan Jian, Marek Kowalski (HE/HIM), Tadas Baltrusaitis, Yiye Chen, Prof. Darren Cosker, Virginia Estellers, Nicholas Gyde, Vinay Namboodiri, Ben Lundell Computer Vision and Pattern Recognition | January 2025 Video
Publication VidTok: A Versatile and Open-Source Video Tokenizer Anni Tang, Tianyu He, Junliang Guo, Xinle Cheng, Li Song, Jiang Bian December 2024 ArXiv | December 2024 Github
Publication Modality-Driven Design for Multi-Step Dexterous Manipulation: Insights from Neuroscience Naoki Wake, Atsushi Kanehira, Daichi Saito, Jun Takamatsu, Kazuhiro Sasabuchi, Hideki Koike, Katsushi Ikeuchi December 2024 arXiv | December 2024