Publication VCode: a Multimodal Coding Benchmark with SVG as Symbolic Visual Representation Kevin Qinghong Lin, Yuhao Zheng, Hangyu Ran, Dantong Zhu, Dongxing Mao, Linjie Li, Philip H. S. Torr, Alex Jinpeng Wang November 2025
Publication Mitigate One, Skew Another? Tackling Intersectional Biases in Text-to-Image Models Pushkar Shukla, Aditya Chinchure, Emily Diana, Alexander Tolbert, Kartik Hosanagar, Vineeth N Balasubramanian, Leonid Sigal, Matthew Turk EMNLP Findings | November 2025
Publication Out of sight, not out of context? Egocentric spatial reasoning in VLMs across disjoint frames Sahithya Ravi, Gabriel Herbert Sarch, Vibhav Vineet, Andrew D. Wilson, Balasaravanan Thoravi Kumaravel Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing | November 2025
Publication Image as a World: Generating Interactive World from Single Image via Panoramic Video Generation Dongnan Gui, Xun Guo, Wengang Zhou, Yan Lu NeurIPS 2025 | November 2025
Publication Linear Differential Vision Transformer: Learning Visual Contrasts via Pairwise Differentials Yifan Pu, Jixuan Ying, Tianzhu Ye, Dongchen Han, Ziyi Wang, Qixiu Li, shao xinyu, Xiaochen Wang, Gao Huang, Xiu Li NeurIPS 2025 | November 2025
Publication When are radiology reports useful for training medical image classifiers? Herman Bergström, Zhongqi Yue, Fredrik D. Johansson ArXiv | October 2025, Vol abs/2510.24385
Publication SNRAware: Improved Deep Learning MRI Denoising with Signal-to-Noise Ratio Unit Training and G-factor Map Augmentation Hui Xue, Sarah M. Hooper, Iain Pierce, Rhodri H. Davies, John Stairs, Joseph Naegele, A. Campbell-Washburn, Charlotte Manisty, James C. Moon, T. Treibel, Peter Kellman, Michael Hansen Radiology: Artificial Intelligence | October 2025, Vol 7(6) Project
Publication RefusalBench: Generative Evaluation of Selective Refusal in Grounded Language Models Aashiq Muhamed, Leonardo F. R. Ribeiro, Markus Dreyer, Virginia Smith, Mona T. Diab CVPR 2005 | October 2025
Publication Semantic Visual Anomaly Detection and Reasoning in AI-Generated Images Chuangchuang Tan, Xiang Ming, Jinglu Wang, Renshuai Tao, Bin Li, Yunchao Wei, Yao Zhao, Yan Lu ICLR 2026 | October 2025
Publication Video-LMM Post-Training: A Deep Dive into Video Reasoning with Large Multimodal Models Yunlong Tang, Jing Bi, Pinxin Liu, Zhenyu Pan, Zhangyun Tan, Qianxiang Shen, Jiani Liu, Hang Hua, Junjia Guo, Yunzhong Xiao, Chao Huang, Zhiyuan Wang, Susan Liang, Xinyi Liu, Yizhi Song, Yuhe Nie, Jia-Xing Zhong, Bozheng Li, Daiqing Qi, Ziyun Zeng, A. Vosoughi, Luchuan Song, Zeliang Zhang, D. Shimada, Han Liu, Jiebo Luo, Chenliang Xu October 2025 arXiv | October 2025