Publication Lens: Rethinking Training Efficiency for Foundational Text-to-Image Models Dong Chen, Fangyun Wei, Ziyu Wan, Dongdong Chen, Jiawei Zhang, Jinjing Zhao, Sirui Zhang, Yang Yue, Zhiyang Liang, Baining Guo, Chong Luo, Jianmin Bao, Ji Li, Lei Shi, Qinhong Yang, Xiuyu Wu, Xuelu Feng, Yan Lu, Yanchen Dong, Yitong Wang, Yun Chen May 2026 arXiv | May 2026
Publication A Nash Equilibrium Framework For Training-Free Multimodal Step Verification Rohit Sinha, Kunal Tilaganji, Tanuja Ganu, Nagarajan Natarajan, Amit Sharma, Vineeth N Balasubramanian International Conference on Learning Representations | May 2026
Publication Visualizing the Invisible: Generative Visual Grounding Empowers Universal EEG Understanding in MLLMs Junyu Pan, Yansen Wang, Enze Zhang, Bao-Liang Lu, Weilong Zheng, Dongsheng Li May 2026 arXiv | May 2026
Publication TaskGround: Structured Executable Task Inference for Full-Scene Household Reasoning Zhiyuan Feng, Yu Deng, Ruichuan An, Zhenhua Liu, Qixiu Li, Keming Wu, Zhiying Du, Weijie Wang, Haoxiao Wang, Shuang Chen, Sicheng Xu, Yaobo Liang, Jiaolong Yang, Baining Guo May 2026 arXiv | May 2026
Publication An Efficient Streaming Video Understanding Framework with Agentic Control Jinming Liu, Jianguo Huang, Zhaoyang Jia, Jiahao Li, Xiaoyi Zhang, Zongyu Guo, Bin Li, Wenjun Zeng, Yan Lu, Xin Jin May 2026 arXiv | May 2026
Publication Video Models Can Reason with Verifiable Rewards Tinghui Zhu, Sheng Zhang, James Y. Huang, Selena Song, Xiaofei Wen, Yuankai Li, Hoifung Poon, Muhao Chen May 2026 arXiv | May 2026
Publication InsightTok: Improving Text and Face Fidelity in Discrete Tokenization for Autoregressive Image Generation Yang Yue, Fangyun Wei, Tianyu He, Jinjing Zhao, Zanlin Ni, Zeyu Liu, Junliang Guo, Lei Shi, Yue Dong, Li Chen, Ji Li, Gao Huang, Dong Chen May 2026 arXiv | May 2026
Publication MorphoHELM: A Comprehensive Benchmark for Evaluating Representations for Microscopy-Based Morphology Assays Emre Hayir, Lorin Crawford, Alex Lu May 2026 arXiv | May 2026
Publication PDCR: Perception-Decomposed Confidence Reward for Vision-Language Reasoning Heegeon Yoon, Eunseop Yoon, Jinqiu Hong, Soo-Hwan Eom, Gwanhyeong Koo, M. Hasegawa-Johnson, Qi Dai, Chong Luo, C. D. Yoo CVPR 2026 | May 2026
Publication No One Knows the State of the Art in Geospatial Foundation Models Isaac Corley, Nils Lehmann, Caleb Robinson, Gabriel Tseng, Anthony Fuller, Hamed Alemohammad, Evan Shelhamer, Jennifer Marcus, Hannah Kerner May 2026 arXiv | May 2026