Publication Does LLM Alignment Really Need Diversity? An Empirical Study of Adapting RLVR Methods for Moral Reasoning Zhaowei Zhang, Xiaohan Liu, Xue-Peng Zhu, Junchao Huang, Ceyao Zhang, Zhiyuan Feng, Yaodong Yang, Xiaoyuan Yi, Xing Xie March 2026 arXiv | March 2026
Publication Social-R1: Towards Human-like Social Reasoning in LLMs Jincenzi Wu, Yuxuan Lei, Jianxun Lian, Yitian Huang, Lexin Zhou, Haotian Li, Xing Xie, Helen M. Meng March 2026 arXiv | March 2026
Publication Video-Based Reward Modeling for Computer-Use Agents Lin-Xin Song, Jieyu Zhang, Huan-Xin Sheng, Taiwei Shi, G. Rahul, Yang Liu, Ranjay Krishna, Jian Kang, Jie-Yu Zhao ArXiv | March 2026, Vol abs/2603.10178
Publication StreamReady: Learning What to Answer and When in Long Streaming Videos Shehreen Azad, Vibhav Vineet, Y. Rawat CVPR 2026 | March 2026
Publication Reject, Resample, Repeat: Understanding Parallel Reasoning in Language Model Inference Noah Golowich, Fan Chen, Dhruv Rohatgi, Raghav Singhal, Carles Domingo-Enrich, Dylan Foster, Akshay Krishnamurthy March 2026 arXiv | March 2026
Publication X-AVDT: Audio-Visual Cross-Attention for Robust Deepfake Detection Youngseo Kim, Kwan Yun, Seokhyeon Hong, Sihun Cha, Colette Suhjung Koo, J. Noh March 2026 arXiv | March 2026
Publication SynthCraft: an AI partner for synthetic data generation to support data access and augmentation in healthcare Thomas Callender, Anders Boyd, Robert Davis, Silas Ruhrberg Estevez, Juan M. Lavista Ferres, Mihaela van der Schaar PLOS Digital Health | March 2026 Project
Publication CAReDiO: Cultural Alignment via Representativeness and Distinctiveness Guided Data Optimization Jing Yao, Xiaoyuan Yi, Jindong Wang, Zhicheng Dou, Xing Xie ICML 2026 | March 2026
Publication Scaling Data Difficulty: Improving Coding Models via Reinforcement Learning on Fresh and Challenging Problems Zongqian Li, Tengchao Lv, Shaohan Huang, Yixuan Su, Qinzheng Sun, Qiufeng Yin, Ying Xin, Scarlett Li, Lei Cui, Nigel Collier, Furu Wei March 2026 arXiv | March 2026
Publication Breaking Training Bottlenecks: Effective and Stable Reinforcement Learning for Coding Models Zongqian Li, Shaohan Huang, Zewen Chi, Yixuan Su, Lexin Zhou, Li Dong, Nigel Collier, Furu Wei March 2026 arXiv | March 2026