Publication Auditing Agent Harness Safety Chengzhi Liu, Yicheng Guo, Yepeng Liu, Yuzhe Yang, Qianqi Yan, Xuandong Zhao, Wenyue Hua, Shengchao Liu, Sharon Li, Yuheng Bu, Xin Wang May 2026 arXiv | May 2026
Publication LIFT: Last-Mile Fine-Tuning for Table Explicitation Divij Khaitan, Ashish Tiwari May 2026 arXiv | May 2026
Publication Inducing Artificial Uncertainty in Language Models Sophia Hager, Simon Zeng, Nicholas Andrews May 2026 arXiv | May 2026
Publication FIND: Toward Multimodal Financial Reasoning and Question Answering for Indic Languages Sarmistha Das, V. Vishal, Syed Ibrahim Ahmad, Manish Gupta, Sriparna Saha May 2026 arXiv | May 2026
Publication GEAR: Granularity-Adaptive Advantage Reweighting for LLM Agents via Self-Distillation Sijia Li, Yuchen Huang, Zifan Liu, Yanping Li, Jingjing Fu, Li Zhao, Jiang Bian, Ling Zhang, Jun Zhang, Rui Wang May 2026 arXiv | May 2026
Publication Agent-BRACE: Decoupling Beliefs from Actions in Long-Horizon Tasks via Verbalized State Uncertainty Joykirat Singh, Zaid Khan, Archiki Prasad, Junyan Chen, Akshay Nambi, Hyunji Lee, Elias Stengel-Eskin, Mohit Bansal May 2026 arXiv | May 2026
Publication From Noise to Diversity: Random Embedding Injection in LLM Reasoning Heeju Kim, Seungpil Lee, J. Yeom, Jaewon Sok, Seonghyeon Park, Jeongjae Park, Taesup Kim, Sundong Kim May 2026 arXiv | May 2026
Publication DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning Haoyu Huang, Jiaxin Bai, Shujie Liu, Yang Wei, Hong Ting Tsang, Yisen Gao, Zhongwei Xie, Yufei Li, Yangqiu Song May 2026 arXiv | May 2026
Publication Generating Leakage-Free Benchmarks for Robust RAG Evaluation Jiayi Liu, Jiaxing Zhang, Bowen Jin, Jennifer Neville May 2026 arXiv | May 2026
Publication When Are Experts Misrouted? Counterfactual Routing Analysis in Mixture-of-Experts Language Models Youngsik Yoon, Siwei Wang, Wei Chen, Jungseul Ok May 2026 arXiv | May 2026