Publication GroupMemBench: Benchmarking LLM Agent Memory in Multi-Party Conversations Jingbo Yang, Kwei-Herng Lai, Xiaowen Wang, Shiyu Chang, Y. Harari, Evgeniy Gabrilovich May 2026 arXiv | May 2026
Publication Auditing Agent Harness Safety Chengzhi Liu, Yicheng Guo, Yepeng Liu, Yuzhe Yang, Qianqi Yan, Xuandong Zhao, Wenyue Hua, Shengchao Liu, Sharon Li, Yuheng Bu, Xin Wang May 2026 arXiv | May 2026
Publication LIFT: Last-Mile Fine-Tuning for Table Explicitation Divij Khaitan, Ashish Tiwari May 2026 arXiv | May 2026
Publication Inducing Artificial Uncertainty in Language Models Sophia Hager, Simon Zeng, Nicholas Andrews May 2026 arXiv | May 2026
Publication FIND: Toward Multimodal Financial Reasoning and Question Answering for Indic Languages Sarmistha Das, V. Vishal, Syed Ibrahim Ahmad, Manish Gupta, Sriparna Saha May 2026 arXiv | May 2026
Publication GEAR: Granularity-Adaptive Advantage Reweighting for LLM Agents via Self-Distillation Sijia Li, Yuchen Huang, Zifan Liu, Yanping Li, Jingjing Fu, Li Zhao, Jiang Bian, Ling Zhang, Jun Zhang, Rui Wang May 2026 arXiv | May 2026
Publication Agent-BRACE: Decoupling Beliefs from Actions in Long-Horizon Tasks via Verbalized State Uncertainty Joykirat Singh, Zaid Khan, Archiki Prasad, Junyan Chen, Akshay Nambi, Hyunji Lee, Elias Stengel-Eskin, Mohit Bansal May 2026 arXiv | May 2026
Publication From Noise to Diversity: Random Embedding Injection in LLM Reasoning Heeju Kim, Seungpil Lee, J. Yeom, Jaewon Sok, Seonghyeon Park, Jeongjae Park, Taesup Kim, Sundong Kim May 2026 arXiv | May 2026
Publication DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning Haoyu Huang, Jiaxin Bai, Shujie Liu, Yang Wei, Hong Ting Tsang, Yisen Gao, Zhongwei Xie, Yufei Li, Yangqiu Song May 2026 arXiv | May 2026
Publication Generating Leakage-Free Benchmarks for Robust RAG Evaluation Jiayi Liu, Jiaxing Zhang, Bowen Jin, Jennifer Neville May 2026 arXiv | May 2026