论文与出版物 Sample-Mean Anchored Thompson Sampling for Offline-to-Online Learning with Distribution Shift Bochao Li, Yao Fu, Wei Chen, Fang-yuan Kong May 2026 arXiv | May 2026
论文与出版物 EmbodiSkill: Skill-Aware Reflection for Self-Evolving Embodied Agents Ruofei Ju, Xinrui Wang, Xin Ding, Yifan Yang, Haotian Wu, Shiqi Jiang, Qianxi Zhang, Hao Wen, Xiangyu Li, Weijun Wang, Kunchang Li, Yunxin Liu, Haipeng Dai, Wei Wang, Ting Cao May 2026 arXiv | May 2026
论文与出版物 AI in the Enterprise: How People Use M365 Copilot Chat Scott Counts, Yan Chen, Jing Dong, Himanshu Sharma, Andrey Zaikin, Rui Hu, Alperen Kok, Gorkem Ozer Yilmaz, Siddharth Suri, Kiran Tomlinson, Sonia Jaffe, Will Wang May 2026 arXiv | May 2026
论文与出版物 Rebellious Student: Reversing Teacher Signals for Reasoning Exploration with Self-Distilled RLVR Jeonghye Kim, Jiwon Jeon, Dongsheng Li, Yuqing Yang May 2026 arXiv | May 2026
论文与出版物 ReVision: Scaling Computer-Use Agents via Temporal Visual Redundancy Reduction Amirhossein Abaskohi, Yuhang He, Peter West, Giuseppe Carenini, Pranit Chawla, Vibhav Vineet May 2026 arXiv | May 2026
论文与出版物 CodeClinic: Evaluating Automation of Coding Skills for Clinical Reasoning Agents Timothy Ossowski, Xinchi Liu, Danyal Maqbool, Vaibhav Dhanuka, Sheng Zhang, Hoifung Poon, Majid Afshar, Tyler J. Bradshaw, Junjie Hu May 2026 arXiv | May 2026
论文与出版物 Oracle Poisoning: Corrupting Knowledge Graphs to Weaponise AI Agent Reasoning Ben Kereopa-Yorke, Guillermo Díaz, Holly Wright, Reagan Johnston, Ron F. Del Rosario, Timothy Lynar May 2026 arXiv | May 2026
论文与出版物 Position: Avoid Overstretching LLMs for every Enterprise Task Kuldeep Singh, Anson Bastos, Isaiah Onando Mulang May 2026 arXiv | May 2026
论文与出版物 Generating Leakage-Free Benchmarks for Robust RAG Evaluation Jiayi Liu, Jiaxing Zhang, Bowen Jin, Jennifer Neville May 2026 arXiv | May 2026
论文与出版物 SkillGen: Verified Inference-Time Agent Skill Synthesis Yuchen Ma, Yue Huang, Han Bao, Haomin Zhuang, Swadheen Shukla, Michel Galley, Xiangliang Zhang, Stefan Feuerriegel May 2026 arXiv | May 2026