Publication Intent-aligned Formal Specification Synthesis via Traceable Refinement Zhe Ye, Aidan Z.H. Yang, Huangyuan Su, Zhenyu Liao, Samuel Tenka, Zhizhen Qin, Udaya Ghai, Dawn Song, Soonho Kong April 2026 arXiv | April 2026
Publication AMID: Model-Agnostic Dataset Distillation by Adversarial Mutual Information Minimization Aoqi Wu, Junming Liu, Yuwei Zhang, Weiquan Huang, Liang Hu, Yifan Yang, Qi Zhang, Jiaxing Miao, Yuhan Tang, Zhongyuan Lai ACM Web Conference 2026 | April 2026
Publication Agent^2 RL-Bench: Can LLM Agents Engineer Agentic RL Post-Training? Wanyi Chen, Xiao Yang, Xu Yang, Tianming Sha, Qizheng Li, Zhuo Wang, Bowen Xian, Fang Kong, Weiqing Liu, Jiang Bian April 2026 arXiv | April 2026 Github
Publication Cost-Aware Retrieval-Augmentation Reasoning Models with Adaptive Retrieval Depth Helia Hashemi, Victor Ruehle, Saravan Rajmohan 2026 The Web Conference | April 2026
Publication From Searchable to Non-Searchable: Generative AI and Information Diversity in Online Information Seeking Yulin Yu, Yizhou Li, Siddharth Suri, Scott Counts April 2026
Publication Litmus (Re)Agent: A Benchmark and Agentic System for Predictive Evaluation of Multilingual Models Avni Mittal, Shanu Kumar, Sandipan Dandapat, Monojit Choudhury April 2026 arXiv | April 2026
Publication Do LLMs Follow Their Own Rules? A Reflexive Audit of Self-Stated Safety Policies Avni Mittal April 2026 arXiv | April 2026
Publication M$^star$: Every Task Deserves Its Own Memory Harness Wenbo Pan, Shujie Liu, Xiangyang Zhou, Shiwei Zhang, Wanlu Shi, Mirror Xu, Xiaohua Jia April 2026 arXiv | April 2026
Publication SPPO: Sequence-Level PPO for Long-Horizon Reasoning Tasks Tianyi Wang, Yixia Li, Long Li, Yibiao Chen, Shaohan Huang, Yun Chen, Peng Li, Yang Liu, Guanhua Chen April 2026 arXiv | April 2026
Publication MEMENTO: Teaching LLMs to Manage Their Own Context Vasilis Kontonis, Yuchen Zeng, Shivam Garg, Lingjiao Chen, Hao Tang, Ziyan Wang, Ahmed Awadallah, Eric Horvitz, John Langford, Dimitris Papailiopoulos 2026 COLM | April 2026