Publication HYSYNTH: Context-Free LLM Approximation for Guiding Program Synthesis Shraddha Barke, Emmanuel Anaya Gonzalez, Saketh Ram Kasibatla, Taylor Berg-Kirkpatrick, Nadia Polikarpova NeurIPS 2024 | December 2024
Publication Neuro-Symbolic Data Generation for Math Reasoning Zenan Li, Zhi Zhou, Yuan Yao, Yu-Feng Li, Chun Cao, Fan Yang, Xian Zhang, Xiaoxing Ma Neural Information Processing Systems | December 2024
Publication Autoformalize Mathematical Statements by Symbolic Equivalence and Semantic Consistency Zenan Li, Yifan Wu, Zhaoyu Li, Xinming Wei, Fan Yang, Xian Zhang, Xiaoxing Ma Neural Information Processing Systems | December 2024
Publication A Shared Standard for Valid Measurement of Generative AI Systems’ Capabilities, Risks, and Impacts Alex Chouldechova, Chad Atalla, Solon Barocas, A. Feder Cooper, Emily Corvi, Alex Dow, Jean Garcia-Gathright, Nick Pangakis, Stefanie Reed, Emily Sheng, Dan Vann, Matthew Vogel, Hannah Washington, Hanna Wallach December 2024 December 2024
Publication Challenges in Human-Agent Communication Gagan Bansal, Jennifer Wortman Vaughan, Saleema Amershi, Eric Horvitz, Adam Fourney, Hussein Mozannar, Victor Dibia, Daniel S. Weld MSR-TR-2024-53 | December 2024 Published by Microsoft Project
Publication Convergence to Equilibrium of No-regret Dynamics in Congestion Games Volkan Cevher, Wei Chen, Leello Dadi, Jing Dong, Ioannis Panageas, Stratis Skoulakis, Luca Viano, Baoxiang Wang, Siwei Wang, Jingyu Wu Conference on Web and Internet Economics (WINE) | December 2024
Publication Combinatorial Rising Bandit Seockbean Song, Youngsik Yoon, Siwei Wang, Wei Chen, Jungseul Ok ICLR 2026 | November 2024
Publication Language-to-Code Translation with a Single Labeled Example Kaj Bostrom, Harsh Jhamtani, Hao Fang, Sam Thomson, Richard Shin, Patrick Xia, Ben Van Durme, Jason Eisner, Jacob Andreas EMNLP | November 2024
Tool MageBench MageBench is a benchmark for evaluating the reasoning and planning ability of large multimodal model agents. This benchmark currently includes three types of environments: WebUI, Sokoban, and Football, comprising a total of 483 different scenarios.… GitHub
Publication CogACT: A Foundational Vision-Language-Action Model for Synergizing Cognition and Action in Robotic Manipulation Qixiu Li, Yaobo Liang, Zeyu Wang, Lin Luo, Xi Chen, Mozheng Liao, Fangyun Wei, Yu Deng, Sicheng Xu, Yizhong Zhang, Xiaofan Wang, Bei Liu, Jianlong Fu, Jianmin Bao, Dong Chen, Yuanchun Shi, Jiaolong Yang, Baining Guo November 2024 arXiv | November 2024