Learning to Refine: Self-Refinement of Parallel Reasoning in LLMs
- Qibin Wang, Pu Zhao, Shaohan Huang, Fangkai Yang, Lu Wang, Furu Wei ,
- Qingwei Lin 林庆维 ,
- Saravan Rajmohan, Dongmei Zhang
ACL’26 findings |
Organized by Microsoft
to be updated.
Research
ACL’26 findings |
Organized by Microsoft
to be updated.
Opens in a new tab