Learning to Refine: Self-Refinement of Parallel Reasoning in LLMs

  • Qibin Wang, Pu Zhao, Shaohan Huang, Fangkai Yang, Lu Wang, Furu Wei ,
  • ,
  • Saravan Rajmohan, Dongmei Zhang

ACL’26 findings |

Organized by Microsoft

to be updated.