Text2Grad: Reinforcement Learning from Natural Language Feedback

  • Hanyang Wang, Lu Wang, Chaoyun Zhang, Tianjun Mao, Si Qin ,
  • ,
  • Saravan Rajmohan, Dongmei Zhang

ICLR'26 |

Organized by Microsoft

to be updated.