Text2Grad: Reinforcement Learning from Natural Language Feedback
- Hanyang Wang, Lu Wang, Chaoyun Zhang, Tianjun Mao, Si Qin ,
- Qingwei Lin 林庆维 ,
- Saravan Rajmohan, Dongmei Zhang
ICLR'26 |
Organized by Microsoft
to be updated.
微软研究院
ICLR'26 |
Organized by Microsoft
to be updated.
(在新选项卡中打开)