Scholar
Richard Yuanzhe Pang
Google Scholar ID: vg_IkckAAAAJ
Meta, New York University
Natural Language Processing
Machine Learning
Follow
Homepage
↗
Google Scholar
↗
Citations & Impact
All-time
Citations
4,069
H-index
22
i10-index
26
Publications
20
Co-authors
0
Publications
7 items
OPD Before RL: Warm-Starting Rubric-Based RL with On-Policy Distillation
2026
Cited
0
Rubric-Based Benchmarking and Reinforcement Learning for Advancing LLM Instruction Following
2025
Cited
0
Prompt Curriculum Learning for Efficient LLM Post-Training
2025
Cited
0
Transformers Struggle to Learn to Search
arXiv.org · 2024
Cited
3
Self-Generated Critiques Boost Reward Modeling for Language Models
arXiv.org · 2024
Cited
1
Self-Consistency Preference Optimization
arXiv.org · 2024
Cited
10
Self-Rewarding Language Models
International Conference on Machine Learning · 2024
Cited
264