Scholar
Jie Lou
Google Scholar ID: MAz9FHYAAAAJ
Xiaohongshu
Alignment
RLHF
Follow
Google Scholar
↗
Citations & Impact
All-time
Citations
264
H-index
8
i10-index
6
Publications
14
Co-authors
3
list available
Publications
18 items
Your Teacher Can't Help You Here: Combating Supervision Fidelity Decay in On-Policy Distillation
2026
Cited
0
Learning from Failures: Correction-Oriented Policy Optimization with Verifiable Rewards
2026
Cited
0
Multimodal OCR: Parse Anything from Documents
2026
Cited
0
Tackling Length Inflation Without Trade-offs: Group Relative Reward Rescaling for Reinforcement Learning
2026
Cited
0
Coupled Variational Reinforcement Learning for Language Model General Reasoning
2025
Cited
0
PretrainZero: Reinforcement Active Pretraining
2025
Cited
0
NVIDIA Nemotron Nano V2 VL
2025
Cited
0
MemSearcher: Training LLMs to Reason, Search and Manage Memory via End-to-End Reinforcement Learning
2025
Cited
0
Load more
Co-authors
3 total
Yaojie Lu
Institute of Software, Chinese Academy of Sciences
Hongyu Lin
Institute of Software, Chinese Academy of Sciences
Dai Dai
Baidu