NewXResearch hub
ExploreLibraryProfile
Account
Sign In
Junwei Bao
Scholar

Junwei Bao

Google Scholar ID: hcRREnsAAAAJ
zuoyebang.com // JD.com // MSRA
NLPLLMQA+DialogGeneration
Homepage↗Google Scholar↗
Citations & Impact
All-time
Citations
1,532
 
H-index
20
 
i10-index
27
 
Publications
20
 
Co-authors
0
 
Publications
9 items
GVPO++: Group Variance Policy Optimization for LLM Post-Training and On-Policy Distillation
2026
Cited
0
PGPO: Potential-Guided Policy Optimization for Multi-Turn Agentic Tasks
2026
Cited
0
FABSVer: Faster Training and Better Self-Verification for LLM Mathematical Reasoning
2026
Cited
0
Elo-Evolve: A Co-evolutionary Framework for Language Model Alignment
2026
Cited
0
Quality-constrained Entropy Maximization Policy Optimization for LLM Diversity
2026
Cited
0
RSPO: Risk-Seeking Policy Optimization for Pass@k and Max@k Metrics in Large Language Models
2025
Cited
0
GVPO: Group Variance Policy Optimization for Large Language Model Post-Training
2025
Cited
0
Multi-Turn Interactions for Text-to-SQL with Large Language Models
Proceedings of the 34th ACM International Conference on Information and Knowledge Management · 2024
Cited
1