NewXResearch hub
ExploreLibraryProfile
Account
Sign In
Xiaohan Wang
Scholar

Xiaohan Wang

Google Scholar ID: H0kocJUAAAAJ
Meituan
Deep reinforcement learningOptimizationCausal inferenceScheduling
Google Scholar↗
Citations & Impact
All-time
Citations
613
 
H-index
13
 
i10-index
16
 
Publications
20
 
Co-authors
6
list available
Publications
23 items
SAKI: Maximal-Coupling-Routed Teacher Supervision for On-Policy Distillation
2026
Cited
0
TGRL: Temperature-Grouped Reinforcement Learning for Efficient Exploration in LLMs
2026
Cited
0
One Step, One Lead: Mitigating Higher-Order Interference in Multi-Domain Reinforcement Learning via Cross-Step Control
2026
Cited
0
When Not to Imitate: Boundary-Aware Skill Memory for Reliable Tool-Use LLM Agents
2026
Cited
0
HiDiffTIR: Hierarchical Difficulty-Aware Policy Optimization for Multi-Turn Tool-Integrated Reasoning
2026
Cited
0
Toward Plasticity-Preserving KL Regularization for Capability Retention in LLM Reinforcement Learning
2026
Cited
0
UniMem: Complementary Episodic-to-Parametric Memory for Boundary-Agnostic Task Streams
2026
Cited
0
TAPO: Tool-Aware Policy Optimization via Credit Transfer for Multimodal Search Agents
2026
Cited
0
Co-authors
4 total
Lin Zhang
Lin Zhang
Professor Ph.D., Director, Cloud Manufacturing Research Center, Beihang Universiy
Yuanjun Laili
Yuanjun Laili
Beihang University
Lihui Wang
Lihui Wang
Chair Professor of Sustainable Manufacturing, KTH
Xi Vincent Wang
Xi Vincent Wang
KTH Royal Institute of Technology