Scholar
Yuheng Zhang
Google Scholar ID: IoEBLNYAAAAJ
University of Illinois Urbana-Champaign
Machine Learning
Reinforcement Learning
Online Learning
Bandits
Learning Theory
Follow
Google Scholar
↗
Citations & Impact
All-time
Citations
1,069
H-index
10
i10-index
11
Publications
19
Co-authors
32
list available
Publications
39 items
Fast Last-Iterate Convergence in Zero-Sum Markov Games with Bandit Feedback
2026
Cited
0
EmbPASS: Towards Cross-Embodiment Open Panoramic Segmentation
2026
Cited
0
Polylogarithmic Nash Regret in Matrix Games with Bandit Feedback
2026
Cited
0
Minimax Last-Iterate Convergence in Matrix Games with Observed Actions
2026
Cited
0
Coupled Calibration and Learning: Mitigating Teacher Bias in LLM Distillation without Target-Domain Reward Feedback
2026
Cited
0
TuringLLM: Efficiently Scaling Foundation Models Toward Physical AI
2026
Cited
0
SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators
2026
Cited
0
Labimus: A Simulation and Benchmark for Humanoid Dexterous Manipulation in Chemical Laboratory
2026
Cited
0
Load more
Co-authors
19 total
Nan Jiang
Associate Professor of Computer Science, UIUC
Ruoxi Jia
Assistant Professor, Virginia Tech
Bo Li
University of Illinois at Urbana–Champaign
Dawn Song
Professor of Computer Science, UC Berkeley
Wenxiao Wang
RELAI.ai
Hanghang Tong
University of Illinois at Urbana-Champaign
Haitao Mi
Principal Researcher, Tencent US
Linfeng Song
Tencent AI Lab | University of Rochester PhD