Scholar
Yupeng Su
Google Scholar ID: zZ8lS-UAAAAJ
UC Santa Barbara
Efficient LLMs
Edge Deployment
Quantization
Sparsity
Follow
Homepage
↗
Google Scholar
↗
Citations & Impact
All-time
Citations
76
H-index
3
i10-index
2
Publications
5
Co-authors
5
list available
Publications
9 items
ReFold: Training-Free Reversible Inter-Turn Context Folding for Long-Horizon Agents
2026
Cited
0
MuonQ: Enhancing Low-Bit Muon Quantization via Directional Fidelity Optimization
2026
Cited
0
RankGuide: Tensor-Rank-Guided Routing and Steering for Efficient Reasoning
2026
Cited
0
Muon$^2$: Boosting Muon via Adaptive Second-Moment Preconditioning
2026
Cited
0
TEON: Tensorized Orthonormalization Beyond Layer-Wise Muon for Large Language Model Pre-Training
2026
Cited
0
PTQTP: Post-Training Quantization to Trit-Planes for Large Language Models
2025
Cited
0
InfiJanice: Joint Analysis and In-situ Correction Engine for Quantization-Induced Math Degradation in Large Language Models
2025
Cited
0
Quantization Meets Reasoning: Exploring LLM Low-Bit Quantization Degradation for Mathematical Reasoning
2025
Cited
0
Load more
Co-authors
4 total
Ngai Wong (Sam)
Associate Professor of Electrical and Electronic Engineering, The University of Hong Kong
Hao Yu (余浩)
SUSTech(南方科技大学)
Hongxia Yang
Professor, HK Polytechnic University
Xiaoqun Liu
Michigan State University