Scholar
Lingzhe Zhang
Google Scholar ID: aIoBwGcAAAAJ
Peking University
AIOps
Reinforcement Fine-Tuning
LSM
Follow
Google Scholar
↗
Citations & Impact
All-time
Citations
160
H-index
8
i10-index
8
Publications
20
Co-authors
14
list available
Publications
24 items
Playing social deduction games with reinforcement fine-tuned large language models
2026
Cited
0
GrowMTP: Can RL Grow Its Own Draft Head?
2026
Cited
0
Bifrost: Empowering Pretrained Language Model with Fallibility Representation for Log-Based Fault Diagnosis
2026
Cited
0
RLCSD: Reinforcement Learning with Contrastive On-Policy Self-Distillation
2026
Cited
0
How Much Parallelism Is "Free"? A Principle of Near-Free Parallelism for Parallel Decoding
2026
Cited
0
Towards In-Depth Root Cause Localization for Microservices with Multi-Agent Recursion-of-Thought
2026
Cited
0
From Feedback Loops to Policy Updates: Reinforcement Fine-Tuning for LLM-Based Alpha Factor Discovery
2026
Cited
0
Towards Robust LLM Post-Training: Automatic Failure Management for Reinforcement Fine-Tuning
2026
Cited
0
Load more
Co-authors
14 total
Tong Jia
Peking University
Mengxi Jia
Peking University, Institute of Artificial Intelligence, China Telecom(中国电信人工智能研究院, TeleAI)
Xiangdong Huang
School of Software, Tsinghua University
Aiwei Liu
Tsinghua University
Yunpeng Zhai
Alibaba Group; Peking University
Xuming Hu
Assistant Professor, HKUST(GZ) / HKUST
Philip S. Yu
Professor of Computer Science, University of Illinons at Chicago
Shaoxu Song
Tsinghua University