Scholar
Xie Chen
Google Scholar ID: d6u01FkAAAAJ
Shanghai Jiao Tong University <- Microsoft <- Cambridge University
Machine Learning
Speech Recognition
Speech Synthesis
Speech&Audio Processing
Follow
Homepage
↗
Google Scholar
↗
Citations & Impact
All-time
Citations
3,478
H-index
33
i10-index
75
Publications
20
Co-authors
29
list available
Contact
No contact links provided.
Publications
31 items
Spoken Function Calling: A New Perspective on Spoken Language Understanding for Large Audio Language Models
2026
Cited
0
GROW: Group-Relative Advantage-Weighted On-Policy Reinforcement Learning of Autoregressive-Diffusion Text-to-Speech model
2026
Cited
0
AgenticASR: Refining Speech Recognition in Real-World Scenarios via an Agentic Approach
2026
Cited
0
OmniVAE: An Audio-Video VAE with Cross-Modal Alignment for Joint Generation
2026
Cited
0
Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models
2026
Cited
0
AudioDER: A Deduplication-Enhanced Reasoning Dataset for Post-Training Large Audio-Language Models
2026
Cited
0
Speech Meets ELF: Audio Conditional Continuous-Target Diffusion for Speech Recognition and Translation
2026
Cited
0
Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement
2026
Cited
0
Load more
Resume (English only)
Co-authors
29 total
Ziyang Ma
Shanghai Jiao Tong University
Kai Yu(俞凯)
Shanghai Jiao Tong University
Mark Gales
Cambridge University
Xunying Liu
Chinese University of Hong Kong
Yiwei Guo
Shanghai Jiao Tong University
Yifan Yang
Shanghai Jiao Tong University, Tencent, Microsoft, Xiaomi
Chenpeng Du
ByteDance
Philip Woodland
Professor of Information Engineering, Cambridge University Engineering Department