Scholar
Xilin Jiang
Google Scholar ID: FQrkPUwAAAAJ
PhD student, Columbia University
Speech and Audio
Machine Listening
Machine Perception
Multimodal LLM
Brain-Computer Interface
Follow
Google Scholar
↗
Citations & Impact
All-time
Citations
321
H-index
8
i10-index
6
Publications
20
Co-authors
15
list available
Publications
14 items
Conversational Voice Aesthetic Model with Reinforcement Learning from Human Listeners
2026
Cited
0
Video Generation Models: A Survey of Post-Training and Alignment
2026
Cited
0
Cocktail-Talker: Multi-Speaker Dialog Modeling in Noisy Social Environments with Turn Action GRPO
2026
Cited
0
Sympatheia: Emotionally Adaptive Voice Assistant with Continuous Affect Conditioning
2026
Cited
0
AVMeme Exam: A Multimodal Multilingual Multicultural Benchmark for LLMs'Contextual and Cultural Knowledge and Thinking
2026
Cited
0
Sci-Phi: A Large Language Model Spatial Audio Descriptor
2025
Cited
0
SightSound-R1: Cross-Modal Reasoning Distillation from Vision to Audio Language Models
2025
Cited
0
Layer-wise Minimal Pair Probing Reveals Contextual Grammatical-Conceptual Hierarchy in Speech Representations
2025
Cited
0
Load more
Co-authors
15 total
Nima Mesgarani
Associate Professor, Columbia University
Cong Han
Google, Columbia University
Yinghao Aaron Li
PhD Student, Columbia University
Junkai Wu
University of Washington
Efthymios Tzinis
Sr. Research Scientist at Google | Ex. UIUC, MERL, Meta
Paris Smaragdis
Professor, Massachusetts Institute of Technology
Zhepei Wang
Adobe | Ex Amazon | Ph.D. @ University of Illinois Urbana-Champaign
Sukru Samet Dindar
Columbia University