Scholar
Potsawee Manakul
Google Scholar ID: dVgn6boAAAAJ
Stanford University & SCB 10X
Natural Language Processing
Speech Processing
Multimodal
Follow
Homepage
↗
Google Scholar
↗
Citations & Impact
All-time
Citations
1,573
H-index
13
i10-index
14
Publications
20
Co-authors
15
list available
Publications
15 items
Building and Evaluating Fixed-Voice Thai TTS from Synthetic Speech
2026
Cited
0
Scaling Open Discrete Audio Foundation Models with Interleaved Semantic, Acoustic, and Text Tokens
2026
Cited
0
Typhoon ASR Real-time: FastConformer-Transducer for Thai Automatic Speech Recognition
2026
Cited
0
Extending Audio Context for Long-Form Understanding in Large Audio-Language Models
2025
Cited
0
AudioJudge: Understanding What Works in Large Audio Model Based Speech Evaluation
2025
Cited
0
Granular feedback merits sophisticated aggregation
2025
Cited
0
FinCoT: Grounding Chain-of-Thought in Expert Financial Reasoning
2025
Cited
0
Prior Prompt Engineering for Reinforcement Fine-Tuning
2025
Cited
0
Load more
Co-authors
12 total
Mark Gales
Cambridge University
Kate Knill
University of Cambridge
Sarana Nutanong
Vidyasirimedhi Institute of Science and Technology
Guangzhi Sun
University of Cambridge
Peerat Limkonchotiwat
Research Fellow, AI Singapore, National University of Singapore
Yu Wang
Shanghai Jiao Tong University & Shanghai AI Laboratory
Rao Ma
University of Cambridge
Patomporn Payoungkhamdee
Vidyasirimedhi Institute of Science and Technology