Scholar
Kazuki Shimada
Google Scholar ID: -t9IslAAAAAJ
Sony
Signal Processing
Speech Recognition
Follow
Google Scholar
↗
Citations & Impact
All-time
Citations
773
H-index
13
i10-index
15
Publications
20
Co-authors
37
list available
Publications
7 items
Spatio-Temporal Audio Language Modeling for Dynamic Sound Sources
2026
Cited
0
StereoSync: Spatially-Aware Stereo Audio Generation from Video
2025
Cited
0
SoundReactor: Frame-level Online Video-to-Audio Generation
2025
Cited
0
Stereo Sound Event Localization and Detection with Onscreen/offscreen Classification
2025
Cited
0
Combining Deterministic Enhanced Conditions with Dual-Streaming Encoding for Diffusion-Based Speech Enhancement
2025
Cited
0
CCStereo: Audio-Visual Contextual and Contrastive Learning for Binaural Audio Generation
2025
Cited
0
Music Foundation Model as Generic Booster for Music Downstream Tasks
arXiv.org · 2024
Cited
1
Co-authors
16 total
Yuki Mitsufuji
Distinguished Engineer, Sony
Shusuke Takahashi
Sony Group Corporation
Naoya Takahashi
SONY
Takashi Shibuya
Sony
Tatsuya Kawahara
Professor, School of Informatics, Kyoto University
Archontis Politis
Assistant Professor, Tampere University
Kengo Uchida
Sony
Tuomas Virtanen
Tampere University