Scholar
Kun Ding
Google Scholar ID: kbwv2tkAAAAJ
CASIA
CV
Multimodal
Follow
Google Scholar
↗
Citations & Impact
All-time
Citations
508
H-index
11
i10-index
13
Publications
20
Co-authors
9
list available
Publications
24 items
Dr.Credit: Rubric-Grounded Process Credit Assignment for Deep Research Agents
2026
Cited
0
How Far Are We from Removing the Visual Encoder? Scaling Laws for Encoder-Free Multimodal Pretraining
2026
Cited
0
DiffPDE: Masked Diffusion Language Models as PDE Solver
2026
Cited
0
DICS: Exploring Data Intrinsic Consistency for Visual Instruction Selection
2026
Cited
0
Audio-Visual Segmentation via Depth-Guided Collaborative Modeling
2026
Cited
0
WikiSeeker: Rethinking the Role of Vision-Language Models in Knowledge-Based Visual Question Answering
2026
Cited
0
Beyond Sequential Distance: Inter-Modal Distance Invariant Position Encoding
2026
Cited
0
SeaVIS: Sound-Enhanced Association for Online Audio-Visual Instance Segmentation
2026
Cited
0
Load more
Co-authors
7 total
Shiming Xiang
National Laboratory of Pattern Recognition, Institute of Automation, Chinese Academy of Sciences
Bin Fan
University of Science and Technology Beijing, previously at NLPR, CASIA
Gaofeng MENG (孟高峰)
Institute of Automation, Chinese Academy of Sciences
Cheng Da
Alibaba Group
Qi Yang
PhD student, Institute of Automation Chinese Academy of Sciences
Tao Zhang
Phd Candidate, Institute of Automation, Chinese Academy of Sciences
zili wang
Chinese Academy of Sciences, Institution of Automation