Scholar
Ke Yan
Google Scholar ID: vWstgn0AAAAJ
Tencent
Multimodal LLM
Computer Vision
Image/Video Understanding
Follow
Google Scholar
↗
Citations & Impact
All-time
Citations
1,819
H-index
21
i10-index
26
Publications
20
Co-authors
0
Publications
3 items
IVT-Guard: All-in-One Reasoning Model for AI-Generated Content Detection
2026
Cited
0
Scene Graph Thinking: Reinforcing Structured Visual Reasoning for Multimodal Large Language Models
2026
Cited
0
Predictive Regularization Against Visual Representation Degradation in Multimodal Large Language Models
2026
Cited
0