Scholar
Zhengxiong Luo
Google Scholar ID: Sz1yTZsAAAAJ
Bytedance Seed
Super-Resolution
Human Pose Estimation
Multimodal Generation
Follow
Homepage
↗
Google Scholar
↗
Citations & Impact
All-time
Citations
2,450
H-index
14
i10-index
17
Publications
20
Co-authors
21
list available
Publications
7 items
VoT: Vision-of-Thought for Unified Multimodal Representation Alignment
2026
Cited
0
Code-Augur: Agentic Vulnerability Detection via Specification Inference
2026
Cited
0
Seedream 4.0: Toward Next-generation Multimodal Image Generation
2025
Cited
0
CI-VID: A Coherent Interleaved Text-Video Dataset
2025
Cited
0
Mogao: An Omni Foundation Model for Interleaved Multi-Modal Generation
2025
Cited
0
Autoregressive Video Generation without Vector Quantization
arXiv.org · 2024
Cited
3
You See it, You Got it: Learning 3D Creation on Pose-Free Videos at Scale
arXiv.org · 2024
Cited
7
Co-authors
18 total
Tieniu Tan
Institute of Automation, Chinese Academy of Sciences
Yan Huang
Institute of Automation, Chinese Academy of Sciences
Liang Wang
National Lab of Pattern Recognition
Yufeng Cui
Beijing Academy of Artificial Intelligence
Xinlong Wang
Beijing Academy of Artificial Intelligence
Qiying Yu
Tsinghua University
Quan Sun(孙泉)
StepFun
Yuanhao Cai
Johns Hopkins University | Tsinghua University | Meta Superintelligence Labs