Resume
Academic Achievements
- NeurIPS 2025 (Datasets and Benchmarks Track): MLR-Bench: Evaluating AI Agents on Open-Ended Machine Learning Research
- NeurIPS 2025: ConfTuner: Training Large Language Models to Express Their Confidence Verbally
- NeurIPS 2025: GRAVER: Generative Graph Vocabularies for Robust Graph Foundation Models Fine-tuning
- NeurIPS 2025: GuardReasoner-VL: Safeguarding VLMs via Reinforced Reasoning
- EMNLP 2025 (Industry Track): Enabling Self-Improving Agents to Learn at Test Time With Human-In-The-Loop Guidance
- EMNLP 2025: How to Make Large Language Models Generate 100% Valid Molecules?
- EMNLP 2025: TopicAttack: An Indirect Prompt Injection Attack via Topic Transition
- EMNLP 2025: Automating Steering for Safe Multimodal Large Language Models
- EMNLP 2025 (Findings): Making Every Step Effective: Jailbreaking Large Vision-Language Models Through Hierarchical KV Equalization
- EMNLP 2025 (Findings): Enhancing Multi-Agent Debate System Performance via Confidence Expression
- EMNLP 2025 (Findings): Backdoor-Powered Prompt Injection Attacks Nullify Defense Methods
- EMNLP 2025 (Findings): Safety in Large Reasoning Models: A Survey