Rewrite What Matters: Adaptive Multilingual Query Rewriting for Reasoning via Agentic Reinforcement Learning

📅 2026-10-04
📈 Citations: 0
✨ Influential: 0
📄 PDF
🤖 AI Summary
This study addresses the performance disparity in multilingual semantically equivalent queries caused by divergent reasoning trajectories. To this end, we propose mRewriter-R1, a framework that formulates query rewriting as a multi-turn sequential decision-making process and leverages agentic reinforcement learning to dynamically optimize semantic transformations. Moving beyond single-paradigm rewriting, the framework enables adaptive operator selection conditioned on query characteristics alongside multi-objective collaborative optimization. Extensive experiments demonstrate that our approach significantly outperforms existing baselines across diverse backbone models, exhibiting strong generalization capabilities and plug-and-play compatibility with heterogeneous architectures.
📝 Abstract
In multilingual scenarios, queries with equivalent semantics but in different languages could guide the model into different reasoning trajectories, leading to performance disparities. To mitigate this gap, previous studies typically apply a one-size-fits-all query rewriting strategy, such as translation, which overlooks the fact that different scenarios require diverse types of semantic transformations. In this paper, we propose mRewriter-R1, an agentic multilingual query rewriting framework with reinforcement learning. Unlike single-turn rewriting, mRewriter-R1 formulates multilingual query rewriting as a multi-turn sequential decision-making process, where the model dynamically performs multi-aspect optimization through adaptive operator selection. Experimental results demonstrate that mRewriter-R1 outperforms all strong multilingual rewriting baselines on different large reasoning backbones. Further analyses show that the learned policy can adaptively decide on rewriting operators according to query characteristics, exhibiting strong generalization ability across diverse reasoning tasks, and plug-and-play compatibility with heterogeneous reasoning language models.
Innovation

Methods, ideas, or system contributions that make the work stand out.

Multilingual Query Rewriting
Reinforcement Learning
Agentic Framework
Sequential Decision-Making
Reasoning
🔎 Similar Papers
No similar papers found.
💼 Related Jobs
No related jobs found.
R
Rui Qi
Key Laboratory of Big Data & Artificial Intelligence in Transportation (Beijing Jiaotong University), Ministry of Education; School of Computer Science and Technology, Beijing Jiaotong University
Y
Yufeng Chen
Key Laboratory of Big Data & Artificial Intelligence in Transportation (Beijing Jiaotong University), Ministry of Education; School of Computer Science and Technology, Beijing Jiaotong University
Yunlong Liang
Yunlong Liang
WeChat
Natural Language Processing (NLP)
Chuan Meng
Chuan Meng
The University of Edinburgh
Artificial intelligenceInformation retrievalNatural language processing
S
Sijin Lu
School of Computer Science and Technology, Beijing Jiaotong University
Ge Shi
Ge Shi
Beijing Institute of Technology
Natural Language ProcessingInformation Extraction
Jinan Xu
Jinan Xu
Professor of School of Computer and Information Technology, Beijing Jiaotong University
NLPMachine TranslationLLM
Fandong Meng
Fandong Meng
WeChat AI, Tencent
Machine TranslationNatural Language Processing
Kaiyu Huang
Kaiyu Huang
Beijing Jiaotong University
natural language processingcomputational linguistics