NewXResearch hub
ExploreLibraryProfile
Account
Sign In
Maxime Riché
Scholar

Maxime Riché

Google Scholar ID: O-vBjSwAAAAJ
Center on Long-term Risk
artificial intelligenceAI safety
Google Scholar↗
Citations & Impact
All-time
Citations
60
 
H-index
3
 
i10-index
2
 
Publications
5
 
Co-authors
0
 
Publications
4 items
Don't Inoculate Everything: Stratified Inoculation Prompting Narrows Backdoor Triggers and Preserves Desired Traits
2026
Cited
0
Inoculation Adapters: Improved Selective Generalization of Capabilities with Fewer Surprising Backdoors
2026
Cited
0
Implementing surrogate goals for safer bargaining in LLM-based agents
2026
Cited
0
Inoculation Prompting: Eliciting traits from LLMs during training can suppress them at test-time
2025
Cited
0