Scholar
Maxime Riché
Google Scholar ID: O-vBjSwAAAAJ
Center on Long-term Risk
artificial intelligence
AI safety
Follow
Google Scholar
↗
Citations & Impact
All-time
Citations
60
H-index
3
i10-index
2
Publications
5
Co-authors
0
Publications
4 items
Don't Inoculate Everything: Stratified Inoculation Prompting Narrows Backdoor Triggers and Preserves Desired Traits
2026
Cited
0
Inoculation Adapters: Improved Selective Generalization of Capabilities with Fewer Surprising Backdoors
2026
Cited
0
Implementing surrogate goals for safer bargaining in LLM-based agents
2026
Cited
0
Inoculation Prompting: Eliciting traits from LLMs during training can suppress them at test-time
2025
Cited
0