Scholar
Louis Jaburi
Google Scholar ID: VknFimMAAAAJ
PhD student
ML
Interpretability
AI safety
Math
Algebraic Geometry
Follow
Homepage
↗
Google Scholar
↗
Citations & Impact
All-time
Citations
9
H-index
2
i10-index
0
Publications
9
Co-authors
0
Publications
8 items
The Unequal Influence of Bad Advice: Using Training Data Attribution to Modulate Emergent Misalignment
2026
Cited
0
Can Data Attribution Filter Out Subliminal Learning? Not Reliably
2026
Cited
0
Where Does Social Reasoning Come From? Capability Provenance in Language Models
2026
Cited
0
Bergson: An Open Source Library for Data Attribution
2026
Cited
0
Concept Influence: Leveraging Interpretability to Improve Performance and Efficiency in Training Data Attribution
2026
Cited
0
Evaluating Explanations: An Explanatory Virtues Framework for Mechanistic Interpretability -- The Strange Science Part I.ii
2025
Cited
1
A Mathematical Philosophy of Explanations in Mechanistic Interpretability -- The Strange Science Part I.i
2025
Cited
0
Towards a unified and verified understanding of group-operation networks
2024
Cited
0