Scholar
Rico Angell
Google Scholar ID: av-OUuwAAAAJ
Graduate Student, University of Massachusetts Amherst
Follow
Google Scholar
↗
Citations & Impact
All-time
Citations
424
H-index
11
i10-index
12
Publications
20
Co-authors
0
Publications
8 items
BOReFT: Manifold Steering of Language Models for Black-box Optimization
2026
Cited
0
AURA-Eval: Evaluation Framework for Acting Under Risk Awareness in LLM Agent Trajectories
2026
Cited
0
Mitigating Adaptive Attacks against Reasoning Models with Activation Consistency Training
2026
Cited
0
On-Policy Consistency Training Improves LLM Safety with Minimal Capability Degradation
2026
Cited
0
Estimating Tail Risks in Language Model Output Distributions
2026
Cited
0
Is It Thinking or Cheating? Detecting Implicit Reward Hacking by Measuring Reasoning Effort
2025
Cited
0
Jailbreak Strength and Model Similarity Predict Transferability
2025
Cited
0
Monitoring Decomposition Attacks in LLMs with Lightweight Sequential Monitors
2025
Cited
0