Researcher, Safety Training, National Security

OpenAI
San Francisco / Washington, DC / US - Remote2026-09-12

About the job

We’re seeking a researcher to train and evaluate models for U.S. government use, with a focus on national security applications. You’ll advance safety post-training and robustness, helping models follow nuanced policies while preserving their usefulness and capabilities.

Responsibilities

Research and implement methods for safety training, reinforcement learning, and adversarial robustness.

Develop evaluations, identify model failure modes, and use findings to improve training.

Work with research, engineering, security, and policy partners to support safe, reliable deployment.

Qualifications

Minimum

Bring 4+ years of relevant AI safety research experience, including RLHF, adversarial training, or robustness.

Have a degree in computer science, machine learning, or a related field, and strong deep learning research or engineering skills.

Have experience improving model safety for deployment and enjoy collaborative research.

Active TS/SCI clearance or equivalent.

Preferred

No preferred qualifications listed.