Summary
OpenAI is an AI research and deployment company focused on ensuring that general-purpose artificial intelligence benefits humanity. The researcher will train and evaluate models for U.S. government and national security applications, advancing safety post-training, reinforcement learning, and adversarial robustness. The role also involves developing evaluations, identifying model failure modes, and collaborating with research, engineering, security, and policy partners to support safe deployment.
Responsibilities
- Research and implement methods for safety training, reinforcement learning, and adversarial robustness
- Develop evaluations, identify model failure modes, and use findings to improve training
- Work with research, engineering, security, and policy partners to support safe, reliable deployment
Skills
- • Bring 4+ years of relevant AI safety research experience, including RLHF, adversarial training, or robustness
- • Have a degree in computer science, machine learning, or a related field, and strong deep learning research or engineering skills
- • Have experience improving model safety for deployment and enjoy collaborative research
- • Are motivated by OpenAI's mission and the responsible use of AI in safety-critical settings
- • Active TS/SCI clearance or equivalent
Qualifications
Must Haves
- • Bring 4+ years of relevant AI safety research experience, including RLHF, adversarial training, or robustness
- • Have a degree in computer science, machine learning, or a related field, and strong deep learning research or engineering skills
- • Have experience improving model safety for deployment and enjoy collaborative research
- • Are motivated by OpenAI's mission and the responsible use of AI in safety-critical settings
- • Active TS/SCI clearance or equivalent