AI Safety & Alignment Jobs
29 live AI Safety & Alignment roles, pulled directly from company career pages. Median disclosed salary: $398k/yr. 17% are remote-friendly. Hiring most: Anthropic, OpenAI, ElevenLabs.
Program Manager, Safeguards Policy, Enforcement, and Threat Intelligence
AnthropicSan Francisco, CA, US
~$285k–$330k
ai safety alignment~$285k–$330k · 2d agoProduct Designer, Safeguards
AnthropicSan Francisco, CA, US
~$305k–$385k
ai safety alignment~$305k–$385k · 10d agoProduct Manager, Safeguards (Generalist)
AnthropicSan Francisco, CA, US
~$385k–$460k
ai safety alignment~$385k–$460k · 16d agoStaff+ Site Reliability Engineer, Safeguards ML Infra
AnthropicSan Francisco, CA, US
~$320k–$485k
ai safety alignmentStaff~$320k–$485k · 1mo agoResearcher, Alignment Interpretability
OpenAISan Francisco, California, US
$295k–$500k
ai safety alignment$295k–$500k · 1mo agoData Scientist - AI Safety
ElevenLabsRemote (GB)
Not disclosed
Remoteai safety alignment1mo agoTechnical Program Manager, AI Safety & Safeguards
OpenAISan Francisco, California, US
$207k–$445k
ai safety alignment$207k–$445k · 1mo agoStaff+ Software Engineer, Safeguards Data
AnthropicNew York City, NY, US
~$320k–$485k
ai safety alignmentStaff~$320k–$485k · 1mo agoStaff+ Software Engineer, Infrastructure, Interpretability
AnthropicSan Francisco, CA, US
~$405k–$485k
ai safety alignmentStaff~$405k–$485k · 1mo agoResearcher, Alignment CoT Monitorability
OpenAISan Francisco, California, US
$295k–$500k
ai safety alignment$295k–$500k · 2mo agoMachine Learning Infrastructure Engineer, Safeguards Research
AnthropicSan Francisco, CA, US
~$350k–$500k
ai safety alignment~$350k–$500k · 2mo agoStaff+ Software Engineer, Safeguards Human Review Tooling
AnthropicNew York City, NY, US
~$320k–$485k
ai safety alignmentStaff~$320k–$485k · 2mo agoRed Team Engineer, Safeguards
AnthropicRemote
~$320k–$405k
Remoteai safety alignment~$320k–$405k · 2mo agoData Engineer, Safeguards
AnthropicSan Francisco, CA, US
~$320k–$405k
ai safety alignment~$320k–$405k · 3mo agoProduct Manager, Safeguards Rare Harms
AnthropicSan Francisco, CA, US
~$305k–$385k
ai safety alignment~$305k–$385k · 3mo agoTechnical Program Manager, Red Team
Scale AISan Francisco, CA, US
~$151k–$189k
ai safety alignment~$151k–$189k · 4mo agoData Scientist, Safeguards
AnthropicNew York City, NY, US
~$285k–$380k
ai safety alignment~$285k–$380k · 4mo agoAnthropic Fellows Program, AI Safety & Security
AnthropicRemote (US)
~$4k+/wk
Remoteai safety alignment~$4k+/wk · 5mo agoProduct Manager, Safeguards (Cyber)
AnthropicSan Francisco, CA, US
~$305k–$385k
ai safety alignment~$305k–$385k · 8mo agoStaff+ Software Engineer, Safeguards Infrastructure
AnthropicLondon, GB
~£325k–£395k
ai safety alignmentStaff~£325k–£395k · 8mo agoResearch Scientist, Interpretability
AnthropicSan Francisco, CA, US
~$350k–$850k
ai safety alignment~$350k–$850k · 11mo ago[Expression of Interest] Research Manager, Interpretability
AnthropicSan Francisco, CA, US
~$350k–$500k
ai safety alignmentLead~$350k–$500k · 11mo agoResearch Engineer, Interpretability
AnthropicSan Francisco, CA, US
~$315k–$560k
ai safety alignment~$315k–$560k · 11mo agoML/Research Engineer, Safeguards
AnthropicSan Francisco, CA, US
~$350k–$500k
ai safety alignment~$350k–$500k · 12mo agoResearcher, Interpretability
OpenAIRemote (US)
$380k–$500k
Remoteai safety alignment$380k–$500k · 15mo agoResearch Engineer / Scientist, Alignment
AnthropicSan Francisco, CA, US
~$350k–$500k
ai safety alignment~$350k–$500k · 17mo ago[Expression of Interest] Research Engineer / Scientist, Alignment - London
AnthropicLondon, GB
~£260k–£370k
ai safety alignment~£260k–£370k · 18mo agoSoftware Engineer, AI Safety
OpenAIRemote (US)
$207k–$385k
Remoteai safety alignment$207k–$385k · 18mo agoResearcher, Alignment
OpenAISan Francisco, California, US
$295k–$500k
ai safety alignment$295k–$500k · 25mo ago