Safeguards Research 團隊(2026 年 7 月成立)——這是一個專門的新團隊,專注於破解防禦(jailbreak robustness)、自動紅隊演練以及針對濫用和對齊失誤的監控技術 。職位包含 Applied Safety Research Engineer, Safeguards,要求 4 年以上軟體/機器學習工程經驗並熟悉 Python 。
領域專屬的 Safeguards Enforcement Analysts——這是最具特色的方案:
2026 年 3 月,Anthropic 特別招聘了一位化學武器與爆炸物專家來設計防護措施,要求應徵者至少具備五年化學武器與爆炸物防禦經驗 。
Anthropic Fellows Program(2026 年梯次)——公開招募工程師和研究人員來探討 Anthropic 最高優先級的安全研究問題,並提供資金和指導 。
Trust & Safety Research Engineers——建立機器學習模型以偵測使用者和 API 合作夥伴在生產環境中出現的不當或異常行為 。
在 264 個公開職位(2025–2026 年)中,薪資中位數為 35.6 萬美元(範圍 28.9 萬至 40.3 萬美元),部分技術人員年薪超過 100 萬美元 。
| 職位 | 基本薪資範圍 | 主要資格要求 |
|---|---|---|
| Safeguards Enforcement Analyst, Chem & Explosives | 24.5 萬–28.5 萬美元 | 化學/爆炸物安全領域專業知識 |
| Applied Safety Research Engineer, Safeguards | 32 萬–40.5 萬美元 | 4 年以上軟體/機器學習工程經驗,熟悉 Python |
| Research Engineer / Scientist, Safeguards | 31.5 萬–56 萬美元 | 高等學位、安全研究經驗 |
| Research Engineer, Trust & Safety | 30 萬–45 萬美元 | 機器學習建模、生產系統經驗 |
| AI Safety Researcher (Senior) | 20 萬–30 萬美元 | 高階紅隊演練/安全背景 |
所有職位均位於舊金山(辦公室或混合辦公),基本薪資之外另提供股權。
這波招聘是對 Amodei 不斷升溫的公開警告所做的直接因應:
招聘武器專家、網路犯罪分析師和安全工程師,正是這些警告的具體實踐。
OpenAI 的對應動作: 2025 年 12 月,OpenAI 開出 Head of Preparedness 職位,基本薪資最高達 55.5 萬美元;2026 年 2 月,他們從 Anthropic 挖角了一名安全研究員來填補這個職位 。2026 年 3 月,OpenAI 也開出化學武器和爆炸物專家的職缺,與 Anthropic 的領域專屬濫用防範角色十分相似 。兩家公司曾在 2025 年中合作進行首次聯合安全評估,互相測試對方公開模型的對齊傾向 。
主要差異: Anthropic 的做法更具結構性——他們建立了常設的 Safeguards Research 團隊和人才培育管道,而非只招聘個別高階主管。彭博社在 2026 年 3 月報導,兩家公司的安全團隊人數仍然驚人地少,安全相關職位的投資相較於產品開發人力有「令人不安的」失衡 。Anthropic 將招聘定位為防止災難(明確列出大規模殺傷性武器情境),而 OpenAI 則傾向於強調負責任的部署和做好準備 。
更廣泛的自我監管背景: 截至 2026 年中,美國尚未通過任何全面的聯邦 AI 安全法規。兩家公司都在自願承諾的框架下運作(白宮 2023 年的自願承諾、Anthropic 公布的透明度中心承諾,內容涵蓋紅隊演練、兒童安全和吹哨者政策)。Amodei 公開承認自我監管是不夠的——他告訴《60 分鐘》,他對於由高階主管單獨做出這些決定「深感不安」——但在缺乏立法的情況下,兩家公司都在建立濫用防範團隊,作為事實上的私部門安全網。結果就是一場爭奪稀缺領域專家(化學武器專家、核子分析師)的人才大戰,而政府與私部門都沒有充足的這類人才儲備,整體人才庫仍然非常薄弱 。