Safeguards Research Team(安全防護研究團隊)——2026年7月成立——呢個全新團隊專注研究越獄(jailbreak)防禦、自動紅隊測試,以及針對濫用同偏差行為嘅監控技術 。職位包括Applied Safety Research Engineer, Safeguards,要求4年以上軟件/機器學習工程經驗同精通Python 。
領域專責嘅Safeguards Enforcement Analysts(安全防護執行分析師)——呢個係最特別嘅招聘計劃:
2026年3月,Anthropic特別招聘咗一名化學武器及爆炸品專家嚟設計安全防線,要求申請人至少有五年化學武器同爆炸品防禦經驗 。
Anthropic Fellows Program(Anthropic研究員計劃)——2026年批次——公開招募工程師同研究員,研究Anthropic最高優先級嘅AI安全研究課題,提供資金同指導 。
Trust & Safety Research Engineers(信任與安全研究工程師)——建立機器學習模型,監測生產環境中唔想要或異常嘅用戶同API合作夥伴行為 。
喺264個2025至2026年嘅公開招聘職位中,中位薪酬係35.6萬美元(28.9萬至40.3萬美元),部分技術人員薪酬超過100萬美元 。
| 職位 | 底薪範圍 | 主要資格 |
|---|---|---|
| 化學品及爆炸品安全防護執行分析師 | 24.5萬–28.5萬美元 | 化學/爆炸品安全領域專業知識 |
| 應用安全研究工程師(安全防護) | 32萬–40.5萬美元 | 4年以上軟件/機器學習工程經驗,Python |
| 安全防護研究工程師/科學家 | 31.5萬–56萬美元 | 高級學位,安全研究經驗 |
| 信任與安全研究工程師 | 30萬–45萬美元 | 機器學習建模,生產系統經驗 |
| 高級AI安全研究員 | 20萬–30萬美元 | 高級紅隊測試/安全背景 |
所有職位都喺三藩市(辦公室或混合模式),底薪以外仲有股權。
呢次招聘直接回應咗Amodei不斷升級嘅公開警告:
招聘武器專家、網絡犯罪分析師同安全防護工程師,正係呢啲警告嘅具體體現。
OpenAI嘅相似行動: 2025年12月,OpenAI招聘咗一個Head of Preparedness職位,底薪最高55.5萬美元——2026年2月,佢哋由Anthropic挖角咗一名安全研究員嚟填補呢個位 。2026年3月,OpenAI亦招聘化學武器同爆炸品專家,同Anthropic嘅領域專責濫用防範職位非常相似 。兩間公司喺2025年中合作進行咗首次聯合安全評估,互相測試對方公開模型嘅偏差傾向 。
主要分別: Anthropic嘅手法更結構化——佢哋建立咗常設嘅Safeguards Research Team同研究員培訓渠道,而唔係只招聘個別高層。彭博喺2026年3月報道,兩間公司嘅安全團隊人數仍然「細得驚人」,安全相關職位嘅投資同產品開發招聘相比「失衡得令人擔憂」。Anthropic將招聘定位為災難預防(明確列出大規模殺傷武器情境),而OpenAI傾向強調負責任部署同準備 。
更廣泛嘅自我監管背景: 截至2026年中,美國仍未通過全面嘅聯邦AI安全法例。兩間公司都係根據自願承諾運作(白宮2023年嘅自願承諾、Anthropic公開嘅透明中心承諾涉及紅隊測試、兒童安全同舉報政策)。Amodei公開承認自我監管唔足夠——佢同60 Minutes講,佢對由公司高層獨自做呢啲決定感到「非常唔舒服」——但喺無立法嘅情況下,兩間公司都建立濫用防範團隊作為事實上的私營安全網。結果就係一場爭奪稀有領域專家(化學武器專家、核分析師)嘅競賽,而政府同私營部門都冇足夠呢類人才,整體人才庫非常薄弱 。