部分 AI 安全研究員請病假、搵心理輔導或者離職,核心唔單止係工作量大,而係道德壓力撞正機構與市場壓力:佢哋負責測試最強一批「前沿 AI」模型,卻擔心模型能力同推出市場嘅速度,會快過防護、監管同評估能力,最終增加生物學或網絡安全傷害嘅風險。
報道指,英國 AI Safety Institute(AISI)——負責獨立評估前沿 AI 模型嘅機構——有數名職員因精神壓力請病假或尋求輔導。消息人士將原因歸於緊迫嘅測試時程、低落士氣同倦怠。
15 至於 Anthropic、OpenAI、Google DeepMind 等大型實驗室,公開資料的確反映研究員存在類似焦慮,但未足以證明每間公司內部嘅情況有幾普遍。
佢哋驚嘅,既有眼前風險,亦有極端長遠情境
研究員關注嘅唔只係抽象嘅「AI 滅世論」。較近在眼前嘅風險包括:模型會否令網絡攻擊更容易發動,或者降低生物學知識與能力被濫用嘅門檻。至於更長遠嘅憂慮,係能力愈來愈強、愈來愈自主嘅系統,可能逐步超出人類有意義嘅控制範圍。
前 Anthropic 研究員 Jacob Coxon 就曾將 AI 輔助生物威脅同網絡武器,形容為可能通向災難嘅路徑。
15
最難受嘅地方:發現風險,未必等於有權煞停
安全團隊唔係旁觀者。佢哋可能直接參與模型評估、訓練,或者支援部署決定。當測試期限好趕、商業競爭持續加速,而研究員即使發現問題都未必有權阻止模型推出,便容易出現無力感、倦怠,甚至一種「自己有冇份促成危害」嘅道德創傷。
Coxon 曾先後喺 OpenAI 同 Anthropic 做預訓練研究,其後辭去 Anthropic 職位,批評公司正競逐自我改進嘅超級智能,卻未有負責任地行事。
14 佢接受 BBC 訪問時亦表示,頂尖實驗室內有人對技術進展速度及其對人類嘅含意「真係感到恐懼」。
9
佢嘅公開發言,令原本可能只喺內部流傳嘅焦慮變得更可見,亦令其他員工更難迴避一個個人抉擇:繼續留低、提出異議,定係離開?
單靠一間公司或一個員工,難以煞停一場競賽
圍繞「應否放慢 AI 發展」嘅討論,其實已經唔止係技術問題,而係勞工與管治問題。史丹福大學嘅討論指出,要全面放慢 AI 能力研發並不容易;較具體嘅方向包括由政府或合資格第三方進行獨立評估,並加強安全、保安同監測投資。
3
重點係:如果每間公司都怕落後,個別研究員或者單一實驗室好難自行承擔「慢落嚟」嘅代價。要減少競賽壓力,需要跨公司協調、可信嘅外部評估,以及有約束力嘅公共規則。
不過,現有資料不足以將一套具體嘅「協調員工行動」方案直接歸於史丹福學者 Rob Reich;較清楚嘅脈絡,係佢討論前沿科學應如何由社會共同管治,而唔應只交畀研究員或企業自行決定。
1
CEO 話要放慢,點解未必能消除不信任?
Anthropic 行政總裁 Dario Amodei、OpenAI 行政總裁 Sam Altman、Google DeepMind 行政總裁 Demis Hassabis 等人,近月都以不同程度支持放慢前沿 AI 發展。
2 但批評者指出,假如「AI 凍結」由現有巨頭設計或主導執行,可能反而鞏固大公司權力、壓縮較小競爭者空間。
11
所以,安全承諾係真心定策略考量,未必可以單靠宣言判斷。較實際嘅信任測試包括:
- 會否因風險而真正延後推出模型;
- 會否接受獨立外部審計;
- 有冇清晰而可執行嘅能力或部署門檻;
- 有冇保障提出安全疑慮嘅吹哨者;
- 願唔願意接受公司以外嘅約束。
AI 幫手做 AI 研究,令「可控制性」更令人不安
目前未有證據顯示 AI 已經做到完整嘅遞迴自我改進——即係持續自行提升自己嘅能力。
6 但 AI 已愈來愈能夠自動化研究同工程工作嘅部分流程,令研發迭代可能加快,快到人類評估員未必追得切理解、測試同管治。
喬治城大學 CSET 指出,愈高度自動化嘅 AI 研發,有可能令能力進步急速加快,同時削弱人類理解及控制系統嘅能力。
4 另一方面,一項近期研究發現,AI 代理可以在冇人類協助下完成相當多研究工程工作,但仍未能喺開放式科研問題上取得實質進展。
5
換言之,憂慮唔係「AI 已經自行爆發式升級」,而係技術正朝住縮短研發周期嘅方向前進,安全工作未必有足夠時間跟上。
總結而言,呢場壓力危機唔等於已經證明人類滅絕迫在眉睫。 但佢反映咗一部分最接近前沿模型開發嘅人,認為能力加速、雙重用途風險、商業競賽同外部制衡不足交織埋一齊,已經造成難以承受嘅心理同倫理負擔。