最も直接的な背景は、倫理的なストレスと組織的な圧力の衝突にある。最先端AI(フロンティアAI)を試験・評価する人々は、十分な安全策、監督、評価能力が整う前に、モデルそのものや「先に出した者が勝つ」開発競争が、生物学的・サイバー上の被害を可能にするのではないかと懸念している。
英国のAI Safety Institute(AISI)は、最先端モデルを独立に評価する組織だ。報道によれば、厳しい検証スケジュールに伴う心理的負担や燃え尽きを背景に、同機関の一部職員が病気休暇を取得したり、カウンセリングを求めたりしているという。
15 Anthropic、OpenAI、Google DeepMindなど大手研究所の研究者にも同様の不安があると伝えられるが、組織ごとにどの程度広がっているかを公的情報だけで断定することはできない。
懸念されるのは「遠い未来」だけではない
研究者の不安は、単に抽象的な終末論ではない。AIがサイバー攻撃や生物学的な悪用の敷居を下げるという、比較的近い時期に起こりうるリスクがある。一方で、より自律性の高いシステムが発展し、人間が意味のある形で制御できなくなる可能性も論点になっている。ジェイコブ・コクソン氏は、AIを利用した生物学的脅威やサイバー兵器を破局につながりうる経路として挙げた。
15
「危険を研究する」だけでなく、開発に関与している負担
安全性担当者は、外からリスクを論評しているだけではない。問題となりうるモデルを評価し、訓練し、ときには配備の過程にも関わる。テスト日程が切迫し、企業間の競争が続くなかで、危険を発見しても公開や投入を止める権限が十分にないと感じれば、無力感や燃え尽き、いわゆる倫理的苦痛につながりうる。
この点で問題は技術だけでなく、誰が停止を決められるのかという組織運営の問題でもある。
コクソン氏の退職が示した内部の不安
OpenAIとAnthropicで事前学習の研究に携わったコクソン氏は、Anthropicを退職後、両社が責任ある対応を取らないまま自己改善型の超知能へ向けて競争していると批判した。
14 BBCに対しても、大手AI研究所の内部には技術進展の速さとその意味を「心から恐れている」人々がいると語っている。
9
こうした発言は、それまで個人的・内部的に語られがちだった不安を公の論点にした。研究者にとっては、組織に残るのか、異議を唱えるのか、離職するのかという判断の重みも増すことになる。
個人や1社だけでは、開発競争を止めにくい
スタンフォード大学の議論が示すように、AIの能力向上を広範に減速させることは容易ではない。その一方で、政府または適格な第三者による独立評価を、AIの仕組みの標準的な一部にすべきだという指摘がある。
3
ロブ・ライシュ氏らが扱う問いも、突き詰めればここにある。競争状態にある1社や1人の従業員だけでは、安全な抑制を実現しにくい。意味のある対応には、企業間の協調、信頼できる独立評価、そして公的なルールが必要になる。なお、利用可能な資料だけから、ライシュ氏に特定の詳細な「労働者による協調行動」の提案を帰すことはできない。
経営者の「減速」発言が、なぜ不信も招くのか
Anthropicのダリオ・アモデイ氏、OpenAIのサム・アルトマン氏、Google DeepMindのデミス・ハサビス氏らは、程度の差はあれ、最先端AI開発の速度を落とす必要性に言及している。
2
ただし批判者は、大手企業が設計・監督する「AI凍結」や減速策は、既存の巨大企業の地位を固定し、小規模な競合を締め出すおそれがあると指摘する。
11 安全を重視する姿勢なのか、競争上の利益も兼ねた戦略なのかは、言葉だけでは判別しにくい。
信頼性を測る基準は、発言ではなく行動だ。たとえば、公開・提供の延期、独立監査、強制力のある能力しきい値、内部告発者の保護、外部規制を受け入れる姿勢が問われる。
AIがAI研究を担うほど、時間感覚は不安定になる
AIが自らを再帰的に改善する段階にすでに到達したわけではない。
6 しかし、AIは研究・開発やエンジニアリングの一部を自動化しつつある。これにより試行錯誤の周期が短くなり、人間の評価者が理解・検証・統治する速度を能力向上が上回るのではないか、という懸念がある。
ジョージタウン大学CSETは、AI研究開発の自動化がAI能力の急速な進展を招き、人間による理解や統制を難しくする可能性を指摘している。
4 一方、最近の研究では、AIエージェントが研究のための相当量のエンジニアリング作業を人の助けなしに実行できた一方、自由度の高い科学的研究課題で意味のある進展を示すには至らなかった。
5
つまり、危機の核心は「人類滅亡が差し迫っていると証明された」ということではない。むしろ最前線にいる一部の人々が、能力の加速、悪用可能性、競争インセンティブ、弱い外部統制という組み合わせを、心理的にも倫理的にも受け入れがたいものだと判断している点にある。