AIの安全性を世界共通のルールで支えるには、企業が「安全だ」と説明するだけでは不十分だ。第三者が根拠を調べられること、そして問題が見つかったときに各国の規制当局が対応できることが欠かせない。シンガポールのジョセフィン・テオ・デジタル開発・情報相は、航空が幾重もの安全策によって日常的に利用されるようになったことを引き合いに、AIの普及と並行して安全策を築く必要性を訴えている。
3
6
航空に学ぶのは「完成した制度」ではなく、その作り方
国際航空のルールは一度に整ったわけではない。各国法や二国間協定を経て、1919年のパリ条約、1944年のシカゴ条約へと進み、国際民間航空機関(ICAO)は1947年に発足した。
31
39
35 AIでも、航空の規則をそのまま移すより、実行できる取り決めから始め、共通の実務を積み上げる発想が重要だ。
制度を設計するなら、国際的な機関は最低基準づくり、試験機関の認定、事故情報の比較を担う。一方、立ち入り検査、改善命令、導入制限、制裁といった権限は各国当局が持つ。国際的な「認証」が、国内での監督に取って代わってはならない。
また、安全確認は公開前の一度きりで終わらない。運用中の監視、大きな変更後の再評価、問題が起きた際に旧版へ戻す手順や運用終了の計画まで必要になる。承認する場合も、対象としたシステムの版と利用環境を明記すべきだ。
「合格マーク」ではなく、検証できる証拠を
独立した試験機関には、対象となるモデルだけでなく、実際の導入設定、文書、重大な不具合の記録にも、安全な方法でアクセスできることが求められる。別の有資格者が手法や結論を吟味できるよう記録を残しつつ、個人情報、営業秘密、安全保障上の機微情報は守らなければならない。
影響の大きいシステムでは、開発者に**「安全性を裏づける説明資料」**を提出させる方法がある。想定用途、試験方法、確認できた安全策、残るリスク、事故への対応を示し、証拠が足りなければ当局が改善や導入制限を求める。目指すのは「絶対に被害が起きない」という約束ではなく、定めた要件を満たすか確かめられる状態だ。
試験の独立性には資金の流れも関わる。大手開発企業が審査者を直接選んで管理するのではなく、共同基金や規制当局が管理する資金を通じて費用を負担する仕組みが考えられる。重大な事故や「事故になりかけた事例」は再発防止を重視して調査し、報告者を保護する。ただし、隠蔽や不正まで免責するわけではない。
シンガポールは拠点になれるか
テオ氏はAIの利用拡大と安全策の整備を同時に進める考えを示している。報道では、シンガポールの検証ツール「AI Verify」とAI Safety Instituteが、安全性の試験や評価に取り組む基盤として挙げられている。
1
3 同国が共同試験や機密性を保った技術交流の場を提供することは、一つの選択肢だ。
ただし、施設を置くだけで米中双方から信頼されるわけではない。運営の透明性、厳格なアクセス管理、独立した異議申し立ての手続きに加え、両国が実際に参加することが必要だ。一つの拠点に依存せず、複数の認定試験機関を結ぶ形が望ましい。
開発減速で一致しなくても、共有できるリスクはある
AI開発の進め方をめぐる立場は割れている。ロイターによると、Anthropicのダリオ・アモデイ氏、OpenAIのサム・アルトマン氏、イーロン・マスク氏は協調的な開発減速を求める一方、Metaのマーク・ザッカーバーグ氏は市場主導の安全策を支持し、NVIDIAのジェンスン・フアン氏は新たな規制の必要性を否定している。
47
48 中国は減速論を退け、ドナルド・トランプ米大統領も9月24日の習近平国家主席との首脳会談でAIの安全上の歯止めに進展があるとは見込んでいないと述べた。
58
50 会談をめぐる報道でも、大きな突破口への期待は低いとされた。
49
それでも、あらゆる論点で一致するまで手をこまねく必要はない。米中の安全保障専門家からは、核関連システムへの介入を防ぐ一線、重大なサイバー攻撃における人間の統制、自律型AIが関わる事案の緊急連絡窓口が提案されている。
20 重大事故の通知や緊急時の連絡から始め、相互に確認できる約束へ広げる道がある。米中の参加は重要だが、基準づくりや試験能力へのアクセスには他国の声も反映すべきだ。
軍備管理から借りられるのは、範囲を絞り、相互に検証できる約束を結ぶという考え方だ。金融分野の監督からは、失敗時の影響が大きい事業者や用途に、より厳しい評価、経営責任、復旧計画、情報漏えい・侵入・モデル盗難を含む重大事案の迅速な報告を求める発想が得られる。低リスクのサービスを扱う小規模企業には共用の試験設備や簡素な書類を用意できる一方、小規模というだけで危険な用途を免除すべきではない。
2030年までの条約や常設機関は、予測ではなく野心的な政策目標だ。まず問うべきは、事故の定義、試験機関の独立性、相互に確認できる安全策で各国が合意し、証拠が不十分なときに規制当局が実際に動けるかどうかである。