Sampura Researchは、元Google DeepMindのRishub Jain氏とJosh Jacob氏が設立したロンドンのAI安全非営利団体。公開発表は2026年8月25日で、Coefficient Givingから初年度700万ドル、追加400万ドルを含む計1,100万ドルの助成を受けています。[4] 同団体は、低コストで高速なLLMによる自動評価だけに依存せず、人間とAIを組み合わせた「ジャッジ」で不確実なケースを重点的に人間へ引き継ぐ構想です。[4] 最初の6か月は、欺瞞検知、文化的バイアス、安全でないエージェント行動などを含む20超のサブデータセットと、継続更新型の公開ランキングを整備する計画です。[4]
研究の答え

Create a landscape editorial hero image for this Studio Global article: What is Sampura Research, the London based nonprofit launched on August 24, 2026 by former Google DeepMind researchers Rishub Jain, Joshua J. Article summary: Sampura Research is a London AI safety nonprofit founded by former Google DeepMind researchers Rishub Jain and Josh Jacob—not, based on its own announcement, by Alex Adams.. Topic tags: general web, ai safety, openai, llm, ai. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and
Sampura Researchは、元Google DeepMind研究者のRishub Jain氏とJosh Jacob氏が立ち上げた、ロンドンを拠点とするAI安全の非営利団体です。質問にあるAlex Adams氏は、同団体の発表上、創設者ではなく、発表内容へのフィードバックを提供した人物として記載されています。4
公開発表は2026年8月25日で、Coefficient Givingから初年度700万ドル、さらに400万ドルが追加で拠出される計1,100万ドルの助成を受けています。4 したがって、8月24日設立という説明よりも、同団体自身の発表に基づく「8月25日に公開」が確認しやすい表現です。
Sampuraが掲げる研究テーマは、英語でいう「Human-AI Complementarity for Scalable Oversight(拡張可能な監督のための人間とAIの相補性)」です。要するに、AIを監督する役割をAIだけに任せるのではなく、人間とAIがそれぞれの強みを生かして担う仕組みを作ろうとしています。4
AI開発の現場では、モデルの回答や行動が正しいか、安全基準に沿っているかを、別の大規模言語モデル(LLM)に判定させる方法が広がっています。人間が一件ずつ確認するより、速く、安く、大量のデータを処理できるためです。
Sampuraは、この自動化だけでは見落としが残ると考えています。特に人間には、次のような役割が残ると説明しています。4
つまり、Sampuraの立場は「人間がすべてを監視すべきだ」という単純なものではありません。AIの処理能力を使いながら、人間の判断を安全上重要な場面に集中させる、という考え方です。
Sampuraがいう「ジャッジ(judge)」とは、AIの回答やAIエージェントの行動の流れを見て、正確性や安全性、価値との整合性を評価する仕組みです。ジャッジは人間でもAIでも、両者を組み合わせたシステムでも構いません。4
計画されている主な手法は次の通りです。
AI評価者の確信度を推定する
AIが自信を持って判定できるケースと、判断が不確かなケースを見分けます。
不確かな案件を人間へエスカレーションする
すべての出力を人間が確認するのではなく、安全上の価値が高い案件だけを人間に回します。
ルーターで人間とAIに仕事を振り分ける
タスク全体、あるいは細分化したサブタスクごとに、AIに任せるか人間が担当するかを決定します。
人間に用途別のAI支援を提供する
人間の評価者が、調査や比較、論点整理などにAIの補助を使えるようにします。
この方式の狙いは、人的チェックをなくすことではなく、限られた専門家の時間を最も重要な判断に配分することです。
Sampuraは最初の6か月間、20を超えるサブデータセットを含む公開ランキングを作り、継続的に更新する計画です。テーマには、欺瞞の検知、文化的バイアス、安全でないエージェントの行動などが含まれます。4
評価するのは、単純な静的テストの正答率だけではありません。監督されるモデルが強化学習の過程で評価者の弱点を見つけ、評価をすり抜けるよう最適化できるかどうかも調べます。これは、AIが本来の安全性を高めるのではなく、評価スコアだけを上げる「報酬ハッキング」を検証する重要なテストです。4
同団体は、論文、コード、データセット、ランキングを公開する方針を示しています。外部の研究者や評価機関が結果を再確認できれば、評価手法の透明性や比較可能性を高められる可能性があります。
Sampuraの研究対象は、典型的な「AIが制御不能になる」シナリオに限られません。発表では、バイアス、子どもとの危険なやり取り、コンパニオンAIへの依存など、より身近で段階的に現れる被害も視野に入れています。4
さらに将来的には、AIの出力を判定するだけでなく、評価のための指示文、採点基準、テストケースそのものを作成・評価する研究へと範囲を広げる構想です。評価の設計段階から弱点を探せれば、失敗を事後的に発見するだけでなく、起こり得る問題を先回りして調べられます。
ただし、これはあくまで発表された研究プログラムです。実際に高度なAIを封じ込める能力が実証されたことを意味するものではありません。4
Sampuraは、より良いジャッジを作るだけでなく、それが実際の安全性向上につながるかを測る考えです。具体的には、次の点が課題になります。4
まずは第三者の評価者を使って仕組みを負荷テストし、その後、最先端モデルを開発する研究所の訓練、評価、監視に導入することを目指す可能性があります。4
この計画の実現性を左右するのが、AIの評価や安全性を理解する人材の確保です。評価機関METRの公開求人では、評価実行に関わる技術職の年間基本給を28万5,548〜50万3,116ドルとし、特に優れた候補者にはさらに高い水準も検討するとしています。9
それでも経験のある評価人材は限られており、Sampuraがロンドンで技術スタッフを採用する計画は、この人材競争という点で意味を持ちます。一方、Sampuraが「少なくとも6人」を年収10万〜29万ポンドで採用するという具体的な主張については、確認できた一次発表では十分な裏付けがありません。同団体の発表が示しているのは、ロンドンで創設期の技術スタッフを募集しているという点です。4
2026年7月には、最先端AIに関わる1,100人超の実務者が、AI開発が人間の安全な監督能力を上回った場合に備え、国際的に開発ペースを落とせる仕組みを求める公開書簡に署名しました。1
Sampuraの取り組みは、この議論に対して技術面から応える可能性があります。信頼でき、監査可能な評価がなければ、開発を続けるべきか、速度を落とすべきかを判断するのは難しいからです。
ただし、Sampuraだけで国際協調、法的権限、モデルへのアクセス、規制当局による執行まで実現できるわけではありません。したがって、その研究はAIガバナンスの代替ではなく、ガバナンスを機能させるための技術的な補完と見るのが妥当です。
Jain氏の退社は、Google DeepMindから複数の研究者が離れた時期と重なって報じられました。ただし、「6日間で中核研究者5人が流出した」という表現は信頼性の低い二次報道に由来する可能性があり、この資料だけで独立して確認された事実として扱うべきではありません。5
同様に、AI企業が「自ら作ったものをまだ封じ込められない」とする大きな断定も、ここで確認できる証拠からは導けません。より慎重で根拠のある結論は、次のようなものです。
Sampura Researchの成否は、ハイブリッドな評価手法を発表できるかだけでなく、それが現実のモデル訓練や運用で、見落としや報酬ハッキングを実際に減らせるかによって判断されることになります。
Studio Global AI
このページにはソースに裏付けされた回答が含まれており、Studio Global 内で続行できます。
Sampura Researchは、元Google DeepMindのRishub Jain氏とJosh Jacob氏が設立したロンドンのAI安全非営利団体。公開発表は2026年8月25日で、Coefficient Givingから初年度700万ドル、追加400万ドルを含む計1,100万ドルの助成を受けています。[4]
Sampura Researchは、元Google DeepMindのRishub Jain氏とJosh Jacob氏が設立したロンドンのAI安全非営利団体。公開発表は2026年8月25日で、Coefficient Givingから初年度700万ドル、追加400万ドルを含む計1,100万ドルの助成を受けています。[4] 同団体は、低コストで高速なLLMによる自動評価だけに依存せず、人間とAIを組み合わせた「ジャッジ」で不確実なケースを重点的に人間へ引き継ぐ構想です。[4]
最初の6か月は、欺瞞検知、文化的バイアス、安全でないエージェント行動などを含む20超のサブデータセットと、継続更新型の公開ランキングを整備する計画です。[4]