Sampura Research由前Google DeepMind研究員Rishub Jain及Josh Jacob創辦;根據機構公告,Alex Adams並非聯合創辦人,而係曾就公告提供意見的人士。機構於2026年8月25日公開推出,獲Coefficient Giving承諾提供1,100萬美元資助。[4] Sampura認為,業界以大型語言模型(LLM)充當「裁判」雖然快同平,但人類仍有能力發現AI不平均、難預測的失誤,並提供獨立監察。 機構計劃建立人類、AI或兩者混合的「裁判」,將信心不足的個案交由人類覆核,亦會用路由系統分配工作,唔係要求人類逐項檢查所有AI輸出。[4]
研究答案

Create a landscape editorial hero image for this Studio Global article: What is Sampura Research, the London based nonprofit launched on August 24, 2026 by former Google DeepMind researchers Rishub Jain, Joshua J. Article summary: Sampura Research is a London AI safety nonprofit founded by former Google DeepMind researchers Rishub Jain and Josh Jacob—not, based on its own announcement, by Alex Adams.. Topic tags: general web, ai safety, openai, llm, ai. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and
Sampura Research係一間設於倫敦、專注AI安全的非牟利研究機構,由前Google DeepMind研究員 Rishub Jain 同 Josh Jacob 創辦。根據Sampura自己發出的公告,Alex Adams並非創辦人,只係被列為曾經就公告提供意見的人士。4
機構於2026年8月25日正式公開推出,獲Coefficient Giving提供一筆合共 1,100萬美元 的初步資助承諾——其中首年為700萬美元,其後再承諾400萬美元。4 換句話講,題目所指的8月24日並非目前主要一手資料所顯示的公開推出日期。
AI安全研究入面有個重要問題:當模型能力愈來愈強,仲有冇足夠人手逐一檢查佢哋做得啱唔啱?業界其中一個答案係「可擴展監督」(scalable oversight),即係用一個AI模型去評估另一個AI模型,因為速度較快,成本亦可能低過完全依賴人類專家。
Sampura就認為,呢種做法唔應該變成完全由AI包辦。佢哋指出,人類仍然有幾方面可能係AI難以取代:
所以,Sampura嘅方向唔係「人類檢查一切」,而係嘗試將有限的人類判斷力,集中用喺最值得介入、最可能出現安全風險的地方。
Sampura所講的「裁判」(judge),可以係人類、AI,或者由兩者組成的混合系統,負責評估AI回覆或AI代理完成一連串任務時,究竟係咪正確、可靠及符合安全要求。
機構計劃研究幾種配合方式:
理想情況下,系統可以兼顧速度、成本同安全:簡單、重複性高的工作由AI處理;複雜、模糊或者風險較高的情況,就保留人類參與。4
Sampura表示,首六個月會優先建立一個公開、持續更新的排行榜,內含超過20個子數據集。初步涵蓋範圍包括:
重點係,佢哋唔只會用一批固定例子測試評審。研究亦會觀察:當被監督的模型喺強化學習期間刻意針對評審漏洞進行優化,評審仲頂唔頂得住。
呢個測試同「獎勵駭客」(reward hacking)有關——模型表面上取得高分,但實際上只係搵到方法欺騙評分機制,並無真正完成原本要求。Sampura亦表示,會公開發表論文、程式碼、數據集同排行榜,令其他研究者可以重現及檢查結果。4
Sampura關注的風險,唔限於科幻式的「AI反叛」情境。公告提到的方向亦包括:模型偏見、同兒童互動時的安全問題,以及人類對陪伴型AI產生過度依賴等。
之後,研究範圍更可能由「評估AI輸出」延伸到製作及評估背後使用的指令、評分準則同測試案例。換句話講,研究者唔只問「個答案啱唔啱」,亦會問「我哋用咩標準去判斷?個測試本身有冇漏咗某類風險?」4
呢個方向有助及早發現監管盲點,但要留意:目前公布的只係研究議程,唔係已經證明有效的AI控制或遏制能力。
Sampura提出的實際部署測試包括:
呢種做法最終能否被前沿模型開發商採用,仍然要視乎測試結果、資料透明度,以及各間公司的模型存取安排。
AI安全監督唔係有錢就可以即刻擴大規模。METR(一個獨立評估AI模型能力及風險的研究機構)公開招聘的評估執行職位,年薪範圍列為 285,548至503,116美元,並表示對非常有經驗的候選人可以考慮更高薪酬。9
呢個例子反映,具備AI評測、模型安全及實際測試經驗的人才相當稀缺。Sampura表示會喺倫敦招聘創辦初期的技術人員,因此招聘策略有一定戰略意義;不過,現有一手公告只確認招聘倫敦的 founding technical staff,未有足夠一手證據證實「至少招聘六人、年薪10萬至29萬英鎊」呢個具體說法。4
2026年7月,一封公開信獲超過1,100名來自前沿AI公司的從業員簽署,要求建立國際性的技術及治理機制,萬一AI發展速度快過人類安全監督能力,就可以有秩序地放慢發展。1
Sampura的工作可以視為其中一項技術基礎:如果連AI模型做得好唔好都無法可靠、獨立及可審計地評估,政府或國際組織就更加難決定幾時應該踩煞車。
但Sampura本身唔能夠提供法律權力、跨國協調、模型存取權限或者執法機制。因此,佢的研究係治理工作的補充,唔係治理本身的替代品。
Jain離開Google DeepMind,正值該研究實驗室被報道出現一連串人才流失。不過,「六日內失去五名核心研究員」呢個講法主要來自質素較參差的二手報道,目前唔應該當成已獲獨立證實的事實。5
同樣地,現有資料亦不足以支持「AI公司目前無法控制自己造出的東西」呢個非常廣泛的結論。較穩妥的解讀係:
最終,Sampura能否證明人機互補比單靠AI評審更安全,關鍵唔係口號,而係佢將會公開的數據、排行榜同實際部署結果。
Studio Global AI
此頁麵包含一個有來源支援的答案,您可以在 Studio Global 內繼續。
Sampura Research由前Google DeepMind研究員Rishub Jain及Josh Jacob創辦;根據機構公告,Alex Adams並非聯合創辦人,而係曾就公告提供意見的人士。機構於2026年8月25日公開推出,獲Coefficient Giving承諾提供1,100萬美元資助。[4]
Sampura Research由前Google DeepMind研究員Rishub Jain及Josh Jacob創辦;根據機構公告,Alex Adams並非聯合創辦人,而係曾就公告提供意見的人士。機構於2026年8月25日公開推出,獲Coefficient Giving承諾提供1,100萬美元資助。[4] Sampura認為,業界以大型語言模型(LLM)充當「裁判」雖然快同平,但人類仍有能力發現AI不平均、難預測的失誤,並提供獨立監察。
機構計劃建立人類、AI或兩者混合的「裁判」,將信心不足的個案交由人類覆核,亦會用路由系統分配工作,唔係要求人類逐項檢查所有AI輸出。[4]