Sampura Research chính thức công bố ra mắt ngày 25/8/2026, không phải ngày 24/8, với mục tiêu xây dựng hệ thống đánh giá AI có sự phối hợp giữa con người và máy móc. Tổ chức này cho rằng chỉ dùng AI để giám sát AI có thể bỏ sót những lỗi mới, bị hệ thống được đánh giá thao túng hoặc lặp lại các kiểu sai lầm vốn có ở...
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: What is Sampura Research, the London-based nonprofit formally launched on August 24, 2026 by former Google DeepMind researchers Rishub Jain,. Article summary: Sampura Research is a London-based AI-safety nonprofit developing “human–AI complementarity for scalable oversight”: systems in which people and AI jointly evaluate increasingly capable models rather than delegating over. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
Sampura Research là một tổ chức phi lợi nhuận về an toàn AI đặt tại London. Câu hỏi trung tâm của tổ chức này khá thực tế: ai nên phán xét liệu một hệ thống AI ngày càng mạnh có đang hoạt động đúng và an toàn hay không?
Câu trả lời của Sampura không phải là loại con người khỏi quy trình. Thay vào đó, tổ chức muốn thiết kế các hệ thống trong đó con người và AI cùng chia sẻ trách nhiệm giám sát. Sampura cho biết đã nhận khoản tài trợ ban đầu 11 triệu USD từ Coefficient Giving, gồm 7 triệu USD cho năm đầu tiên và 4 triệu USD được cam kết bổ sung. 1
Thông báo ra mắt công khai của tổ chức được đăng ngày 25/8/2026, không phải ngày 24/8. Tài liệu này xác định Rishub Jain và Josh Jacob là những người sáng lập. Một số bài đăng trước đó trên mạng xã hội đề cập đến sự tham gia của Alex Adams, nhưng thông báo chính thức không xác nhận cả ba người đều là đồng sáng lập trên danh nghĩa. 112
Trong cách dùng thuật ngữ của Sampura, thẩm phán có thể là một người, một mô hình AI hoặc một hệ thống kết hợp, với nhiệm vụ đánh giá liệu hành vi của một hệ thống AI khác có chính xác và phù hợp với mục tiêu đề ra hay không. Đối tượng được đánh giá có thể là một câu trả lời, cả cuộc hội thoại hoặc chuỗi hành động nhiều bước của một tác nhân AI. 1
Điểm này quan trọng vì năng lực của mô hình và năng lực giám sát thường bị xem như hai bài toán riêng biệt. Một mô hình có thể tạo ra câu trả lời trôi chảy hoặc hoàn thành nhiệm vụ phức tạp, nhưng vẫn đánh lừa người đánh giá, khai thác lỗ hổng trong hàm thưởng hoặc thực hiện hành động không an toàn trong một chuỗi dài.
Sampura gọi hướng tiếp cận của mình là sự bổ trợ giữa người và AI cho hoạt động giám sát có khả năng mở rộng: tự động hóa những phần mà máy móc đáng tin cậy, đồng thời giữ con người tham gia ở những quyết định đòi hỏi phán đoán, diễn giải hoặc cân nhắc giá trị. 1
AI hấp dẫn ở vai trò người giám sát vì có thể hoạt động nhanh và rẻ hơn khi triển khai trên quy mô lớn. Tuy nhiên, theo Sampura, tốc độ không tự động biến một hệ thống đánh giá thành hệ thống đáng tin cậy. Tuyên bố ra mắt của tổ chức nêu một số rủi ro:
Những lo ngại này không có nghĩa con người lúc nào cũng đánh giá tốt hơn AI. Chúng cho thấy cần kiểm tra tổ hợp người và máy nào hoạt động hiệu quả nhất dưới áp lực, thay vì mặc định giao toàn bộ nhiệm vụ cho một phía. 1
Trong chương trình sáu tháng đầu tiên, Sampura dự định xây dựng một bảng xếp hạng đa dạng dành cho các “thẩm phán”, gồm hơn 20 bộ dữ liệu con. Các chủ đề dự kiến bao gồm phát hiện hành vi lừa dối, thiên lệch văn hóa và những hành động không an toàn của tác nhân AI. 1
Các bài kiểm tra sẽ không chỉ dừng ở dạng hỏi–đáp tĩnh. Sampura còn muốn tạo ra những tình huống trong đó mô hình bị giám sát trực tiếp tối ưu để qua mặt “thẩm phán” trong quá trình học tăng cường. Cách thiết kế này nhằm cho thấy một hệ thống đánh giá có còn hiệu quả hay không khi mô hình bị đánh giá có động lực tìm và khai thác điểm yếu của nó. 1
Nghiên cứu sẽ so sánh ba hướng tiếp cận lớn:
Mục tiêu không chỉ là đạt điểm cao trên một bộ kiểm thử hẹp. Sampura muốn tìm ra những “thẩm phán” hoạt động ổn định trên nhiều bài kiểm tra và vẫn đáng tin khi các mô hình được giám sát ngày càng giỏi khai thác lỗ hổng trong quy trình đánh giá. 1
Sampura đã nêu một số cách để kết hợp phán đoán của người và AI:
Cách tiếp cận này xem sự tham gia của con người là một biến số cần tối ưu, không phải lựa chọn “có hoặc không”. Một số trường hợp có thể được tự động hóa với chi phí thấp và độ tin cậy cao; những trường hợp khác có thể xứng đáng với thời gian đánh giá chậm hơn nhưng kỹ lưỡng hơn của con người.
Vì vậy, bài toán thực sự không phải “con người đối đầu với AI”, mà là cân bằng giữa độ chính xác, chi phí, tốc độ và khả năng chống lại việc mô hình cố tình qua mặt hệ thống. 1
Sau khi phát triển các “thẩm phán” tốt hơn, Sampura cho biết sẽ kiểm tra liệu chúng có thể giảm hiện tượng lách phần thưởng trong quá trình huấn luyện mô hình hay không. Tổ chức cũng muốn nghiên cứu mức độ tham gia cần thiết của con người, cách hệ thống giám sát thích ứng khi mô hình nền học được cách khai thác nó, và liệu “thẩm phán” có thể làm nhiều hơn việc phân loại đầu ra. 1
Các hướng mở rộng có thể bao gồm soạn thảo hoặc đánh giá thông số kỹ thuật, hướng dẫn, tiêu chí chấm điểm và bộ kiểm thử được sử dụng để huấn luyện cũng như đánh giá AI. Sampura cho biết sẽ công bố kết quả thông qua các bài nghiên cứu, mã nguồn, bộ dữ liệu và bảng xếp hạng. 1
Tài liệu ra mắt hiện có chỉ xác nhận chương trình ở mức bộ dữ liệu, benchmark, hệ thống định tuyến và công cụ hỗ trợ con người. Tài liệu này chưa xác lập những dự án cụ thể như một bộ dữ liệu mang tên “tác hại có thể xảy ra trong tương lai” hay một nền tảng chấm điểm bởi con người được mở mã nguồn. Vì vậy, các mô tả đó nên được xem là chưa được kiểm chứng, không phải sản phẩm đã công bố.
Sampura cho biết đang tuyển những nhân sự kỹ thuật đầu tiên tại London. Chương trình của tổ chức đòi hỏi chuyên môn trải rộng từ học máy, thiết kế đánh giá, tương tác người–máy đến vận hành dữ liệu và triển khai hệ thống. 1
Các bài đăng công khai trước đây đề cập kế hoạch tuyển ít nhất sáu nhà nghiên cứu bổ sung và mức lương 100.000–290.000 bảng Anh, nhưng thông báo ra mắt của tổ chức không xác nhận chính xác những con số này. 1213
Thị trường nhân lực trong lĩnh vực đánh giá AI cũng đang cạnh tranh gay gắt. Tin tuyển dụng của METR cho vị trí Member of Technical Staff, Evaluation Execution đưa ra mức lương cơ bản 285.548–503.116 USD, đồng thời cho biết có thể trả cao hơn cho những ứng viên đặc biệt giàu kinh nghiệm. 18
Sự tương phản này cho thấy thách thức mà Sampura phải đối mặt: xây dựng hệ thống giám sát đáng tin cậy cần cả nghiên cứu kỹ thuật lẫn đánh giá thực tế cẩn trọng, trong khi các tổ chức theo đuổi bài toán này lại đang cạnh tranh để tuyển cùng một nhóm chuyên gia.
Sampura ra mắt trong bối cảnh ngày càng có nhiều lo ngại rằng tốc độ phát triển AI có thể vượt qua các hệ thống được dùng để theo dõi và kiểm soát nó. Tháng 7/2026, hơn 1.100 nhân viên từ các công ty AI lớn đã ký một thư ngỏ, đề nghị chính phủ Mỹ ủng hộ các công cụ kỹ thuật và quản trị quốc tế có thể chủ động điều tiết tốc độ phát triển AI tiên phong nếu cần. Bức thư không kêu gọi dừng ngay hoạt động phát triển AI. 40
Lĩnh vực này cũng chứng kiến nhiều biến động về nhân sự cấp cao. Reuters đưa tin về những thay đổi lãnh đạo trong bộ phận AI của Google và việc một số kỹ sư, nhà nghiên cứu nổi bật rời đi để gia nhập các công ty hoặc startup khác. 49 Những diễn biến đó giúp tạo bối cảnh cho sự ra đời của Sampura, nhưng không chứng minh rằng tổ chức phi lợi nhuận này đã giải quyết được bài toán an toàn AI.
Bằng chứng mạnh nhất hiện có cho thấy Sampura là một tổ chức nghiên cứu giai đoạn đầu, đang xây dựng hạ tầng đo lường và ra quyết định cho hoạt động giám sát AI. Các benchmark và phương pháp đánh giá kết hợp của tổ chức về sau có thể hữu ích cho các phòng thí nghiệm AI, đơn vị đánh giá độc lập hoặc những tổ chức kiểm tra hành vi mô hình. 1
Điều đó khác với việc chứng minh Sampura có thể kiểm soát các hệ thống AI tiên phong. Đóng góp trước mắt của tổ chức là tìm hiểu cách thiết kế và kiểm tra hoạt động giám sát khi mô hình bị đánh giá có năng lực cao, biết thích ứng và có thể được khuyến khích để vượt qua bài kiểm tra.
Cược lớn của Sampura là: an toàn AI trên quy mô lớn sẽ cần tự động hóa—nhưng không phải kiểu tự động hóa loại con người khỏi những phán đoán có hậu quả quan trọng nhất.
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
Sampura Research chính thức công bố ra mắt ngày 25/8/2026, không phải ngày 24/8, với mục tiêu xây dựng hệ thống đánh giá AI có sự phối hợp giữa con người và máy móc.
Sampura Research chính thức công bố ra mắt ngày 25/8/2026, không phải ngày 24/8, với mục tiêu xây dựng hệ thống đánh giá AI có sự phối hợp giữa con người và máy móc. Tổ chức này cho rằng chỉ dùng AI để giám sát AI có thể bỏ sót những lỗi mới, bị hệ thống được đánh giá thao túng hoặc lặp lại các kiểu sai lầm vốn có ở con người.
Chương trình sáu tháng đầu tiên sẽ xây dựng bảng xếp hạng “thẩm phán” gồm hơn 20 bộ dữ liệu con, nhằm so sánh người đánh giá, AI và các mô hình kết hợp.