Sampura Research официально объявила о запуске 25 августа 2026 года, а не 24 августа. По мнению Sampura, надзор только с помощью ИИ может пропускать новые типы ошибок, подвергаться манипуляциям со стороны проверяемой модели и воспроизводить ошибки человека.
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: What is Sampura Research, the London-based nonprofit formally launched on August 24, 2026 by former Google DeepMind researchers Rishub Jain,. Article summary: Sampura Research is a London-based AI-safety nonprofit developing “human–AI complementarity for scalable oversight”: systems in which people and AI jointly evaluate increasingly capable models rather than delegating over. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
Sampura Research — лондонская некоммерческая организация, занимающаяся безопасностью искусственного интеллекта. Её ключевой вопрос звучит так: кто должен решать, ведёт ли себя всё более способная модель правильно и безопасно? Ответ организации — не исключать человека из процесса, а разделить надзор между людьми и ИИ.
Sampura сообщила о первоначальном гранте в размере 11 млн долларов от Coefficient Giving: 7 млн долларов предназначены для первого года работы, ещё 4 млн обещаны дополнительно. 1
Публичное объявление о запуске датировано 25 августа 2026 года, а не 24 августа. В нём основателями названы Ришуб Джайн и Джош Джейкоб. В более ранних публикациях в соцсетях упоминался Алекс Адамс, однако объявление о запуске не подтверждает, что все трое официально основали некоммерческую организацию. 112
В терминологии Sampura, «судьёй» может быть человек, модель ИИ или гибридная система, которая проверяет, насколько поведение другой ИИ-системы корректно и соответствует заданным целям. Объектом оценки может быть отдельный ответ, диалог или многоэтапная траектория действий автономного агента. 1
Это важно потому, что возможности модели и качество надзора часто рассматривают как разные задачи. Система может писать убедительные ответы и выполнять сложные поручения, но при этом вводить проверяющего в заблуждение, использовать лазейки в функции вознаграждения или совершать опасные действия в длинной последовательности шагов. Sampura хочет улучшить инструменты, которые должны обнаруживать такие сбои.
Организация описывает свой подход как дополняющее взаимодействие человека и ИИ для масштабируемого надзора: автоматизировать то, что машины делают надёжно, но сохранять участие людей там, где требуются интерпретация, суждение или решения, затрагивающие ценности. 1
Автоматические оценщики привлекательны: они работают быстрее и дешевле, особенно при проверке огромного числа примеров. Но скорость сама по себе не делает проверяющую систему надёжной. В заявлении о запуске Sampura выделяет несколько рисков:
Это не означает, что человек всегда лучше машины. Аргумент Sampura в другом: необходимо проверить, какое сочетание человеческой и машинной оценки сохраняет надёжность под давлением, вместо того чтобы заранее отдавать весь контроль одной стороне. 1
Первые шесть месяцев работы посвящены созданию разнообразного рейтинга систем-«судей» более чем с 20 поднаборами данных. Среди заявленных направлений — выявление обмана, культурной предвзятости и небезопасных действий ИИ-агентов. 1
Проверка не ограничится статичными вопросами и ответами. Sampura планирует также сценарии, в которых контролируемая модель во время обучения с подкреплением напрямую оптимизируется против судьи. Такой эксперимент должен показать, продолжает ли оценщик работать, когда у проверяемой системы появляется стимул найти и использовать его слабые места. 1
Исследователи собираются сравнить три подхода:
Цель — не просто получить высокий результат в одном узком тесте. Sampura хочет найти системы, которые сохраняют устойчивость на широком наборе проверок и не теряют эффективность по мере того, как контролируемые модели учатся обходить оценивание. 1
Sampura рассматривает несколько вариантов объединения человеческих и машинных решений:
В таком подходе участие человека — не принцип «всё или ничего», а параметр, который можно оптимизировать. Простые и надёжные случаи можно проверять автоматически, а более важные или неоднозначные — передавать человеку. Поэтому главный компромисс выглядит не как «человек против ИИ», а как поиск баланса между точностью, стоимостью, скоростью и устойчивостью к намеренному обходу проверки. 1
После создания более надёжных судей Sampura намерена проверить, помогают ли они снижать взлом функции вознаграждения — ситуацию, когда модель находит способ формально получить высокий результат, не достигая реальной цели обучения. Организация также хочет изучить, сколько человеческого участия необходимо, как должны адаптироваться системы надзора, когда базовые модели учатся их обходить, и можно ли применять судей не только для классификации готовых ответов. 1
В перспективе речь может идти о подготовке и оценке спецификаций, инструкций, критериев и тестовых сценариев, по которым ИИ обучают и проверяют. Sampura обещает публиковать результаты в виде научных работ, кода, наборов данных и рейтингов. 1
При этом доступные материалы подтверждают именно общую программу с наборами данных, бенчмарками, маршрутизацией задач и инструментами помощи людям. Они не подтверждают существование каждого более конкретного проекта, который связывают с организацией, включая отдельно названный набор данных о «перспективном вреде» или готовую платформу для открытого оценивания людьми. Такие описания следует считать неподтверждёнными, а не анонсированными продуктами.
Sampura объявила о найме первых технических сотрудников в Лондоне. Для её программы нужны специалисты по машинному обучению, дизайну оценивания, взаимодействию человека и компьютера, работе с данными и внедрению систем. 1 В более ранних публичных сообщениях говорилось о найме как минимум ещё шести исследователей и зарплатах от 100 000 до 290 000 фунтов в год, однако эти точные цифры не подтверждены объявлением о запуске некоммерческой организации. 1213
Рынок специалистов по оценке ИИ уже испытывает дефицит. В собственной вакансии METR на должность специалиста по выполнению оценок указана базовая зарплата от 285 548 до 503 116 долларов в год; организация также допускает более высокую оплату для исключительно опытных кандидатов. 18
Это показывает масштаб задачи Sampura: надёжный надзор требует не только разработки моделей, но и продуманного дизайна проверок, человеческих интерфейсов и практической эксплуатации. При этом некоммерческие организации, работающие над безопасностью ИИ, конкурируют за многих одних и тех же специалистов с крупнейшими технологическими компаниями.
Запуск Sampura состоялся на фоне опасений, что развитие ИИ может опередить системы, призванные его контролировать. В июле 2026 года более 1 100 сотрудников крупных ИИ-компаний подписали открытое письмо с призывом к правительству США поддержать международные технические и управленческие механизмы, которые при необходимости позволили бы намеренно замедлить развитие передовых систем. Письмо не призывало немедленно останавливать разработку ИИ. 40
В этой же более широкой картине происходят заметные кадровые перестановки в индустрии. Reuters сообщило об изменениях в руководстве ИИ-подразделения Google и уходе известных инженеров и исследователей в другие компании и стартапы. 49 Эти события помогают понять контекст появления Sampura, но сами по себе не доказывают, что некоммерческая организация уже решила проблему безопасности.
Наиболее надёжно подтверждённая характеристика Sampura — ранняя исследовательская организация, создающая инфраструктуру измерения и принятия решений для надзора за ИИ. Её бенчмарки и гибридные методы оценки в будущем могут пригодиться разработчикам моделей, независимым аудиторам и другим организациям, проверяющим поведение ИИ. 1
Но это не доказательство того, что Sampura способна сдержать передовые системы ИИ. Её ближайшая задача — исследовать, как проектировать и тестировать надзор, если проверяемая модель становится способной к адаптации, сложному поведению и намеренному поиску лазеек в оценивании.
Главная ставка организации проста: масштабируемая безопасность потребует автоматизации — но не такой автоматизации, которая исключает человека из самых важных решений.
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
Sampura Research официально объявила о запуске 25 августа 2026 года, а не 24 августа.
Sampura Research официально объявила о запуске 25 августа 2026 года, а не 24 августа. По мнению Sampura, надзор только с помощью ИИ может пропускать новые типы ошибок, подвергаться манипуляциям со стороны проверяемой модели и воспроизводить ошибки человека.
В первые шесть месяцев организация планирует создать рейтинг систем «судей» более чем с 20 наборами данных и сравнить человеческих, машинных и гибридных оценщиков.