По данным 404 Media, OpenAI отстранила нескольких подрядчиков, которые использовали ИИ при выполнении заданий по оценке её моделей. Дело не в том, что сотрудники компании, разрабатывающей ИИ, воспользовались ИИ как таковым. Ценность этих заданий — в независимом мнении человека о том, насколько удачно ChatGPT отвечает пользователю. В публикациях отстранения рассматриваются на фоне более широкой работы OpenAI с подрядчиками, а Project Lily описывается как одна из программ человеческой оценки. При этом нет оснований утверждать, что каждый отстранённый подрядчик работал именно в Project Lily.
16
13
Как устроена оценка в Project Lily
По сообщениям СМИ, в Project Lily участвуют сотни внешних подрядчиков. Они изучают реальные запросы к ChatGPT, а в некоторых случаях — и переписку вокруг запроса. Проверяющих, как сообщается, привлекают через Crossing Hurdles, а выплаты проходят через Mercor. Один из работников рассказал о заработке более 50 долларов в час; считать эту сумму общей ставкой для всех проверяющих нельзя.
2
20
Задача проверяющего — кратко изложить, чего хотел пользователь, затем оценить предложенные ответы ChatGPT и объяснить их сильные и слабые стороны. В заданиях, согласно публикациям, может быть до четырёх вариантов ответа; каждый оценивают по шкале от 1 до 7. Среди важных критериев — тон, шаблонные «роботизированные» обороты и чрезмерная склонность соглашаться с пользователем. Оценки и письменные замечания предназначены для улучшения поведения будущих моделей.
4
11
3
1
Почему нельзя поручить эту работу другой модели
Человек может самостоятельно заметить, что ответ формально вежлив, но не решает задачу, или что ChatGPT слишком охотно поддакивает пользователю. Если замечания и балл вместо него формирует ИИ, обратная связь перестаёт быть независимой: в неё могут попасть предпочтения другой модели. Это риск для качества данных, а не доказательство того, что какая-либо конкретная оценка уже навредила модели.
4
16
Согласно опубликованным правилам, проверяющим запрещено применять ИИ для анализа заданий и написания отзывов — в том числе функции Grammarly и машинного перевода на основе ИИ. Подрядчикам, которые проверяют работу других оценщиков, также запрещают пользоваться программами для выявления текста, созданного ИИ: в инструкциях такие детекторы названы ненадёжными.
13
9
Как замечают нарушения — и чего проверка не гарантирует
По сообщениям СМИ, руководители обращают внимание на косвенные признаки: повторяющиеся формулировки, похожие на текст ИИ, или необычно быстро выполненные задания. Это повод присмотреться к работе, но не доказательство само по себе. Из доступных публикаций нельзя понять, как часто такие проверки верно выявляют нарушения и сколько случаев пропускают.
9
33
Есть и другая граница надёжности: человеческая оценка не обязательно качественная оценка. Проверяющий может ошибиться, отнестись к заданию небрежно или намеренно поставить плохой балл. Однако доступные материалы не подтверждают конкретное предполагаемое признание подрядчика в умышленном выставлении неверных оценок — судить об обстоятельствах этого эпизода или о распространённости подобной практики нельзя. Вывод здесь уже и точнее: пометка «оценено человеком» говорит о происхождении отзыва, но не гарантирует правильности каждого суждения. Нужен и контроль качества самих оценок.
1
4
Для пользователей Project Lily поднимает отдельный вопрос — приватность переписки. Проверяющие могут видеть текст реальных разговоров, а фильтр, который, по сообщениям, OpenAI применяет для удаления личных данных, способен пропустить чувствительные сведения. Поэтому важно не только то, кто и как оценивает ответы, но и то, какие пользовательские данные при этом попадают к проверяющим.
8
12