404 Media đưa tin Project Lily huy động hàng trăm nhà thầu, được trả hơn 50 USD mỗi giờ, để đánh giá hội thoại ChatGPT thật và chấm 4 phương án trả lời theo thang 1–7. Người dùng Free, Plus và Pro trong không gian làm việc cá nhân có thể vào Cài đặt → Kiểm soát dữ liệu → tắt “Cải thiện mô hình cho mọi người” để các...
Đăng bởiBiên tập bằng GPT-5.6 TerraHình ảnh được tạo bằng GPT Image 2
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: What did the 404 Media investigation reveal about OpenAI’s secret “Project Lily,” including how hundreds of contractors paid more than $50 p. Article summary: 404 Media reported that OpenAI’s internal “Project Lily” uses outside human reviewers to evaluate real ChatGPT exchanges for model improvement—not merely synthetic test data. The investigation raises a privacy concern be. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
Theo cuộc điều tra của 404 Media về sáng kiến nội bộ mang tên Project Lily, OpenAI được cho là đã tổ chức một chương trình phản hồi có người đánh giá, dựa trên các cuộc trò chuyện thật với ChatGPT. Điểm đáng lo không chỉ là chat có thể được dùng để cải thiện mô hình: báo cáo nói rằng các nhà thầu bên ngoài có thể đọc nội dung đã bỏ tên người dùng, nhưng vẫn chứa bối cảnh cá nhân rất nhạy cảm. 2
Theo các tài liệu rò rỉ mà 404 Media xem xét, OpenAI tuyển hàng trăm nhà thầu thông qua các công ty nhân sự để đánh giá prompt thật của người dùng cùng phản hồi của ChatGPT. Công việc này được cho là trả hơn 50 USD mỗi giờ. Người đánh giá phải tóm tắt ý định của người dùng, so sánh 4 câu trả lời ứng viên và chấm điểm theo thang 1–7. 2
Mục tiêu được nêu là cải thiện chất lượng phản hồi: giúp ChatGPT bớt máy móc, hạn chế các tuyên bố quá giống con người, đồng thời giảm xu hướng đồng tình hoặc tâng bốc quá mức. Phản hồi từ con người vốn là phương pháp quen thuộc trong phát triển AI, nhưng việc dùng hội thoại thật của người tiêu dùng khiến câu hỏi về quyền riêng tư trở nên trực diện hơn. 2
404 Media cho biết người đánh giá có thể nhận được toàn bộ phần trao đổi và, trong một số trường hợp, cả bản tóm tắt bộ nhớ người dùng. Báo cáo nói tên người dùng không hiển thị, nhưng bối cảnh còn lại có thể tiết lộ nơi ở gần đúng, nghề nghiệp, mối quan tâm trước đây và hoàn cảnh cá nhân. 2
Đó là khác biệt quan trọng: bỏ tên không đồng nghĩa cuộc trò chuyện đã vô hại hay thực sự ẩn danh. Một tổ hợp chi tiết về công việc, gia đình, sức khỏe hoặc một sự kiện đặc biệt vẫn có thể rất nhạy cảm, dù không nêu trực tiếp danh tính chủ tài khoản.
OpenAI mô tả Privacy Filter là mô hình nhằm phát hiện và che giấu thông tin nhận dạng cá nhân trong văn bản. 46
47
Trong bài điều tra về Project Lily, OpenAI nói họ loại bỏ tên người dùng và áp dụng bộ lọc tự động trước khi dữ liệu đến tay nhà thầu. Tuy vậy, 404 Media đưa tin các chi tiết nhạy cảm vẫn có thể còn lại trong những cuộc trò chuyện được đưa đi đánh giá. 2
Điều này cho thấy giới hạn của việc che dữ liệu tự động. Hệ thống có thể nhận ra các định danh rõ ràng như tên, email hoặc số điện thoại, nhưng ngữ cảnh nhận diện gián tiếp thường khó phân loại đáng tin cậy hơn nhiều.
Theo bài báo, hướng dẫn dành cho nhà thầu không chỉ xoay quanh tính đúng đắn. Họ được yêu cầu nhận diện các vấn đề như:
Việc tập trung vào xu hướng “nịnh người dùng” là đáng chú ý. Một mô hình quá vội xác nhận quan điểm của người dùng có thể tạo cảm giác được ủng hộ, nhưng lại không phản biện các giả định sai, nguy hiểm hoặc có hại. Project Lily được cho là nhằm điều chỉnh một phần hành vi này. 2
Viết yêu cầu giữ bí mật trong prompt không thay đổi các thiết lập kiểm soát dữ liệu của tài khoản. Đó chỉ là nội dung trong cuộc trò chuyện, không phải mệnh lệnh kỹ thuật có thể ghi đè cách OpenAI sử dụng dữ liệu theo cài đặt của bạn.
Với không gian làm việc ChatGPT cá nhân, tùy chọn được OpenAI nêu là “Cải thiện mô hình cho mọi người” (Improve the model for everyone). Khi bật, các cuộc trò chuyện có thể được dùng để cải thiện mô hình; khi tắt, OpenAI nói họ sẽ không huấn luyện trên các cuộc trò chuyện mới. 21
30
Với người dùng đã đăng nhập, hướng dẫn của OpenAI là:
Cài đặt này áp dụng cho tài khoản, không gắn với một thiết bị cụ thể. Lịch sử chat hiện có vẫn có thể được lưu sau khi tắt, nhưng OpenAI nói các cuộc trò chuyện mới sẽ không được sử dụng để huấn luyện mô hình. 19
30
OpenAI cũng có lựa chọn “Không huấn luyện trên nội dung của tôi” (Do not train on my content) trên cổng quyền riêng tư. Công ty cho biết với các tác vụ ChatGPT và Codex, dùng lựa chọn này hoặc thiết lập Kiểm soát dữ liệu trong ứng dụng là đủ; không cần làm cả hai. 21
OpenAI cho biết với không gian làm việc cá nhân ở các gói Free, Plus và Pro, việc chia sẻ dữ liệu để huấn luyện mô hình được bật theo mặc định, dù người dùng có thể từ chối. Với ChatGPT Business, Enterprise, Edu và nền tảng API, OpenAI nói dữ liệu đầu vào và đầu ra được cung cấp không được dùng để huấn luyện mô hình theo mặc định. 23
Tuy nhiên, điều đó không biến mọi cuộc trò chuyện công việc thành hoàn toàn không rủi ro cho mọi mục đích. Tổ chức vẫn nên kiểm tra thiết lập không gian làm việc, chính sách lưu giữ, quyền chia sẻ và quy định nội bộ trước khi đưa thông tin mật vào bất kỳ công cụ AI nào.
Project Lily, theo báo cáo của 404 Media, là lời nhắc rằng ChatGPT dành cho người dùng cá nhân nên được xem là một dịch vụ có các cài đặt sử dụng dữ liệu, chứ không mặc định là kênh liên lạc tuyệt mật. Nếu prompt chứa thông tin cá nhân, pháp lý, y tế, tài chính hoặc bí mật kinh doanh đặc biệt nhạy cảm, bước thực tế an toàn nhất là tắt “Cải thiện mô hình cho mọi người” trước khi bắt đầu cuộc trò chuyện mới. 2
21
Việc từ chối chỉ kiểm soát cách OpenAI dùng các cuộc trò chuyện mới để cải thiện mô hình. Nó không phải một yêu cầu ẩn trong prompt, và tài liệu của OpenAI không mô tả đây là cách rút lại nội dung đã gửi trước đó. 21
30
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
404 Media đưa tin Project Lily huy động hàng trăm nhà thầu, được trả hơn 50 USD mỗi giờ, để đánh giá hội thoại ChatGPT thật và chấm 4 phương án trả lời theo thang 1–7.
404 Media đưa tin Project Lily huy động hàng trăm nhà thầu, được trả hơn 50 USD mỗi giờ, để đánh giá hội thoại ChatGPT thật và chấm 4 phương án trả lời theo thang 1–7. Người dùng Free, Plus và Pro trong không gian làm việc cá nhân có thể vào Cài đặt → Kiểm soát dữ liệu → tắt “Cải thiện mô hình cho mọi người” để các cuộc trò chuyện mới không được dùng cải thiện mô hình.
Theo OpenAI, dữ liệu đầu vào và đầu ra trên ChatGPT Business, Enterprise, Edu và nền tảng API không được dùng để huấn luyện mô hình theo mặc định.