404 Media đưa tin ngày 15/9/2026 rằng “Project Lily” của OpenAI sử dụng hàng trăm nhà thầu thuê ngoài để đánh giá các cuộc trò chuyện ChatGPT thật của người dùng cá nhân, đôi khi có bối cảnh nhạy cảm. Theo tài liệu mà 404 Media xem xét, người đánh giá tóm tắt ý định người dùng, so sánh bốn phương án trả lời và chấm...
Đăng bởiBiên tập bằng GPT-5.6 TerraHình ảnh được tạo bằng GPT Image 2
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: What did the 404 Media investigation published on September 15, 2026, reveal about OpenAI’s secret “Project Lily,” including how hundreds of. Article summary: 404 Media reported that OpenAI’s internal “Project Lily” uses a large outsourced human-feedback operation to improve ChatGPT using real consumer conversations—not merely public web data or synthetic tests. The report is . Topic tags: general, general web, academic, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, char
404 Media cho biết cuộc điều tra về Project Lily — một dự án nội bộ của OpenAI — đã mô tả quy trình phản hồi có con người tham gia, dựa trên các cuộc trò chuyện ChatGPT thật của người dùng cá nhân. Theo tài liệu bị rò rỉ, các ví dụ prompt và phản hồi mà tờ báo xem xét, nhà thầu thuê ngoài có thể đọc bối cảnh trò chuyện để đánh giá câu trả lời của mô hình, kể cả khi đoạn chat chứa chi tiết riêng tư, nhạy cảm. 1
Điểm cần nhớ với người dùng ChatGPT cho các vấn đề cá nhân, sức khỏe, quan hệ, pháp lý hoặc công việc là: câu nhắn “hãy giữ kín chuyện này” không phải một cơ chế kiểm soát quyền truy cập. Cài đặt liên quan là tài khoản có cho phép dùng các cuộc trò chuyện mới để cải thiện mô hình hay không. 1
Theo 404 Media, hàng trăm nhà thầu được tuyển qua các công ty cung ứng nhân sự, với mức thù lao hơn 50 USD mỗi giờ, xem xét một lượng lớn hội thoại ChatGPT thật. Công việc của họ được cho là gồm:
Các tiêu chí đánh giá tập trung vào việc nâng chất lượng và cảm giác tự nhiên của câu trả lời. Người đánh giá được hướng dẫn đánh dấu lối diễn đạt mang nặng kiểu AI, thông tin sai sự thật, giọng điệu tâng bốc hoặc đồng tình quá mức, vấn đề an toàn, cũng như các phản hồi khiến người dùng hiểu nhầm rằng mô hình có trải nghiệm hay cảm xúc cá nhân. 1
Vòng phản hồi này nhằm giúp ChatGPT bớt cứng nhắc và tự nhiên hơn. Nhưng điều đó cũng đồng nghĩa quá trình cải thiện chất lượng có thể liên quan đến việc con người tiếp cận nội dung hội thoại của người dùng. 1
OpenAI nói với 404 Media rằng tên người dùng được loại bỏ và một Bộ lọc quyền riêng tư được áp dụng trước khi tài liệu tới tay người đánh giá. Tuy nhiên, cuộc điều tra phát hiện tài liệu đánh giá có thể gồm toàn bộ ngữ cảnh hội thoại và phần tóm tắt bộ nhớ do mô hình tạo ra. Các phần tóm tắt này được cho là có thể chứa thông tin như khu vực sinh sống gần đúng, nghề nghiệp và những hoàn cảnh cá nhân rất riêng tư. 1
Vấn đề nằm ở khả năng nhận diện từ ngữ cảnh. Dù tên hay mã định danh tài khoản bị gỡ bỏ, tổ hợp các sự kiện đời sống, thông tin nghề nghiệp, địa điểm hay chi tiết hiếm gặp vẫn có thể khiến một cuộc trò chuyện trở nên dễ nhận ra với người quen — hoặc đơn giản là quá nhạy cảm để bị lộ. Theo 404 Media, OpenAI thừa nhận bộ lọc có thể khó xử lý các định danh ít phổ biến và những chi tiết riêng tư mơ hồ, phụ thuộc vào ngữ cảnh. 1
Dặn ChatGPT giữ bí mật chỉ là một chỉ dẫn bên trong cuộc hội thoại, không phải tùy chọn quyền riêng tư của tài khoản. Nó không ghi đè cài đặt sử dụng dữ liệu của dịch vụ và không ngăn một đoạn chat được chọn vào quy trình cải thiện mà 404 Media mô tả. 1
Vì vậy, không nên xem chatbot tiêu dùng là kênh bảo mật chỉ vì cuộc trò chuyện mang tính riêng tư. Nếu một thông tin có thể gây hại khi được tiết lộ cho người đánh giá được ủy quyền, an toàn hơn là không nhập thông tin đó trong không gian làm việc cá nhân khi tính năng cải thiện mô hình đang bật.
Theo tài liệu Data Controls của OpenAI, người dùng không gian làm việc cá nhân có thể tắt việc cải thiện mô hình theo các bước:
Khi tắt tùy chọn này, các cuộc trò chuyện mới vẫn hiện trong lịch sử chat nhưng sẽ không được dùng để huấn luyện hoặc cải thiện các mô hình ChatGPT. Cài đặt áp dụng cho toàn bộ tài khoản, không phụ thuộc vào từng thiết bị.
Thời điểm thay đổi rất quan trọng: OpenAI nói việc từ chối chỉ áp dụng cho các cuộc trò chuyện mới. Nó không rút lại các cuộc trò chuyện đã được gửi đi trong lúc tính năng cải thiện mô hình còn bật.
OpenAI cho biết mặc định họ không dùng dữ liệu đầu vào và đầu ra từ ChatGPT Business, Enterprise, Edu hoặc nền tảng API để huấn luyện mô hình. Ngược lại, việc chia sẻ dữ liệu để cải thiện mô hình được bật mặc định cho người dùng ChatGPT Free, Plus và Pro trong không gian làm việc cá nhân, dù họ có thể tắt trong Data Controls.
Sự khác biệt này không thay thế các yêu cầu quản trị dữ liệu của tổ chức. Các nhóm vẫn nên tuân thủ chính sách của cơ quan, doanh nghiệp và kiểm tra đúng cài đặt của không gian làm việc mình sử dụng. Tuy vậy, đây là khác biệt đáng chú ý so với cách dữ liệu chat tiêu dùng được xử lý mặc định.
Không. Việc có người tham gia đánh giá không chỉ xảy ra ở OpenAI. Chính sách quyền riêng tư của Anthropic nêu rằng họ có thể huấn luyện và cải thiện mô hình bằng dữ liệu đầu vào, đầu ra do người dùng hoặc lực lượng lao động cộng đồng cung cấp, trừ khi người dùng từ chối. Một nghiên cứu học thuật về chính sách quyền riêng tư của các nhà cung cấp AI lớn cũng ghi nhận Google và OpenAI đều đề cập việc con người xem xét chat của người dùng nhằm huấn luyện hoặc cải thiện mô hình.
Vấn đề cốt lõi không phải là có hay không có phản hồi từ con người, mà là người dùng có hiểu khi nào hội thoại của mình có thể đi vào quy trình đó, biện pháp khử nhận dạng bảo vệ được đến đâu, và phải đổi cài đặt nào hay không.
Project Lily, theo thông tin 404 Media đưa ra, nhắc rằng chat AI tiêu dùng không mặc nhiên là cuộc trao đổi riêng tư một-một. Biện pháp khử nhận dạng có thể giảm mức độ lộ lọt, nhưng chưa chắc loại bỏ toàn bộ chi tiết có thể tiết lộ danh tính trong một cuộc trò chuyện giàu bối cảnh cá nhân. 1
Trước khi chia sẻ thông tin nhạy cảm trên ChatGPT, hãy kiểm tra Cài đặt → Kiểm soát dữ liệu → Cải thiện mô hình cho mọi người. Nếu tính năng này đang bật, nên hiểu rằng các cuộc trò chuyện mới có thể đủ điều kiện được sử dụng để cải thiện dịch vụ; nếu tắt, OpenAI nói các cuộc trò chuyện mới sẽ không được dùng cho mục đích đó.
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
404 Media đưa tin ngày 15/9/2026 rằng “Project Lily” của OpenAI sử dụng hàng trăm nhà thầu thuê ngoài để đánh giá các cuộc trò chuyện ChatGPT thật của người dùng cá nhân, đôi khi có bối cảnh nhạy cảm.
404 Media đưa tin ngày 15/9/2026 rằng “Project Lily” của OpenAI sử dụng hàng trăm nhà thầu thuê ngoài để đánh giá các cuộc trò chuyện ChatGPT thật của người dùng cá nhân, đôi khi có bối cảnh nhạy cảm. Theo tài liệu mà 404 Media xem xét, người đánh giá tóm tắt ý định người dùng, so sánh bốn phương án trả lời và chấm điểm từ 1 đến 7 nhằm giúp ChatGPT bớt máy móc, bớt xu nịnh và đáng tin cậy hơn.
OpenAI được cho là xóa tên người dùng và áp dụng Bộ lọc quyền riêng tư, nhưng các chi tiết theo ngữ cảnh cùng phần tóm tắt bộ nhớ vẫn có thể làm lộ thông tin cá nhân nhạy cảm.