404 Media informó el 15 de septiembre de 2026 que el «Project Lily» de OpenAI recurre a cientos de contratistas externos para evaluar conversaciones reales de usuarios de ChatGPT, incluso cuando incluyen contexto pote... Según la investigación, los revisores resumen la intención del usuario, comparan cuatro respuest...
Publicado porEditado con GPT-5.6 TerraImágenes generadas con GPT Image 2
Respuesta de investigación

Create a landscape editorial hero image for this Studio Global article: What did the 404 Media investigation published on September 15, 2026, reveal about OpenAI’s secret “Project Lily,” including how hundreds of. Article summary: 404 Media reported that OpenAI’s internal “Project Lily” uses a large outsourced human-feedback operation to improve ChatGPT using real consumer conversations—not merely public web data or synthetic tests. The report is . Topic tags: general, general web, academic, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, char
La investigación de 404 Media sobre el Project Lily de OpenAI describe una operación de evaluación humana basada en conversaciones reales de consumidores de ChatGPT. Según documentos filtrados, ejemplos de indicaciones y declaraciones examinadas por el medio, contratistas externos pueden leer el contexto de los chats para valorar las respuestas del modelo, incluso si las conversaciones contienen datos personales sensibles. 1
Para quienes usan ChatGPT para asuntos personales, de salud, relaciones, trabajo o cuestiones legales, la conclusión práctica es clara: pedirle al chatbot que «esto quede entre nosotros» no es una configuración de privacidad. Lo determinante es si la cuenta permite que las conversaciones nuevas se usen para mejorar el modelo. 1
404 Media informó que cientos de contratistas, contratados a través de empresas de trabajo temporal y con pagos superiores a 50 dólares por hora, revisan un gran flujo de conversaciones reales de ChatGPT. Sus tareas incluirían:
Los criterios de evaluación estarían orientados a mejorar la calidad y el tono de las respuestas. Los revisores deben señalar formulaciones que suenen a IA, errores factuales, un tono excesivamente complaciente o adulador, riesgos de seguridad y respuestas que hagan creer falsamente que el modelo tiene experiencias o emociones propias. 1
El objetivo es que ChatGPT responda de forma más natural y menos mecánica. Pero ese proceso de mejora puede implicar que personas autorizadas accedan al contenido de conversaciones de usuarios. 1
OpenAI dijo a 404 Media que elimina los nombres de usuario y aplica un filtro de privacidad antes de enviar el material a los revisores. Sin embargo, la investigación encontró ejemplos en los que los materiales de revisión podían incluir el contexto completo de una conversación y resúmenes de memoria generados por el modelo. Esos resúmenes contenían, según el medio, datos como una ubicación aproximada, profesión y circunstancias personales muy íntimas. 1
El problema es la identificación por contexto. Aunque se elimine un nombre o identificador de cuenta, la combinación de episodios de vida, detalles profesionales, referencias geográficas o datos inusuales puede volver reconocible una conversación para alguien que conozca a la persona, o simplemente hacer que su exposición resulte muy sensible. 404 Media señaló que OpenAI reconoció que los filtros pueden tener dificultades con identificadores poco comunes y referencias privadas ambiguas o dependientes del contexto. 1
Pedirle a ChatGPT que mantenga una conversación en confidencialidad es una instrucción dentro del chat, no una preferencia de privacidad de la cuenta. No anula la configuración de uso de datos del servicio ni evita que el chat pueda ser seleccionado para un flujo de mejora como el descrito por 404 Media. 1
Por eso conviene no tratar un chatbot de consumo como un canal confidencial solo porque la conversación parezca personal. Si divulgar cierta información a un revisor autorizado podría causar un perjuicio, lo más prudente es no introducirla en un espacio de trabajo personal que tenga activada la mejora del modelo.
La documentación de controles de datos de OpenAI indica que los usuarios de espacios personales pueden desactivar la mejora del modelo siguiendo estos pasos:
Con esta opción desactivada, las conversaciones nuevas seguirán apareciendo en el historial, pero no se usarán para entrenar o mejorar los modelos de ChatGPT. La configuración se aplica a la cuenta, no a un dispositivo concreto.
El momento en que se cambia el ajuste importa: OpenAI indica que la exclusión se aplica a las conversaciones nuevas. No elimina de forma retroactiva los chats que ya se enviaron mientras la mejora del modelo estaba activada.
OpenAI afirma que, de forma predeterminada, no usa para entrenar sus modelos las entradas y salidas de ChatGPT Business, Enterprise, Edu ni de su plataforma API. En cambio, para usuarios de ChatGPT Free, Plus y Pro en espacios personales, el uso de datos para mejorar el modelo está activado por defecto, aunque puede desactivarse en los controles de datos.
Esa diferencia no elimina las obligaciones de gobierno de datos de una organización. Los equipos deben seguir las políticas de su empresa o institución y revisar los ajustes concretos de su espacio de trabajo. Aun así, es una distinción relevante frente al tratamiento predeterminado de los chats de consumo.
El uso de revisión humana para mejorar sistemas de IA no es una práctica exclusiva de OpenAI. La política de privacidad de Anthropic indica que puede entrenar y mejorar sus modelos con entradas y salidas proporcionadas por usuarios o trabajadores externos, salvo que los usuarios se excluyan. Un análisis académico de las prácticas de privacidad de grandes proveedores de IA también concluyó que Google y OpenAI contemplan la revisión humana de chats de usuarios para el entrenamiento o la mejora de modelos.
La cuestión de fondo no es solo si existe retroalimentación humana, sino si los usuarios entienden cuándo sus conversaciones pueden entrar en ese proceso, qué límites tiene la desidentificación y cómo modificar la configuración aplicable.
Project Lily, tal como lo describió 404 Media, recuerda que un chat de IA de consumo no equivale automáticamente a una conversación confidencial entre dos personas. Las medidas de desidentificación pueden reducir la exposición, pero no necesariamente eliminan todos los detalles reveladores de una conversación con mucho contexto personal. 1
Antes de compartir información sensible en ChatGPT, conviene revisar Configuración → Controles de datos → Mejorar el modelo para todos. Si la mejora del modelo está activada, trate los chats nuevos como potencialmente aptos para mejorar el servicio; si está desactivada, OpenAI afirma que las conversaciones nuevas no se usarán con ese fin.
Studio Global AI
Esta página incluye una respuesta respaldada por fuentes que puede continuar dentro de Studio Global.
404 Media informó el 15 de septiembre de 2026 que el «Project Lily» de OpenAI recurre a cientos de contratistas externos para evaluar conversaciones reales de usuarios de ChatGPT, incluso cuando incluyen contexto pote...
404 Media informó el 15 de septiembre de 2026 que el «Project Lily» de OpenAI recurre a cientos de contratistas externos para evaluar conversaciones reales de usuarios de ChatGPT, incluso cuando incluyen contexto pote... Según la investigación, los revisores resumen la intención del usuario, comparan cuatro respuestas candidatas y las puntúan de 1 a 7 para ayudar a que ChatGPT sea menos robótico, menos complaciente y más fiable.
OpenAI afirmó que elimina nombres de usuario y aplica un filtro de privacidad, pero 404 Media halló que los resúmenes de memoria y otros detalles contextuales aún pueden revelar información personal sensible.