Selon 404 Media, des centaines de prestataires, rémunérés à plus de 50 dollars de l’heure, évaluaient de vrais échanges ChatGPT, comparant quatre réponses sur une échelle de 1 à 7. La suppression des noms d’utilisateur et un filtrage automatisé n’empêchent pas nécessairement l’exposition d’un contexte personnel sens...
Publié parModifié avec GPT-5.6 TerraImages générées avec GPT Image 2
Réponse de recherche

Create a landscape editorial hero image for this Studio Global article: What did the 404 Media investigation reveal about OpenAI’s secret “Project Lily,” including how hundreds of contractors paid more than $50 p. Article summary: 404 Media reported that OpenAI’s internal “Project Lily” uses outside human reviewers to evaluate real ChatGPT exchanges for model improvement—not merely synthetic test data. The investigation raises a privacy concern be. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
L’enquête de 404 Media sur une initiative interne d’OpenAI baptisée Project Lily décrit un programme structuré de retours humains fondé sur de véritables conversations ChatGPT. La question de confidentialité ne se limite donc pas à l’usage des échanges pour améliorer les modèles : d’après le média, des prestataires externes pouvaient lire des contenus dont le nom d’utilisateur avait été retiré, mais qui conservaient parfois un contexte très personnel. 2
D’après des documents internes consultés par 404 Media, OpenAI a recruté des centaines de prestataires par l’intermédiaire de sociétés de recrutement. La rémunération aurait dépassé 50 dollars de l’heure. Leur tâche : résumer l’intention de l’utilisateur, comparer quatre réponses possibles de ChatGPT, puis les noter sur une échelle de 1 à 7. 2
L’objectif rapporté était d’améliorer la qualité des réponses, notamment en rendant ChatGPT moins mécanique, moins enclin à se présenter comme humain et moins excessivement complaisant. Le recours à des évaluations humaines est courant dans le développement de l’IA ; ici, c’est l’emploi de conversations réelles d’utilisateurs qui rend l’enjeu de confidentialité plus concret. 2
404 Media rapporte que les évaluateurs pouvaient recevoir l’échange complet et, dans certains cas, un résumé des mémoires utilisateur. Les noms d’utilisateur n’étaient pas affichés, mais le contexte disponible pouvait tout de même révéler une localisation approximative, une profession, des centres d’intérêt passés ou des circonstances personnelles. 2
C’est une différence essentielle : retirer un nom ne rend pas automatiquement une conversation anodine ni réellement anonyme. L’addition d’éléments liés au travail, à la famille, à la santé ou à un événement singulier peut rester sensible, même sans identifier directement le titulaire d’un compte.
OpenAI présente son Privacy Filter comme un modèle destiné à détecter et à masquer les informations permettant d’identifier une personne dans un texte. 46
47
Dans le cadre de Project Lily, OpenAI a indiqué avoir supprimé les noms d’utilisateur et appliqué un filtre automatisé avant la transmission des contenus aux prestataires. Mais 404 Media rapporte que des détails sensibles pouvaient malgré tout subsister dans les conversations examinées. 2
Un filtrage automatisé peut repérer des identifiants évidents, comme un nom, une adresse e-mail ou un numéro de téléphone. En revanche, un contexte indirect — métier, lieu approximatif, événement de vie inhabituel — est nettement plus difficile à détecter de manière fiable.
Les consignes décrites dans l’enquête ne portaient pas uniquement sur l’exactitude des réponses. Les prestataires auraient aussi dû repérer :
L’attention portée à la complaisance est importante. Un modèle qui valide trop facilement les propos de son interlocuteur peut sembler rassurant, tout en évitant de remettre en cause des hypothèses erronées, risquées ou préjudiciables. Project Lily devait notamment contribuer, selon le reportage, à ajuster ce comportement. 2
Écrire dans une invite que la conversation doit rester confidentielle ne modifie pas les règles de traitement des données du compte. Cette phrase fait partie du contenu du chat : elle ne remplace ni ne contourne les paramètres de contrôle des données d’OpenAI.
Pour les espaces de travail personnels ChatGPT, le réglage documenté par OpenAI s’appelle « Improve the model for everyone ». Lorsqu’il est activé, les conversations peuvent être utilisées pour améliorer les modèles ; lorsqu’il est désactivé, OpenAI indique ne plus entraîner ses modèles sur les nouvelles conversations. 21
30
Pour les personnes connectées à leur compte, OpenAI indique la marche à suivre suivante :
Ce réglage s’applique au compte, et non à un appareil en particulier. L’historique existant peut rester accessible après sa désactivation, mais OpenAI indique que les nouvelles conversations ne seront plus utilisées pour entraîner ses modèles. 19
30
L’entreprise propose également l’option « Do not train on my content » via son portail de confidentialité. Pour les tâches ChatGPT et Codex, OpenAI précise qu’il suffit d’utiliser l’une de ces deux options : il n’est pas nécessaire de les activer toutes les deux. 21
OpenAI indique que, dans les espaces de travail personnels Free, Plus et Pro, le partage de données pour l’entraînement est activé par défaut, avec possibilité de s’y opposer. Pour ChatGPT Business, Enterprise, Edu et la plateforme API, OpenAI affirme ne pas utiliser par défaut les données fournies en entrée et en sortie pour entraîner ses modèles. 23
Cela ne signifie pas pour autant que tout échange professionnel est sans risque, quel qu’en soit l’usage. Les organisations ont intérêt à vérifier leurs paramètres d’espace de travail, leurs règles de conservation, leurs modalités de partage et leurs propres politiques internes avant d’y introduire des informations confidentielles.
Project Lily, tel que décrit par 404 Media, rappelle qu’un chat d’IA grand public doit être considéré comme un service doté de paramètres d’usage des données, et non comme un canal intrinsèquement confidentiel. Avant de saisir des informations personnelles, médicales, juridiques, financières ou propriétaires particulièrement sensibles, la précaution immédiate consiste à désactiver « Improve the model for everyone ». 2
21
Ce choix concerne l’utilisation des nouvelles conversations pour l’amélioration des modèles. Il ne correspond pas à une consigne écrite dans une invite et la documentation d’OpenAI ne le présente pas comme un mécanisme permettant de retirer des contenus déjà envoyés. 21
30
Studio Global AI
Cette page comprend une réponse basée sur la source que vous pouvez continuer dans Studio Global.
Selon 404 Media, des centaines de prestataires, rémunérés à plus de 50 dollars de l’heure, évaluaient de vrais échanges ChatGPT, comparant quatre réponses sur une échelle de 1 à 7.
Selon 404 Media, des centaines de prestataires, rémunérés à plus de 50 dollars de l’heure, évaluaient de vrais échanges ChatGPT, comparant quatre réponses sur une échelle de 1 à 7. La suppression des noms d’utilisateur et un filtrage automatisé n’empêchent pas nécessairement l’exposition d’un contexte personnel sensible : profession, localisation approximative ou situation familiale, par exemple.
Dans un espace personnel Free, Plus ou Pro, désactivez « Improve the model for everyone » dans Paramètres → Contrôles des données pour que les nouvelles conversations ne servent plus à améliorer les modèles.