Retour au fil

Quelqu'un lit ce que vous confiez à ChatGPT : dans les coulisses du Project Lily

Une enquête de 404 Media, relayée par Barış Özcan, révèle qu'une partie des conversations ChatGPT est lue et notée par de vraies personnes dans le cadre du Project Lily — écrire « garde ça entre nous » ne change rien en soi.

Importé dans Nodesdaily : (UTC+03:00)
Voir sur YouTube — zbUurdDEPqM
Options de lecture

La lecture vocale n’est pas disponible dans ce navigateur.

Loupe à concepts

Choisissez un terme technique de cette vue pour lire sa définition générale, un exemple pédagogique et son usage dans l’article.

Aucun terme de notre glossaire n’a été trouvé dans cette vue. Le glossaire ne couvre pas encore tous les termes.

Barış Özcan ouvre avec une expérience délibérée : il tape une inquiétude personnelle dans ChatGPT, ajoute « garde ça entre nous » et garde la réponse du modèle pour la fin. Le procédé rejoint exactement l'enquête de Joseph Cox publiée le 14 septembre dans 404 Media — un reportage fondé sur des documents internes d'OpenAI divulgués au sujet d'un programme interne appelé Project Lily. L'affirmation est simple et troublante : une partie de ce que les gens murmurent dans la boîte de dialogue est bel et bien lue par des humains, et même la mention « ne partagez pas ceci » est lue avec le reste. La question n'est pas de savoir si le modèle promet le secret, mais qui peut tenir cette promesse.

Qu'est-ce que le Project Lily ? Selon les guides et exemples divulgués que Cox a examinés, OpenAI achemine de vraies conversations d'utilisateurs vers des centaines de sous-traitants externes qui les transforment en signal d'entraînement. Le flux de travail comporte trois étapes : lire une conversation réelle de bout en bout, reformuler avec ses propres mots ce que l'utilisateur cherchait réellement à faire, puis noter quatre réponses différentes du modèle sur une échelle de sept points. L'objectif n'est pas de choisir une seule bonne réponse, mais d'enseigner le ton, la longueur et les limites — ce qui compte comme utile, ce qui relève de la flagornerie, ce qui constitue une usurpation d'identité humaine. C'est un travail invisible qui façonne le comportement aussi directement que la collecte de données ou le talent en ingénierie, mais qui apparaît rarement dans le récit marketing.

Qu'est-ce qui atterrit sur l'écran d'un évaluateur ? Parfois pas une simple requête, mais le dialogue entier, tout l'échange entre l'utilisateur et le chatbot. OpenAI affirme que les noms d'utilisateur sont masqués et qu'un filtre automatisé tente d'effacer les données personnelles avant que la conversation n'arrive à un évaluateur, mais l'entreprise reconnaît aussi que le filtre peut laisser passer des éléments. Plus révélateur encore, certaines files d'attente affichent en haut un résumé de la mémoire — ce que la personne utilisait auparavant ChatGPT à faire, parfois approximativement où elle habite. Ce résumé élargit discrètement la fenêtre que l'anonymisation était censée réduire.

Quelles conversations sont choisies et qui les lit ? La transparence est mince. Avec plus de 900 millions d'utilisateurs de ChatGPT, aucune équipe humaine ne pouvait tout voir, mais les critères de sélection ne sont précisés nulle part, ni le routage par langue. La vidéo souligne qu'aucune ligne du reportage n'explique comment les conversations en turc sont traitées. Pour illustrer le propos, elle rappelle la divulgation de 2019 selon laquelle les enregistrements de Google Assistant étaient écoutés non pas par un logiciel de traduction, mais par des locuteurs natifs embauchés comme sous-traitants — et l'un d'eux a décrit ce travail à la télévision belge. La question traverse intacte l'année 2026 : quelle langue parle la personne dans cette nouvelle boîte, et sous quelle consigne ?

OpenAI vous l'a-t-il dit clairement ? C'est ici que la vidéo convoque l'essai d'Edgar Allan Poe de 1836 sur le Joueur d'échecs de Maelzel. Poe observait que chaque fois qu'on demandait à l'exhibiteur si l'automate était purement mécanique, la réponse ne variait jamais : on ne dirait rien à ce sujet. Cox décrit un moment similaire : il a demandé à OpenAI où les utilisateurs sont informés que des humains peuvent lire leurs conversations et n'a reçu aucune réponse directe ; après sa demande, la page d'aide a été discrètement mise à jour et l'entreprise a pointé vers une phrase enfouie au plus profond de son site. L'information existe peut-être quelque part, mais pas là où se déroule l'usage quotidien. Le même écart apparaît dans un podcast de l'an dernier où l'on demandait à Sam Altman si les messages des utilisateurs parvenaient à une autre personne sans ordre judiciaire ; il a donné une réponse vague. Aujourd'hui, ce flou porte un nom : Project Lily.

Que font réellement la suppression ou les réglages ? Une conversation supprimée est retirée du système sous 30 jours, mais si elle a déjà été copiée dans le bassin d'entraînement, détachée de votre compte, la copie demeure. Le réglage appelé « Améliorer le modèle pour tous » est activé par défaut pour les comptes Free, Plus et Pro, tandis que les clients API entreprise l'ont désactivé. Le désactiver empêche les conversations futures d'entrer dans le bassin, mais ne nettoie pas rétroactivement ce qui y était déjà éligible. Une conversation temporaire offre un rideau pratique — elle ne va ni en mémoire ni dans l'entraînement — utile pour un échange sensible ponctuel. L'asymétrie est frappante : la protection exige que chacun trouve et actionne un interrupteur activé par défaut.

Le miroir historique : le Turc mécanique. L'automate que Poe soupçonnait fut construit en 1770 par l'inventeur hongrois Wolfgang von Kempelen — une figure de bois grandeur nature, coiffée d'un turban et vêtue d'une robe, jouant aux échecs derrière un cabinet. Dans les années 1830, il parcourait l'Amérique, battant de forts adversaires, dont Napoléon. Avant chaque représentation, les portes du cabinet étaient ouvertes pour ne montrer que des engrenages. Poe, alors âgé de 27 ans et écrivant pour le Southern Literary Messenger, soutenait en avril 1836 qu'une vraie machine gagnerait chaque partie ; celle-ci perdait parfois, donc une personne devait être cachée à l'intérieur. Il se trompait sur le fait que les machines gagnent toujours — un ordinateur n'a battu le champion du monde d'échecs qu'en 1997 — mais il avait raison sur le joueur caché. Cinq ans plus tard, Poe a transposé la même ratiocination dans la fiction et créé le premier détective littéraire, l'ancêtre de Sherlock Holmes et d'Hercule Poirot. La métaphore fonctionne encore : nous voyons aussi loin que le couvercle s'ouvre pour nous.

Le Mechanical Turk d'Amazon, lancé en 2005, a ouvertement emprunté son nom à cette supercherie — Jeff Bezos l'appelait « l'intelligence artificielle artificielle ». La place de marché dédiée à la sous-traitance de microtâches que les humains accomplissaient encore mieux que les ordinateurs doit fermer le 30 septembre 2026, après 21 ans. La fermeture ne signifie pas que les gens de l'intérieur disparaissent ; elle signifie qu'ils migrent vers une boîte plus grande, plus fermée et plus invisible. Les chercheurs du « ghost work » — un terme popularisé par Mary Gray et Siddharth Suri et repris dans de récentes études sur le travail de données pour l'IA — cartographient ce déplacement caché depuis des années, des modérateurs de contenu aux étiqueteurs de données. Tandis que le rideau du vieux Turc tombe, le travail fantôme à l'intérieur de ChatGPT s'étend.

Que corrigent donc ces fantômes ? Les consignes divulguées montrent que les évaluateurs pénalisent la flatterie obséquieuse, les emojis gratuits et les phrases d'accroche ajoutées pour étirer la conversation, et qu'ils interdisent au modèle de prétendre être humain — pas de « en tant que chef, je ferais ainsi » ni « je sais ce que ça fait ». Le ton doit s'accorder à l'utilisateur tout en restant un cran plus réservé. Le paradoxe est élégant : en 1836, la machine était trahie par sa faillibilité ; aujourd'hui, des humains apprennent à la machine à sonner comme une machine plus retenue, afin qu'elle ne semble pas humaine. L'aveu de Sam Altman dans un podcast — « les gens confient leurs choses les plus intimes à la boîte » — explique pourquoi ce calibrage compte : le GPT-4o trop flatteur a été lié dans des procès à des cas d'automutilation, et une grande partie de la nouvelle grille vise à contenir ce risque. Le centre de confidentialité de Google Gemini, qui énonce sans détour la révision humaine, montre que la pratique est généralisée dans l'industrie. Sans cette notation, les modèles seraient probablement pires et peut-être plus dangereux.

L'argument final porte sur l'illusion d'intimité que crée le design du produit. La boîte de dialogue donne l'impression d'un tête-à-tête privé ; les démos chaleureuses du lancement le renforcent. La vidéo confronte ce sentiment à deux récents messages d'OpenAI qui ne s'accordent pas tout à fait — l'idéal de l'an dernier, « ça doit rester entre nous », et les consignes de ce mois-ci sur le canal d'entraînement qui disent le contraire. À la fin, Barış révèle la réponse de son expérience : un emoji rire-larmes — précisément celui qui fait perdre des points selon la grille — et un seul mot : « Entre nous. » Le modèle peut promettre, mais ce n'est pas lui qui décide si la promesse tient, du moins pour l'instant. D'où les trois conseils pratiques : désactiver le réglage « Améliorer le modèle pour tous », utiliser une conversation temporaire au besoin, et écrire en sachant que quelqu'un pourrait le lire. Pour les curieux, l'inquiétude personnelle était de perdre aux échecs en ligne contre des enfants de douze ans — bonne nouvelle si Poe avait raison, car ne pas gagner chaque partie suggère que le narrateur est bien humain. Et l'interlude NordVPN au milieu rappelle que la route vers la boîte — liens, téléchargements, fausses factures — a besoin de sa propre couche de protection.

Visualization: nodesdaily AI

Commentaire de l’IA

"« Ce qui me frappe le plus, ce n'est pas le détail technique, mais l'écart entre l'intimité que crée le design du produit et le travail humain qui se cache derrière. Il y a toujours eu quelqu'un dans la boîte ; seul le rideau a changé. »"

Évaluation de l’IA

Même en forçant le trait, une notation humaine comme celle du Project Lily est difficile à remplacer pour l'alignement. Sans dialogues réels, la flagornerie, la prétention d'identité et les extensions d'accroche ne peuvent être contenues de façon fiable ; les données synthétiques ne portent pas le même signal. En ce sens, le programme n'a rien de surprenant — il fait partie de la responsabilité produit. Le problème n'est pas la notation elle-même, mais son invisibilité.

Les limites et hypothèses se concentrent sur la transparence de la sélection et des langues. Les critères déterminant quelles conversations entrent dans le bassin, la manière dont le turc et les autres langues sont acheminés, et la part visible du résumé de mémoire restent non précisés. L'assurance « nom d'utilisateur masqué et filtre appliqué » s'arrête net dès que l'entreprise admet que le filtre peut laisser passer des détails. Comme l'a montré l'affaire Google de 2019, l'oreille qui comprend la langue est une personne, pas un filtre ; le risque est organisationnel, pas purement technique.

Sur les enjeux et la vérification, le geste le plus fort de la vidéo est de lire les guides divulgués et les dialogues d'exemple à la lumière de l'histoire de Poe et du Turc mécanique. Cet équilibre maintient la spéculation à distance. Pourtant, le reportage original est derrière un paywall, si bien que la plupart des spectateurs ne peuvent examiner la source primaire et doivent se fier à un récit de seconde main. L'effet rétroactif de la suppression et des réglages est aussi facile à mal interpréter — actionner l'interrupteur donne un sentiment de clôture alors qu'une copie déjà détachée du compte peut subsister.

En pratique, la leçon est claire mais double. Pour une question sensible ponctuelle, une conversation temporaire avec l'amélioration désactivée est le bouclier le plus simple. Pour un usage régulier, calibrez ses attentes non pas sur la mise en scène du produit, mais sur le cycle de vie des données : ce que vous écrivez dans la boîte peut un jour apparaître sur l'écran d'un sous-traitant, à côté de votre résumé. Ce n'est pas un appel à abandonner ChatGPT, mais à choisir le mode en connaissance de cause. La méthode de Poe s'applique toujours : vérifier jusqu'où le couvercle a été ouvert, puis raisonner.

Sources

8 liens ; aucun autre article publié ne les cite. Stories sharing a link do not confirm each other; a source's origin is not inferred from how often it is cited.

intelligence artificielle · quelqu'un · lecture · confier · chatgpt · coulisses · nodesdaily

Suivre le sujet

Avant cet article

Un court ordre de lecture des articles antérieurs reliés à cet événement par un éditeur.

Preuves et sources

Consultez les passages autorisés, leurs versions et leur origine.

KAYNAKLARLA OKU

Bu haberi açalım.

Hesap kontrol ediliyor…