Des centaines de sous-traitants lisent vos conversations ChatGPT

Des centaines de sous-traitants lisent vos conversations ChatGPT

OpenAI fait appel à des équipes de sous-traitants pour lire et noter de vraies conversations ChatGPT, y compris des échanges à teneur personnelle. L'entreprise reconnaît que des informations sensibles peuvent passer malgré ses filtres.

OpenAI engage des centaines de sous-traitants chargés de lire un flux massif de conversations réelles entre les utilisateurs et ChatGPT. L'enquête de 404 Media fondée sur des documents internes fuités et des prompts réels décrit ces équipes de révision qui notent et critiquent les réponses du modèle, notamment pour corriger sa complaisance excessive. OpenAI affirme retirer les informations personnelles avant que les prompts atteignent les relecteurs, et précise que les noms d'utilisateurs ne leur sont pas transmis. Mais l'entreprise reconnaît elle-même que des éléments sensibles peuvent malgré tout franchir ces filtres.

Anthropic a confirmé à 404 Media recourir au même type de revue humaine pour améliorer ses modèles.

Des conversations intimes dans un pipeline peu visible

Le profil des usages aggrave l'exposition. ChatGPT est fréquemment utilisé comme substitut à un thérapeute, un assistant professionnel ou un confident numérique : des échanges portant sur la santé mentale, des difficultés professionnelles ou des relations personnelles alimentent directement ce processus de révision. Or, selon un contractant travaillant avec ces prompts, les utilisateurs n'imaginent pas qu'un humain puisse lire leurs échanges. La formulation exacte, en anglais dans l'article : "I don't think they would imagine some contractor somewhere [...] is analyzing the conversations." [traduit de l'anglais]

L'enquête corrige aussi une représentation courante du fonctionnement de ces systèmes. Le progrès des modèles ne résulte pas uniquement de l'ingénierie, des équipes bien rémunérées ou du scraping massif d'internet : il repose aussi sur un travail humain externalisé, peu qualifié, qui traite des données issues d'usages que la plupart des quelque 900 millions d'utilisateurs de ChatGPT ne soupçonnent pas d'être relus.

Un consentement qui ne couvre pas tout

La question n'est pas technique : elle porte sur ce que le consentement accordé lors de l'inscription couvre réellement. L'écart entre la formulation générale des engagements d'OpenAI et la réalité d'un relecteur humain lisant une conversation entière est substantiel. L'entreprise reconnaît que des détails sensibles peuvent passer, sans préciser les garanties effectives ni leur périmètre exact.

Réduire l'exposition sans attendre la régulation

En attendant que des obligations de transparence s'imposent aux opérateurs, les utilisateurs peuvent ajuster leurs pratiques : séparer les usages selon leur sensibilité, éviter de transmettre des informations personnelles identifiables dans les échanges à teneur confidentielle, et vérifier dans les paramètres si l'utilisation des conversations à des fins d'entraînement peut être désactivée. Ces gestes réduisent la surface d'exposition sans l'éliminer.

Et si les régulateurs européens exigeaient un consentement distinct des conditions générales, spécifique à la transmission de conversations réelles à des relecteurs humains ? Un tel mécanisme déplacerait la charge de la preuve : au lieu que l'utilisateur découvre après coup les pratiques de révision, l'opérateur devrait obtenir un accord explicite avant que la conversation entre dans le pipeline. Pour les organisations qui utilisent ChatGPT sur des données professionnelles sensibles, cette question mérite d'être posée dès maintenant, sans attendre qu'une obligation réglementaire la rende incontournable.