Des prestataires chargés d’améliorer les modèles d’OpenAI ont été écartés pour avoir utilisé eux-mêmes de l’IA, rapporte 404 Media le 22 septembre 2026. Une situation ironique qui s’explique par leur mission : apporter un jugement humain.

Dans de nombreux métiers, l’IA promet de faire gagner du temps. Mais l’utiliser peut aussi vous coûter votre mission. Selon une enquête de 404 Media publiée le 22 septembre 2026, plusieurs prestataires participant à l’amélioration des modèles d’OpenAI ont été écartés pour avoir… utilisé de l’IA dans leur travail.

Le média s’appuie sur des documents internes et les témoignages de trois prestataires travaillant sur différents projets d’OpenAI, dont deux évoquent des exclusions liées à cet usage. Il ne s’agit pas de salariés licenciés directement par OpenAI.

Mercor, l’un des sous-traitants concernés, confirme que ses contrats interdisent l’utilisation de modèles de langage pour accomplir ces missions et affirme retirer des projets les personnes dont l’infraction est établie. OpenAI a refusé de commenter.

Le logo d'OpenAI.  // Source : Numerama / OpenAI
Le logo d’OpenAI. // Source : Numerama / OpenAI

Leur travail : juger les réponses de ChatGPT

Pour améliorer ChatGPT, certains prestataires examinent les conversations de ses utilisateurs. C’est notamment le cas dans le projet Lily, décrit dans une précédente enquête de 404 Media : des centaines de personnes lisent ces échanges, qui peuvent contenir des informations personnelles, et jugent les réponses du chatbot. Elles doivent notamment vérifier qu’il ne cherche pas trop à donner raison à l’utilisateur ou ne se présente pas comme un être humain. 404 Media ne précise pas si les personnes écartées pour avoir utilisé de l’IA travaillaient sur ce projet.

Pour comprendre l’intérêt de ces tâches, il faut distinguer la capacité d’un modèle à générer du texte de celle à fournir une réponse utile et adaptée à la demande. Une réponse peut être parfaitement rédigée, mais ne pas respecter la consigne ou affirmer quelque chose de faux avec beaucoup d’assurance.

Les retours humains permettent notamment d’orienter ces comportements. En janvier 2022, lors de la présentation d’InstructGPT, OpenAI expliquait demander à des personnes de rédiger des exemples de bonnes réponses et de classer différentes propositions du modèle.

Ces comparaisons servaient ensuite à ajuster celui-ci grâce à l’apprentissage par renforcement à partir de retours humains, ou RLHF. L’enquête de 404 Media ne précise toutefois pas comment les évaluations sont utilisées dans chacun des projets concernés.

Concrètement, un évaluateur peut devoir comparer deux réponses à une même question et indiquer laquelle est la meilleure. S’il confie ce choix à un chatbot, l’entreprise recueille le jugement d’une autre IA, alors qu’elle attend celui d’un humain. Le problème dépasse donc le simple raccourci pour travailler plus vite : l’évaluation fournie n’est pas celle qui était demandée.

Sam Altman, cofondateur et PDG d'OpenAI. // Source : TechCrunch
Sam Altman, cofondateur et PDG d’OpenAI. // Source : TechCrunch

Repérer l’IA… sans utiliser de détecteur d’IA

Reste à repérer ces usages. Selon les consignes rapportées par 404 Media, les personnes chargées de contrôler le travail des prestataires ne doivent pas utiliser de détecteurs d’IA, jugés peu fiables. Un document interne exclut notamment GPTZero. Il interdit aussi aux contrôleurs de recourir eux-mêmes à l’IA pour rédiger leurs commentaires, y compris à des outils de traduction par IA.

À la place, ils doivent rechercher plusieurs indices : des formulations répétitives, certaines habitudes de ponctuation ou des tâches terminées très rapidement. Le document leur demande également de ne pas expliquer aux prestataires ce qui a éveillé leurs soupçons, afin d’éviter qu’ils apprennent à contourner les contrôles. Il précise toutefois qu’il faut examiner un ensemble de signes plutôt qu’un indice isolé.

Car dans les faits, aucun de ces éléments ne constitue, à lui seul, une preuve. Un texte répétitif peut parfaitement avoir été écrit par un humain, tout comme une tâche peut avoir été accomplie rapidement sans assistance. Reste que l’ironie demeure : même dans l’industrie de l’IA, déléguer son travail à un chatbot peut vous coûter votre mission.

Découvrez les bonus

+ rapide, + pratique, + exclusif

Zéro publicité, fonctions avancées de lecture, articles résumés par l'I.A, contenus exclusifs et plus encore.

Découvrez les nombreux avantages de Numerama+.

S'abonner à Numerama+

Vous avez lu 0 articles sur Numerama ce mois-ci

Il y a une bonne raison de ne pas s'abonner à

Tout le monde n'a pas les moyens de payer pour l'information.
C'est pourquoi nous maintenons notre journalisme ouvert à tous.

Mais si vous le pouvez,
voici trois bonnes raisons de soutenir notre travail :

  • 1 Numerama+ contribue à offrir une expérience gratuite à tous les lecteurs de Numerama.
  • 2 Vous profiterez d'une lecture sans publicité, de nombreuses fonctions avancées de lecture et des contenus exclusifs.
  • 3 Aider Numerama dans sa mission : comprendre le présent pour anticiper l'avenir.

Si vous croyez en un web gratuit et à une information de qualité accessible au plus grand nombre, rejoignez Numerama+.

S'abonner à Numerama+
Toute l'actu tech en un clien d'oeil

Toute l'actu tech en un clin d'œil

Ajoutez Numerama à votre écran d'accueil et restez connectés au futur !


Anticipez le futur en vous inscrivant gratuitement à ToujoursPlus, la newsletter tech de référence.