Dans les coulisses de la nouvelle expérience d’OpenAI : mesurer l’IA aux emplois réels face aux humains

Employees working inside an office.

Image: Generated by Google’s Nano Banana

Jan 12, 2026
4 minute read
eWeek content and product recommendations are editorially independent. We may make money when you click on links to our partners. Learn More

OpenAI emprunte une voie inhabituellement directe pour déterminer dans quelle mesure son IA peut gérer de vrais emplois.

Le géant de l’IA demande à des prestataires tiers de téléverser des travaux réels réalisés dans le cadre d’emplois précédents ou actuels, dans le cadre d’un nouvel effort visant à tester les performances de ses systèmes d’IA sur des tâches concrètes. Les détails ont été rapportés pour la première fois par WIRED, qui a examiné des documents et des présentations internes liés au projet.

Selon l’article, l’initiative est menée en partenariat avec la société de données d’entraînement Handshake AI. Les prestataires doivent décrire les tâches qu’ils ont prises en charge au travail et téléverser les fichiers qu’ils ont effectivement produits, comme des documents, des feuilles de calcul, des présentations, des images ou des dépôts de code.

L’objectif est de créer une « référence humaine » claire qu’OpenAI pourra comparer directement aux résultats de ses derniers modèles d’IA.

Le projet s’inscrit dans la volonté plus large d’OpenAI de mesurer les performances de l’IA face à des travailleurs humains qualifiés dans différents secteurs. En septembre, l’entreprise a lancé un nouveau processus d’évaluation conçu pour comparer les systèmes d’IA à des professionnels effectuant un travail à valeur économique — une initiative qu’OpenAI considère comme centrale dans son objectif à long terme de créer une intelligence artificielle générale (AGI).

Un document confidentiel d’OpenAI examiné par WIRED explique la logique qui sous-tend le projet.

« Nous avons recruté des personnes dans différents métiers pour nous aider à recueillir des tâches du monde réel inspirées de celles que vous avez réalisées dans le cadre de vos emplois à temps plein, afin de mesurer les performances des modèles d’IA sur ces tâches », indique le document, cité par WIRED.

Les prestataires sont encouragés à transformer des missions longues ou complexes déjà réalisées en tâches structurées que les systèmes d’IA pourront tenter de reproduire.

Ce qu’OpenAI demande

Une présentation d’OpenAI consultée par WIRED indique que les prestataires doivent téléverser les fichiers de travail eux-mêmes, et non des résumés. Parmi les exemples cités figurent des documents Word, des PDF, des diapositives PowerPoint, des fichiers Excel, des images et des dépôts logiciels.

Chaque soumission comporte deux parties :

  • La demande de tâche, par exemple les instructions d’un responsable ou d’un collègue
  • Le livrable, c’est-à-dire le travail effectivement produit en réponse
Advertisement

L’entreprise insiste à plusieurs reprises sur le fait qu’il doit s’agir de tâches que le prestataire a « réellement effectuées » dans le cadre de son emploi. OpenAI autorise également les exemples fictifs, mais uniquement s’ils reflètent de manière réaliste la façon dont une personne répondrait dans une situation professionnelle réelle.

L’outil de nettoyage « Superstar »

OpenAI ne demande pas de secrets industriels — du moins pas intentionnellement. L’entreprise souligne à plusieurs reprises que les prestataires doivent supprimer toute information confidentielle ou permettant d’identifier une personne (PII) avant de cliquer sur le bouton de téléversement.

Pour les aider dans ce « nettoyage des données », OpenAI a même orienté les travailleurs vers un outil spécifique de ChatGPT. Selon Wired, un document mentionne un outil appelé « Superstar Scrubbing » qui fournit des indications pour supprimer les données sensibles avant la transmission des fichiers.

Il est rappelé aux prestataires de « supprimer ou anonymiser toute : information personnelle, donnée exclusive ou confidentielle, information importante non publique (par exemple, stratégie interne, détails d’un produit non commercialisé). »

Un champ de mines juridique ?

Malgré ces outils de nettoyage, les experts juridiques tirent la sonnette d’alarme. Cette stratégie repose presque entièrement sur la capacité du prestataire à déterminer ce qui constitue ou non un secret d’entreprise.

Evan Brown, avocat spécialisé en propriété intellectuelle chez Neal & McDevitt, a déclaré à Wired que cette approche représentait un pari gigantesque pour le géant de l’IA.

« Le laboratoire d’IA fait énormément confiance à ses prestataires pour décider de ce qui est ou non confidentiel, a déclaré Brown. S’ils laissent passer quelque chose, les laboratoires d’IA prennent-ils vraiment le temps de déterminer s’il s’agit ou non d’un secret industriel ? J’ai l’impression que le laboratoire d’IA se met en grand danger. »

Au-delà des risques pour OpenAI, les prestataires eux-mêmes pourraient avoir de sérieux ennuis. Même si un document est « nettoyé », sa divulgation pourrait tout de même violer les accords de non-divulgation (NDA) signés avec d’anciens employeurs, qui sont les véritables propriétaires de la propriété intellectuelle.

Advertisement

Une industrie florissante autour des données d’IA de haute qualité

Les documents examinés par Wired mettent en évidence une tendance plus large dans l’ensemble du secteur de l’IA. Des entreprises comme OpenAI, Anthropic et Google s’appuient de plus en plus sur de vastes réseaux de prestataires qualifiés pour produire des données d’entraînement de haute qualité, qui vont au-delà de ce qui est disponible publiquement en ligne.

À mesure que les modèles d’IA cherchent à automatiser des tâches de bureau et d’entreprise toujours plus complexes, la demande pour des données réalistes de niveau professionnel a augmenté. Cette évolution a contribué à la création d’un marché de l’entraînement des données en forte croissance, où des entreprises comme Handshake AI et Surge se positionnent comme des acteurs clés.

OpenAI a également étudié d’autres moyens de se procurer des données d’entreprise réelles, notamment en acquérant des informations auprès de sociétés ayant cessé leurs activités — une idée finalement abandonnée en raison des difficultés à supprimer complètement les informations personnelles, selon Wired.

Ne manquez pas non plus notre article sur la façon dont le GPT-5.2 d’OpenAI vient de résoudre un problème de mathématiques vieux de 30 ans, ouvrant une nouvelle ère pour le raisonnement de l’IA, qui va au-delà de la simple reconnaissance de motifs.

Aminu Abdullahi

Aminu Abdullahi is a B2C and B2B technology and finance writer with more than six years of experience covering enterprise IT, cybersecurity, cloud computing, artificial intelligence, fintech, business software, and emerging technologies. His work has appeared in publications including TechRepublic, eWEEK, Channel Insider, Geekflare, Enterprise Networking Planet, eSecurity Planet, CIO Insight, and Webopedia. With a technical background in computer science, he specializes in translating complex technology topics into clear, accessible content for business leaders and decision-makers.

eWeek Logo

eWeek has the latest technology news and analysis, buying guides, and product reviews for IT professionals and technology buyers. The site's focus is on innovative solutions and covering in-depth technical content. eWeek stays on the cutting edge of technology news and IT trends through interviews and expert analysis. Gain insight from top innovators and thought leaders in the fields of IT, business, enterprise software, startups, and more.

Property of TechnologyAdvice. © 2026 TechnologyAdvice. All Rights Reserved

Advertiser Disclosure: Some of the products that appear on this site are from companies from which TechnologyAdvice receives compensation. This compensation may impact how and where products appear on this site including, for example, the order in which they appear. TechnologyAdvice does not include all companies or all types of products available in the marketplace.