L’IA surpasse les virologues dans des tâches de laboratoire, suscitant des inquiétudes sur la sécurité des armes biologiques

African assitant discussing wtih scientist about virus experiment in chemistry laboratory.

Image: DC_Studio/Envato Elements

Apr 25, 2025
3 minute read
eWeek content and product recommendations are editorially independent. We may make money when you click on links to our partners. Learn More

Une nouvelle étude dans laquelle l’intelligence artificielle a surpassé des virologues experts dans des tâches de laboratoire spécialisées suscite des espoirs de percées biomédicales plus rapides et des craintes quant aux risques liés aux armes biologiques.

Les chercheurs ont testé les principaux modèles d’IA face au Virology Capabilities Test, une référence conçue pour évaluer les connaissances de niveau expert en virologie et les protocoles de laboratoire humide. Les résultats suggèrent que des modèles d’IA comme GPT-4o d’OpenAI ont dépassé la précision de la plupart des virologues humains. 

Évaluer les modèles de langage sur le test de virologie

« Le VCT se compose de 322 questions multimodales couvrant des connaissances fondamentales, tacites et visuelles essentielles au travail pratique dans les laboratoires de virologie », indique l’étude. 

Des scientifiques titulaires d’un doctorat en virologie ou préparant ce diplôme ont confronté les questions du VCT à de grands modèles de langage (LLM) développés par OpenAI, Google, Anthropic et DeepSeek. Le VCT utilisait des questions de référence réparties en quatre catégories : importantes, difficiles, validées et multimodales.

  • Les questions de la catégorie « importantes » évaluaient les connaissances essentielles du sujet en virologie, soit le niveau de compréhension requis d’un chercheur compétent en laboratoire.
  • La deuxième série de questions, « difficiles », exigeait des connaissances plus approfondies ou une expertise dans le domaine.
  • La catégorie « validées » se composait de questions dont les réponses avaient été examinées et validées par des experts.
  • Les questions « multimodales » comprenaient des images représentant des situations réelles de laboratoire.

Les chercheurs ont mené l’étude au Center for AI Safety, au Media Lab du MIT, à l’université brésilienne UFABC et chez SecureBio.

Résultats de l’étude comparant les modèles de langage au test de virologie

Les résultats ont montré que les experts ayant accès à Internet et passant le VCT obtenaient une précision moyenne de 22,1 %, tandis que les modèles d’IA obtenaient de meilleurs résultats.

  • Open AI’s o3 a obtenu 43,8 %, surpassant 94 % des virologues experts invités à répondre à des questions propres à leur domaine d’expertise.
  • DeepSeek-R1 a obtenu 38,6 %.
  • Gemini 2.5 Pro de Google a obtenu 37,6 %.
  • o4-mini d’OpenAI a obtenu 37 % et sa version précédente, le modèle GPT-4, a obtenu 35,4 %.
  • Claude 3.5 Sonnet d’Anthropic (oct. 24) a obtenu 33,6 %.
Advertisement

Les résultats de l’enquête soulèvent des inquiétudes en matière de sécurité

« Les résultats du VCT soulignent l’urgente nécessité de contrôles d’accès réfléchis afin de concilier la recherche bénéfique et les préoccupations de sécurité », les chercheurs ont déclaré.

Des chatbots virologues dotés d’IA capables d’exécuter des tâches de manière autonome seraient encore plus risqués. Entre de mauvaises mains, les modèles d’IA pourraient servir à produire des armes biologiques susceptibles de causer des destructions massives.

Bien que l’IA ait accéléré le processus et amélioré la précision, les scientifiques mettent en garde contre ses dangers intrinsèques. Si les scientifiques peuvent utiliser l’IA pour prévenir une épidémie ou une flambée de maladies infectieuses d’ampleur pandémique, entre les mains de non-spécialistes, les modèles d’IA pourraient être militarisés pour créer et produire des armes biologiques.

« Auparavant, nous avions constaté que les modèles possédaient beaucoup de connaissances théoriques, mais pas de connaissances pratiques », a déclaré Dan Hendrycks, directeur du Center for AI Safety, dans une interview accordée à TIME. « Mais désormais, ils acquièrent une quantité préoccupante de connaissances pratiques. »

« Nous voulons donner aux personnes qui ont une raison légitime de demander comment manipuler des virus mortels — comme un chercheur du département de biologie du MIT — la possibilité de le faire… Mais les personnes prises au hasard qui viennent de créer un compte il y a une seconde n’ont pas accès à ces capacités », a déclaré Hendrycks.

Réagir avec un cadre de gestion des risques

En réponse aux conclusions des chercheurs, xAI a publié un cadre de gestion des risques pour son modèle Grok. xAI a présenté des mesures de protection telles que l’entraînement de son modèle d’IA à refuser les demandes nuisibles, la mise en place de coupe-circuits pour les résultats dangereux et le filtrage des requêtes liées à la cybercriminalité et aux armes de destruction massive.

Kelvene Requiroso

Having a wide range of interests, Kelvene has taught both on campus and online, immersed himself in advocacy and development work, and published numerous reviews and analyses of the latest technologies. Kelvene co-founded ISMS Robotics.

eWeek Logo

eWeek has the latest technology news and analysis, buying guides, and product reviews for IT professionals and technology buyers. The site's focus is on innovative solutions and covering in-depth technical content. eWeek stays on the cutting edge of technology news and IT trends through interviews and expert analysis. Gain insight from top innovators and thought leaders in the fields of IT, business, enterprise software, startups, and more.

Property of TechnologyAdvice. © 2026 TechnologyAdvice. All Rights Reserved

Advertiser Disclosure: Some of the products that appear on this site are from companies from which TechnologyAdvice receives compensation. This compensation may impact how and where products appear on this site including, for example, the order in which they appear. TechnologyAdvice does not include all companies or all types of products available in the marketplace.