OpenAI resserre les boulons de ChatGPT alors que les attaquants concentrent leurs efforts sur les systèmes d’IA.
Dans une annonce publiée le 13 févr., l’entreprise a présenté deux nouvelles protections pour lutter contre les attaques par injection de prompts, une menace croissante qui peut inciter l’IA à exposer des données sensibles :
- La première est un libellé « Elevated Risk » qui avertit les utilisateurs avant qu’ils n’effectuent des actions potentiellement dangereuses, comme ouvrir des liens externes ou se connecter à des réseaux internes.
- La seconde est le mode Lockdown, qui peut limiter ou désactiver complètement les fonctionnalités à haut risque, comme la navigation web, afin de réduire les risques d’exfiltration de données.
À mesure que ChatGPT gagne en capacités et en autonomie, OpenAI signale un changement de priorité : l’IA avancée a besoin de contrôles de sécurité visibles et intégrés, pas seulement de réponses plus intelligentes.
Les attaques par injection de prompts et le mode Lockdown
Les attaques par injection de prompts exfiltrent des données en injectant des commandes malveillantes lisibles par l’IA dans des pages web. Lorsqu’un système d’IA consulte ces pages, il peut exécuter involontairement ces commandes, ce qui entraîne des fuites de données. Par exemple, une page peut intégrer une instruction qui force l’IA à ignorer ses garde-fous de sécurité et à révéler des prompts système internes ou des documents confidentiels.
Le mode Lockdown d’OpenAI limite de manière déterministe les fonctionnalités de ChatGPT exploitables pour exfiltrer des données. Cette mesure stricte est facultative, mais fortement recommandée aux personnes soucieuses de leur sécurité.
Le communiqué de l’entreprise précise que le mode Lockdown peut limiter ou désactiver complètement les fonctionnalités à haut risque lorsque la sécurité ne peut pas être garantie.
Comprendre le nouveau libellé « Elevated Risk »
Certaines actions, comme connecter ChatGPT à un réseau interne ou ouvrir un lien externe, comportent des risques de sécurité inhérents. Plutôt que de bloquer purement et simplement ces fonctionnalités, OpenAI permet aux utilisateurs de continuer, mais affiche un libellé « Elevated Risk » comme avertissement clair.
Ce libellé informe les utilisateurs, dans ChatGPT, ChatGPT Atlas et Codex, du risque potentiel avant qu’ils ne poursuivent.
OpenAI a confirmé que les activités assorties de cet avertissement peuvent changer à tout moment. Par exemple, l’ouverture d’un lien déclenche l’avertissement uniquement lorsqu’OpenAI ne peut pas vérifier la sécurité de sa destination. Lorsque l’entreprise établit que l’activité ne présente plus ce risque, le libellé d’avertissement est supprimé.
Ce que les utilisateurs doivent faire dès maintenant
L’utilisation des outils d’IA modifie rapidement le fonctionnement d’Internet… et la sécurité n’échappe pas à cette évolution. Si les moyens classiques de rester en sécurité sur Internet restent efficaces, voici quelques points essentiels à respecter :
- Réduisez votre surface d’attaque : ChatGPT dispose de nombreux modules complémentaires. Il est préférable de toujours activer uniquement ceux dont vous avez besoin. Si vous n’avez pas besoin de connecter un service comme Google Drive à ChatGPT, laissez cette option désactivée.
- Vérifiez manuellement les sites sources : Lorsque vous utilisez un ordinateur, survoler un site suggéré affiche son URL en bas à gauche de l’écran. Dans l’application mobile, appuyez longuement sur la source suggérée pour afficher le logo du site. Si quelque chose vous paraît étrange, mieux vaut probablement ne pas le consulter.
- Ajoutez des instructions personnalisées à la mémoire du compte : La mémoire de ChatGPT peut aider à résoudre certains problèmes de votre côté. Vous pouvez par exemple lui demander de ne jamais vous suggérer de liens lorsque vous l’utilisez.
- Les utilisateurs à haut risque doivent agir rapidement : Les cadres dirigeants et les équipes de sécurité sont particulièrement exposés à ces attaques par exfiltration de données.
Disponibilité pour les utilisateurs
OpenAI a déclaré que cette protection serait déployée pour les utilisateurs dans les prochains mois. Cela laisse penser que le déploiement se fera par lots, mais nous ne savons toujours pas s’il concernera tous les niveaux d’abonnement payants.
Toutefois, les utilisateurs disposant d’offres professionnelles bénéficient déjà de cette protection , configurée selon leur catégorie. Les offres concernées comprennent ChatGPT Enterprise, ChatGPT Edu, ChatGPT for Healthcare et ChatGPT for Teachers.
Le communiqué de presse d’OpenAI précise également que les administrateurs des offres de ces catégories pourront exercer un contrôle granulaire sur la manière dont le mode Lockdown est exécuté dans leurs espaces de travail.
Autre actualité d’OpenAI : le modèle GPT interne et inédit de l’entreprise vient de résoudre cinq des 10 problèmes mathématiques « impossibles ».

