Dans son blog consacré au CES 2024, NVIDIA a présenté ses annonces comme « Un tremplin pour l’IA générative » — à juste titre, puisque 2023 a incontestablement été l’année où l’IA générative s’est imposée auprès du grand public.
Je voulais voir ce que NVIDIA nous réservait. On peut difficilement citer une entreprise plus importante que le géant des puces pour faire progresser l’IA. Tout comme Intel a joué un rôle essentiel à l’ère du PC, NVIDIA jouera un rôle similaire pour l’IA.
Au CES 2024, NVIDIA a annoncé plusieurs nouveautés couvrant l’informatique grand public et le jeu vidéo, l’industrie automobile et la robotique. Même si elles ciblent les particuliers, les professionnels de l’informatique doivent en tenir compte, car les marchés grand public annoncent généralement les évolutions à venir dans les technologies d’entreprise.
NVIDIA : l’informatique accélérée par l’IA pour les joueurs et les créateurs de contenu
L’annonce phare était l’essor des ordinateurs portables dotés d’intelligence artificielle : NVIDIA y a dévoilé les nouveaux GPU GeForce RTX 40 SUPER Series, des ordinateurs portables prêts pour l’IA et des outils d’IA générative — tous destinés aux joueurs et aux créateurs.
Avec un parc installé de 100 millions de GPU et 500 jeux et applications RTX, GeForce RTX est la plus grande plateforme au monde pour les joueurs, les créateurs et l’IA générative. Ces GPU sont au cœur de l’IA générative, notamment des services populaires comme ChatGPT et Stable Diffusion.
Lors d’une présentation organisée avant le CES, Justin Walker, Senior Director of Product Management chez NVIDIA, a déclaré que RTX était la plateforme pour ordinateurs portables de NVIDIA affichant la plus forte croissance. « Elle a été multipliée par 5 au cours des quatre dernières années, et il existe désormais plus de 50 millions d’ordinateurs portables RDX dans le monde », m’a-t-il expliqué. « Au CES, nous annonçons une nouvelle vague d’ordinateurs portables RTX, lancés par tous les grands OEM. »
Acer, ASUStek, Dell, HP, Lenovo et Samsung en font notamment partie. Les ordinateurs portables RTX vont des modèles compacts de 14 pouces aux modèles plus imposants de 18 pouces. « Ils sont tous équipés de Tensor Cores, a-t-il ajouté. Ils seront tous prêts pour l’IA. »
L’entreprise a également annoncé trois nouveaux GPU pour ordinateurs de bureau, tous fondés sur l’architecture Ada Lovelace. Ces GPU amélioreront les performances des joueurs grâce à un plus grand nombre de cœurs et à une mémoire plus rapide. « C’est un GPU fantastique pour jouer en 4K avec le ray tracing intégral, dans la plus haute résolution et avec la meilleure qualité d’image, a-t-il déclaré. Il offre une puissance de calcul IA considérable pour une IA générative ultrarapide. »
Ce sont les PC et ordinateurs portables dotés des plus grandes capacités d’IA disponibles. « Vous disposez d’une puissance de traitement pouvant atteindre 1 300 TOPS, a-t-il ajouté. Depuis dix ans, nous développons un ensemble de technologies autour de CUDA et TensorRT afin d’aider les développeurs à tirer le meilleur parti de ces processeurs dédiés à l’IA. »
Même s’il s’agit de cas d’usage grand public, la possibilité d’exécuter des grands modèles de langage sur un PC local améliorera l’expérience des visioconférences, des applications du métavers et de réalité augmentée ou virtuelle, ainsi que de nombreux workloads propres à certains secteurs.
Accélérer les grands modèles de langage
Jeff Fisher, Senior VP for GeForce chez NVIDIA, a déclaré que la bibliothèque TensorRT-LLM pour Windows, lancée en octobre 2023, accélérait les grands modèles de langage tels que Llama 2 et Mistral jusqu’à cinq fois sur les PC RTX.
L’entreprise passe à la vitesse supérieure avec son nouveau service « Chat with RTX », qui permet d’accéder à un LLM accéléré par RTX en utilisant les propres données de l’entreprise — des documents stockés localement aux vidéos YouTube. Chat with RTX utilise la génération augmentée par récupération (RAG), qui améliore la précision et la fiabilité des modèles d’IA générative.
NVIDIA a introduit l’accélération TensorRT pour Stable Diffusion XL et SDXL Turbo avec l’application de conversion texte-image Automatic1111. Selon NVIDIA, TensorRT améliore les performances jusqu’à 60 %.
Diffusion en direct sur Twitch et simulation robotique
Nvidia a indiqué qu’elle collaborerait avec Twitch pour lancer la diffusion en direct multiencodage, permettant aux streamers d’envoyer jusqu’à trois flux simultanés vers Twitch, dans différentes résolutions et qualités, afin que chaque spectateur bénéficie d’une expérience optimale.
Plus de 500 jeux et applications Activision/Blizzard utilisent la technologie RTX, notamment les titres primés Alan Wake 2, Horizon Forbidden West, Pax Dei et Diablo IV. Le partenariat avec Activision s’étend au cloud avec GEForce NOW.
NVIDIA Isaac, l’application de simulation robotique de l’entreprise, accélère l’arrivée des robots dans le monde réel. L’utilisation de robots collaboratifs (cobots) sur le lieu de travail progresse dans des secteurs comme l’industrie manufacturière et l’entreposage, et s’étendra bientôt à la santé et à d’autres industries. La possibilité de commencer par un entraînement dans un environnement simulé peut faire économiser des milliers d’heures, car les simulations peuvent couvrir un ensemble complet de scénarios, y compris ceux qu’il est difficile de reproduire dans le monde réel.
Mes principaux enseignements
Comme on pouvait s’y attendre de la part de NVIDIA, cet ensemble d’annonces était exhaustif. Alors que d’autres fabricants de puces grignotent la domination de NVIDIA dans l’IA, toute entreprise souhaitant lui faire concurrence devra voir plus loin que le seul GPU.
La force de NVIDIA réside dans la conception de systèmes qui associent le GPU, les logiciels et d’autres composants matériels issus d’un vaste écosystème. Pour ma part, le point fort des annonces de NVIDIA était les ordinateurs portables dédiés à l’IA, car ils apportent des capacités d’IA générative sur le poste de travail, en complément de ce qui s’est déjà produit dans le cloud.

