La start-up chinoise Z.ai a annoncé lundi que son nouveau modèle d’IA open source GLM-4.5 serait moins coûteux à utiliser que DeepSeek. De plus, GLM-4.5 serait environ deux fois plus petit que DeepSeek et pourrait être téléchargé et utilisé gratuitement par les développeurs.
L’entreprise, auparavant connue sous le nom de Zhipu, a déclaré que le nouveau GLM-4.5 était son premier modèle de fondation conçu autour de l’IA agentique, une technologie conçue pour décomposer de manière autonome les tâches complexes en sous-tâches plus faciles à gérer afin d’améliorer la précision de leur exécution.
Le PDG de Z.ai, Zhang Peng, a déclaré dans le communiqué de presse: « Avec GLM-4.5, nous établissons une nouvelle référence, en démontrant que des performances de pointe peuvent être ouvertes, efficaces et abordables. L’approche fondée sur les premiers principes pour mesurer l’AGI consiste à intégrer des capacités intelligentes plus générales sans perdre celles qui existent déjà. GLM-4.5 est notre première réalisation complète de ce concept. »
GLM-4.5 s’impose déjà dans le paysage de l’IA en Chine
GLM-4.5 marque l’entrée de Z.ai dans le développement open source avec une architecture de modèle Mixture of Experts (MoE). Il est proposé dans deux configurations : le modèle phare GLM-4.5, doté de 355 milliards de paramètres, et le modèle plus compact GLM-4.5-Air, doté de 106 milliards de paramètres. Lors d’évaluations internes menées sur 12 benchmarks représentatifs, le modèle se serait classé troisième au niveau mondial et en tête parmi ses concurrents chinois et open source.
Z.ai a souligné l’efficacité opérationnelle du modèle, affirmant qu’il ne nécessitait que huit puces NVIDIA H20 — c’est-à-dire un matériel spécifiquement conçu pour la Chine dans le cadre des restrictions américaines à l’exportation — selon l’entretien de Zhang avec CNBC.
Plus tôt ce mois-ci, NVIDIA a confirmé qu’elle reprendrait ses livraisons de puces à la Chine après une suspension de trois mois, sous réserve de l’obtention des licences nécessaires. Zhang a déclaré à CNBC que Z.ai n’avait pas besoin d’acheter davantage de puces, car elle disposait déjà d’une puissance de calcul suffisante.
Les coûts et les tarifs d’entraînement de DeepSeek
DeepSeek a fortement marqué le secteur de l’IA en janvier grâce à sa capacité à créer un modèle abordable rivalisant avec ChatGPT d’OpenAI, malgré les limites imposées par les restrictions américaines sur les puces. L’entreprise a affirmé que l’entraînement de son modèle V3 lui avait coûté moins de 6 millions de dollars, même si certains analystes du secteur estiment que ce chiffre reposait sur les dépenses matérielles de l’entreprise, qui auraient dépassé 500 millions de dollars au fil du temps.
Zhang a refusé de fournir des informations sur le montant consacré à l’entraînement des modèles d’IA et a déclaré que davantage de détails sur le nouveau modèle GLM-4.5 seraient communiqués ultérieurement.
Z.ai prévoit de facturer 0,11 dollar par million de jetons d’entrée et 0,28 dollar par million de jetons de sortie pour l’utilisation de GLM-4.5, soit moins que les tarifs respectifs de DeepSeek, de 0,14 dollar et 2,19 dollars.
Le développement de l’IA en Chine s’intensifie, suscitant une mise en garde d’OpenAI
Fondée en 2019, Z.ai s’est concentrée sur l’avancement des technologies d’IA et a levé plus de 1,5 milliard de dollars auprès d’investisseurs. En conséquence, l’entreprise a été ajoutée à l’Entity List des États-Unis, qui interdit aux entreprises américaines de faire affaire avec les entités qui y figurent sans autorisation spéciale du gouvernement. En juin, OpenAI a mis en garde contre le rythme du développement de l’IA chinoise, citant Z.ai — qui opérait alors sous le nom de Zhipu — parmi les entreprises à surveiller.
Le nouveau modèle de Z.ai n’est que l’un des nombreux modèles d’IA open source produits par des développeurs chinois.
- Plus tôt ce mois-ci, Moonshot, une entreprise soutenue par Alibaba, a présenté son modèle Kimi K2, affirmant qu’il était plus performant que ChatGPT dans certains benchmarks de programmation.
- Tencent a présenté son modèle HunyuanWorld-1.0 lors de la World AI Conference à Shanghai. Ce modèle est conçu pour générer des scènes 3D destinées aux environnements de jeu vidéo.
- La semaine dernière, Alibaba a annoncé son nouveau modèle Qwen3-Coder, destiné à effectuer des tâches de programmation.

