OpenAI, Google et Alibaba lancent des modèles plus rapides et moins chers

The Neuron featured image on how AI platforms upscale their models with cheaper prices.

Image: The Neuron

Written By
Grant Harvey
Grant Harvey
Mar 4, 2026
4 minute read
eWeek content and product recommendations are editorially independent. We may make money when you click on links to our partners. Learn More

Au cours des dernières 24 heures, trois acteurs majeurs ont lancé de nouveaux modèles, et aucun ne cherche à être « l’IA la plus intelligente de tous les temps ». Mais tous ont besoin de vitesse…

Voici ce qui se passe :

  • Google a lancé Gemini 3.1 Flash-Lite.
  • OpenAI a répondu avec GPT-5.3 Instant.
  • Et Alibaba a discrètement lancé quatre modèles Qwen 3.5 Small qui peuvent fonctionner sur votre téléphone ou votre ordinateur portable.

Tous ces modèles sont optimisés pour la même chose : la vitesse, le coût et l’exécution sur du matériel moins puissant.

Voici ce sur quoi chaque entreprise mise

  • OpenAI a conçu GPT-5.3 Instant pour les applications en temps réel, où même un délai de deux secondes suffit à gâcher l’expérience (fiche système).
    • Pensez aux copilotes en direct dans les documents, aux assistants vocaux qui ne peuvent pas se permettre de silences gênants et aux fonctions de chat dopées à l’IA intégrées aux outils que vous utilisez déjà.
    • La sortie tient surtout du ressenti : « ton plus fluide », « moins de refus », « moins moralisateur ».
    • Lors d’une évaluation interne à forts enjeux (médecine, droit, finance), les hallucinations ont diminué de 26,8 % avec la recherche web et de 19,7 % sans elle.
    • Sur un autre jeu de données composé de conversations réelles sur ChatGPT signalées par les utilisateurs comme factuellement erronées, les hallucinations ont diminué de 22,5 % avec le web et de 9,6 % sans lui.
    • L’exemple du tir à l’arc est assez drôle : GPT-5.2 rédigeait tout un essai sur ce qu’il ne pouvait pas faire avant de répondre, tandis que 5.3 répond directement.
    • Ils ont discrètement confirmé que GPT-5.2 Instant serait retiré le 3 juin 2026.
    • La chaîne du modèle API est gpt-5.3-chat-latest
  • Google s’est attaqué à l’échelle des entreprises. Flash-Lite est conçu pour les sociétés qui effectuent des millions d’appels API par jour, pour lesquelles économiser des fractions de centime par requête compte davantage que les scores aux benchmarks.
    • La tarification des jetons commence à 0,25 dollar par million de jetons d’entrée (contre 1,75 dollar chez OpenAI).
    • Un délai avant le premier jeton 2,5 fois plus rapide (c’est-à-dire la vitesse à laquelle le modèle commence à répondre) et une vitesse de sortie supérieure de 45 % à celle de Gemini 2.5 Flash.
    • Le modèle propose des « niveaux de réflexion » réglables, afin que les développeurs puissent augmenter ou réduire le raisonnement selon la tâche.
    • Il cible les charges de travail à gros volume comme la traduction, la modération de contenu et les applications en temps réel.
    • Disponible en avant-première via l’API Gemini dans Google AI Studio et Vertex AI.
  • Alibaba a tenté le pari le plus audacieux. Qwen 3.5 Small est une famille de modèles (de 0,8 à 9 milliards de paramètres) qui peut fonctionner sur votre téléphone ou votre ordinateur portable, sans cloud requis (ce qui signifie que c’est gratuit si vous l’exécutez sur votre propre machine).
    • Le modèle 9B utilise même une technique appelée apprentissage par renforcement à l’échelle (« Scaled Reinforcement Learning ») pour réduire les hallucinations et améliorer le raisonnement, rivalisant avec des modèles 5 à 10 fois plus grands.
    • Elon les a même félicités pour leur densité d’information.
    • Au fait, AlphaSignal a publié un guide d’installation de Qwen pour votre téléphone comme pour votre ordinateur !

Pourquoi c’est important

Voilà à quoi ressemble l’IA quand elle devient une infrastructure. Personne ne se vante de la puissance de son électricité. Ce qui compte, c’est qu’elle soit bon marché, fiable et disponible partout. Nous n’en sommes pas encore tout à fait à la phase de « service public ennuyeux », mais on peut déjà l’apercevoir qui se profile à l’horizon, juste au-dessus de la cime des arbres, au loin, par une journée sans smog.

Pour la plupart des gens, la conclusion est simple : le prochain outil d’IA que vous utiliserez ne sera probablement pas le modèle le plus puissant du marché. Ce sera le plus rapide et le moins cher qui soit suffisamment performant. Et ce qui est « suffisamment performant » ne cesse de s’améliorer. D’autant que vous pouvez toujours activer le mode « Thinking » (tous les modèles d’IA disposent d’une option permettant d’activer « Thinking », ou une variante, afin qu’ils réfléchissent plus longtemps avant de répondre. Conseil de pro : faites-le souvent. Personnellement, je le fais tout le temps).

Advertisement

Note de la rédaction : ce contenu a été publié à l’origine dans la newsletter de notre publication sœur, The Neuron. Pour lire davantage d’articles de The Neuron, inscrivez-vous à sa newsletter ici.

Grant Harvey

Grant Harvey is the Lead Writer of The Neuron, where he continues to lead the publication's daily coverage of AI news, tools, and trends.

eWeek Logo

eWeek has the latest technology news and analysis, buying guides, and product reviews for IT professionals and technology buyers. The site's focus is on innovative solutions and covering in-depth technical content. eWeek stays on the cutting edge of technology news and IT trends through interviews and expert analysis. Gain insight from top innovators and thought leaders in the fields of IT, business, enterprise software, startups, and more.

Property of TechnologyAdvice. © 2026 TechnologyAdvice. All Rights Reserved

Advertiser Disclosure: Some of the products that appear on this site are from companies from which TechnologyAdvice receives compensation. This compensation may impact how and where products appear on this site including, for example, the order in which they appear. TechnologyAdvice does not include all companies or all types of products available in the marketplace.