Le LLM révolutionnaire Marco-o1 d’Alibaba augmente de 6 % la précision des tests de résolution de problèmes mathématiques

Alibaba homepage.

Alibaba’s homepage.

Dec 14, 2024
3 minute read
eWeek Le contenu et les recommandations de produits sont indépendants de la rédaction. Nous pouvons gagner de l'argent lorsque vous cliquez sur des liens vers nos partenaires. En savoir plus

Alibaba a annoncé Marco-o1, un grand modèle de langage (LLM) avancé conçu pour s’attaquer à des problèmes ouverts et à des tâches de raisonnement complexe. Développé par l’équipe MarcoPolo au sein d’Alibaba International Digital Commerce, Marco-o1 est appelé à rivaliser avec le modèle o1 d’OpenAI, en proposant des améliorations dans le raisonnement, la traduction et la résolution de problèmes dans de nombreux domaines.

La différence Alibaba

Contrairement aux modèles d’IA traditionnels qui excellent dans des tâches structurées comme le codage et les mathématiques, Marco-o1 se concentre sur les problèmes ouverts, pour lesquels les réponses définitives et les critères d’évaluation clairs font souvent défaut. 

« À l’heure actuelle, o1 d’OpenAI suscite un vif intérêt pour l’étude des grands modèles de raisonnement (LRM) », selon un extrait du rapport. « S’appuyant sur cette dynamique, Marco-o1 ne se concentre pas seulement sur les disciplines qui admettent des réponses standard, comme les mathématiques, la physique et le codage — particulièrement adaptées à l’apprentissage par renforcement (RL) —, mais accorde aussi une plus grande place aux solutions ouvertes. Nous cherchons à répondre à la question suivante : “Le modèle o1 peut-il se généraliser efficacement à des domaines plus vastes, dépourvus de critères clairs et où les récompenses sont difficiles à quantifier ?” »

Cette avancée repose sur une combinaison de méthodologies avancées :

  • Ajustement fin fondé sur la chaîne de pensée (CoT) : permet un raisonnement étape par étape en explicitant le cheminement de la pensée.
  • Recherche arborescente de Monte-Carlo (MCTS) : explore plusieurs chemins de raisonnement en utilisant des scores de confiance pour guider le modèle vers des solutions optimales.
  • Stratégies d’action pour le raisonnement : ajuste dynamiquement le niveau de granularité de la prise de décision, afin d’affiner l’approche du modèle face aux problèmes nuancés.

Marco-o1 repose sur l’architecture Qwen2-7B-Instruct et a été entraîné à partir d’un mélange de données CoT open source et de jeux de données synthétiques propriétaires. Ces technologies permettent à Marco-o1 de traiter des tâches allant du raisonnement abstrait aux traductions multilingues.

Advertisement

Points forts en matière de performances

Marco-o1 a réalisé des avancées significatives dans les benchmarks de raisonnement et de traduction, avec notamment une précision supérieure de 6,17 % sur le jeu de données MGSM (anglais), un test rigoureux des capacités de raisonnement ; une précision supérieure de 5,60 % sur le jeu de données MGSM (chinois), qui témoigne de ses compétences multilingues ; ainsi qu’une maîtrise de la traduction automatique, comme le montre sa capacité à interpréter les nuances culturelles de l’argot. 

Dans un geste en faveur de l’innovation ouverte, Alibaba a mis Marco-o1 gratuitement à disposition sur des plateformes comme GitHub et Hugging Face, invitant les chercheurs et les développeurs à explorer ses capacités et à les améliorer.

L’annonce d’Alibaba intervient peu après des innovations similaires, comme le modèle DeepSeek-R1-Lite-Preview lancé par le laboratoire chinois DeepSeek, et met directement au défi le modèle o1 d’OpenAI, salué pour ses performances en raisonnement logique et mathématique, notamment sur des plateformes comme AIME et CodeForces. Marco-o1 entend toutefois aller plus loin en généralisant ses capacités de raisonnement à des domaines ambigus du monde réel.

Pour en savoir plus sur certaines des autres grandes entreprises qui transforment le monde de la technologie de l’IA.

Aminu Abdullahi

Aminu Abdullahi is a B2C and B2B technology and finance writer with more than six years of experience covering enterprise IT, cybersecurity, cloud computing, artificial intelligence, fintech, business software, and emerging technologies. His work has appeared in publications including TechRepublic, eWEEK, Channel Insider, Geekflare, Enterprise Networking Planet, eSecurity Planet, CIO Insight, and Webopedia. With a technical background in computer science, he specializes in translating complex technology topics into clear, accessible content for business leaders and decision-makers.

eWeek Logo

eWeek has the latest technology news and analysis, buying guides, and product reviews for IT professionals and technology buyers. The site's focus is on innovative solutions and covering in-depth technical content. eWeek stays on the cutting edge of technology news and IT trends through interviews and expert analysis. Gain insight from top innovators and thought leaders in the fields of IT, business, enterprise software, startups, and more.

Propriété de TechnologyAdvice. © 2026 TechnologyAdvice. Tous droits réservés

Divulgation publicitaire : Certains des produits qui apparaissent sur ce site proviennent d'entreprises dont TechnologyAdvice reçoit une compensation. Cette compensation peut influencer la façon dont les produits apparaissent sur ce site, notamment l'ordre dans lequel ils apparaissent. TechnologyAdvice n'inclut pas toutes les entreprises ou tous les types de produits disponibles sur le marché.