Qwen3.7‑Max est le nouveau modèle phare d’Alibaba conçu pour des agents IA capables d’exécuter des tâches complexes sur de longues périodes, y compris un test interne de 35 heures avec plus de 1 000 appels d’outils. Le modèle met l’accent sur le code, le raisonnement et l’intégration d’outils plutôt que sur la simpl...

Create a landscape editorial hero image for this Studio Global article: What is Alibaba’s new Qwen3.7‑Max AI model, and what are its key capabilities, benchmarks, and real‑world applications—including its agentic. Article summary: Alibaba’s Qwen3.7-Max is a new flagship Qwen large language model positioned less as a chatbot and more as an “agent-era” model: it is built for coding, tool use, reasoning, office automation, and long-running autonomous. Topic tags: general, news, general web, user generated. Reference image context from search candidates: Reference image 1: visual subject "# Alibaba launches Qwen3-Max, its largest and most capable AI model to date. **Alibaba has released Qwen3-Max, the biggest and most capable AI model in its lineup. The new model is" source context "Alibaba launches Qwen3-Max, its largest and most capable AI ..." Reference image 2: visual subject "# Alibaba
Les modèles d’intelligence artificielle évoluent rapidement. Alors qu’ils étaient surtout conçus pour répondre à des questions, une nouvelle génération vise désormais à réaliser des tâches complètes de manière autonome. C’est précisément l’objectif de Qwen3.7‑Max, le dernier modèle phare d’Alibaba.
Présenté lors de l’Alibaba Cloud Summit 2026, ce modèle se positionne comme une base pour des agents IA capables de planifier, écrire du code, utiliser des outils externes et exécuter des workflows complexes sur de longues périodes. L’idée n’est plus seulement de discuter avec un chatbot, mais de permettre à l’IA de faire réellement le travail dans des domaines comme le développement logiciel, l’automatisation de bureau ou les opérations d’entreprise.
Qwen3.7‑Max appartient à la famille des grands modèles de langage Qwen développée par Alibaba. Cette version a été conçue spécifiquement pour les charges de travail dites “agentiques” : des scénarios où l’IA doit planifier, utiliser des outils et enchaîner de nombreuses actions pour atteindre un objectif.
Selon Alibaba, le modèle met l’accent sur plusieurs capacités clés :
Cette orientation reflète une tendance majeure de l’industrie : passer d’une IA qui génère des réponses à une IA qui agit directement au nom de l’utilisateur.
L’un des exemples les plus commentés lors de la présentation concerne la capacité du modèle à effectuer un travail autonome sur de longues durées.
Dans une expérience interne rapportée par Alibaba, Qwen3.7‑Max aurait mené un processus d’optimisation de noyau informatique pendant 35 heures, avec plus de 1 000 appels à des outils. Durant ce test, le modèle a écrit du code, lancé des tests, analysé les résultats puis amélioré progressivement l’implémentation.
Ce type de fonctionnement suit une boucle typique d’agent IA :
Maintenir la cohérence pendant des centaines d’étapes est un défi technique pour les modèles actuels. Ces démonstrations restent donc des résultats fournis par l’éditeur, qui devront être confirmés par des tests indépendants.
Les premiers résultats de benchmark placent Qwen3.7‑Max dans le groupe des modèles les plus performants au monde, même s’il ne domine pas encore tous les classements.
Sur l’Artificial Analysis Intelligence Index, un indicateur qui agrège plusieurs évaluations difficiles, Qwen3.7‑Max obtient un score d’environ 57.
Ce niveau le place parmi les modèles les plus avancés disponibles actuellement, même si certains systèmes de pointe développés par des laboratoires américains obtiennent encore des scores légèrement supérieurs.
Sur le leaderboard LM Arena, basé sur des comparaisons à l’aveugle évaluées par des utilisateurs, Qwen3.7‑Max‑Preview a atteint un score Elo d’environ 1 475, soit autour de la 13ᵉ place mondiale pour les capacités textuelles.
Les sous‑classements indiquent notamment :
À sa sortie, ces résultats en faisaient le modèle chinois le mieux classé sur la plateforme Arena.
Alibaba positionne clairement Qwen3.7‑Max comme un modèle orienté développement logiciel et agents de codage.
Les évaluations et démonstrations évoquent de bonnes performances dans des tâches comme :
L’architecture est pensée pour fonctionner avec des outils — compilateurs, interpréteurs, API ou environnements de développement — afin que l’IA puisse modifier et tester son code de manière répétée jusqu’à atteindre l’objectif.
La famille de modèles Qwen met également l’accent sur les contextes longs, c’est‑à‑dire la capacité à analyser de très grandes quantités de texte ou de code dans une seule requête.
La documentation d’Alibaba indique que certaines variantes de la série Qwen peuvent gérer des centaines de milliers voire près d’un million de tokens de contexte.
Cependant, la limite exacte du contexte pour Qwen3.7‑Max n’est pas clairement confirmée dans les documents publics disponibles. Les références fréquentes à un contexte d’un million de tokens doivent donc être considérées avec prudence tant qu’une documentation officielle détaillée n’est pas publiée.
Alibaba présente Qwen3.7‑Max comme une infrastructure pour des agents IA d’entreprise dans plusieurs domaines.
Dans ces scénarios, l’IA ne se contente pas de produire du texte : elle planifie, appelle des outils et enchaîne des actions pour atteindre un objectif concret.
Dans l’écosystème chinois de l’IA, Qwen3.7‑Max apparaît comme l’un des modèles les plus avancés au moment de son lancement, surpassant plusieurs concurrents locaux dans certains benchmarks.
À l’échelle mondiale, la situation est plus nuancée. Le modèle se classe parmi les meilleurs, mais reste légèrement derrière certains systèmes de pointe développés aux États‑Unis dans plusieurs indices agrégés.
Cette dynamique reflète la compétition intense entre laboratoires d’IA, où les progrès sont mesurés sur plusieurs axes : raisonnement, programmation, coût d’inférence et capacités d’agents.
La véritable importance de Qwen3.7‑Max ne réside pas seulement dans ses scores de benchmark.
Il incarne surtout une évolution majeure : le passage du chatbot à l’agent autonome.
Les modèles de cette nouvelle génération sont conçus pour :
Qwen3.7‑Max illustre clairement cette transition : une IA conçue non seulement pour dialoguer, mais pour exécuter des workflows entiers de manière autonome.
Reste à voir si les démonstrations les plus ambitieuses — comme les sessions de codage autonomes sur plusieurs dizaines d’heures — se confirmeront à grande échelle. Mais la direction est déjà claire : la prochaine génération d’IA vise à opérer et produire du travail réel, pas simplement à répondre à des prompts.
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Qwen3.7‑Max est le nouveau modèle phare d’Alibaba conçu pour des agents IA capables d’exécuter des tâches complexes sur de longues périodes, y compris un test interne de 35 heures avec plus de 1 000 appels d’outils.
Qwen3.7‑Max est le nouveau modèle phare d’Alibaba conçu pour des agents IA capables d’exécuter des tâches complexes sur de longues périodes, y compris un test interne de 35 heures avec plus de 1 000 appels d’outils. Le modèle met l’accent sur le code, le raisonnement et l’intégration d’outils plutôt que sur la simple conversation, afin d’alimenter des agents pour le développement logiciel et les workflows d’entreprise.
Les premiers benchmarks le placent parmi les modèles mondiaux les plus performants, avec un score d’environ 57 sur l’Artificial Analysis Intelligence Index et un classement autour de la 13ᵉ place sur LM Arena.