En août 2026, Qwen, la famille de grands modèles d’Alibaba, s’est hissé en l’espace de trois ans parmi les plus gros écosystèmes de grands modèles au monde, si l’on suit Alibaba Cloud.
À l’origine, Alibaba l’a lancé en 2023 comme un chatbot d’entreprise. Depuis, Qwen s’est étendu au texte, à la vision, à l’audio et au raisonnement, et a largement dépassé le cadre chinois, toujours d’après Alibaba Cloud.
Le virage a été pris très vite. Alibaba ne s’est pas contenté d’une vitrine technologique et a commencé à publier des modèles à poids ouverts dès 2023, selon Alibaba Cloud.
À ce stade, le point culminant s’appelle Qwen3.8, présenté en août 2026 par Alibaba Cloud comme un modèle MoE de 2 400 milliards de paramètres, dont 95 milliards activés à l’inférence.
Qwen : comment Alibaba a transformé un chatbot en écosystème mondial
L’histoire démarre le 7 avril 2023, quand Alibaba Cloud ouvre sur invitation l’accès à Tongyi Qianwen.
Quatre jours après, Alibaba élargit la présentation de Tongyi Qianwen et annonce son intégration dans DingTalk et Tmall Genie, là encore selon Alibaba Cloud.
À ce moment-là, Qwen a encore l’allure d’une simple brique logicielle, pensée d’abord pour faire tourner l’écosystème Alibaba.
Le vrai changement de rythme arrive le 3 août 2023, avec la publication en poids ouverts de Qwen-7B et de Qwen-7B-Chat, d’après Alibaba Cloud.
Les deux modèles ont été entraînés sur plus de 2 200 milliards de tokens, avec une fenêtre de contexte de 2 048 tokens, selon Alibaba Cloud.
Un peu plus tard dans le mois, Qwen-VL fait son apparition, cette fois pour la compréhension d’images, toujours selon Alibaba Cloud.
L’accès public s’ouvre le 13 septembre. Puis, en décembre, la gamme s’élargit avec des versions 72B et 1,8B, toujours d’après Alibaba Cloud.
2024 : l’année où Qwen accélère vraiment
En février 2024, Qwen1.5 marque une nouvelle étape. On y trouve des modèles denses allant de 0,5B à 72B, tous avec 32K de contexte, un modèle MoE de 14B avec 2,7B de paramètres actifs, ainsi qu’un très gros modèle dense de 110B, selon Alibaba Cloud.
L’intention devient alors assez nette : couvrir à peu près tous les usages, du local jusqu’au très haut de gamme.
Qwen2, lancé en juin 2024 par Alibaba Cloud, pousse encore plus loin cette ambition.
La famille s’étend de 0,5B à 72B, ajoute un modèle amiral MoE 57B-A14B, prend en charge 27 langues en plus de l’anglais et du chinois, et grimpe jusqu’à 128K tokens de contexte sur les versions Instruct 7B et 72B, selon Alibaba Cloud.
Autre signe adressé aux développeurs, toutes les tailles sauf 72B passent sous licence Apache 2.0, d’après Alibaba Cloud.
Pendant l’été puis à la rentrée 2024, l’écosystème s’étoffe encore avec Qwen2-Math, Qwen2-Audio et Qwen2-VL. Ce dernier peut analyser des vidéos de plus de 20 minutes, selon Alibaba Cloud.
Puis, en septembre, Qwen2.5 arrive avec plus de 100 modèles open source, des tailles allant de 0,5B à 72B, 128K de contexte, jusqu’à 8K tokens générés, et un saut des données de préentraînement de 7 000 à 18 000 milliards de tokens, toujours selon Alibaba Cloud.
De Qwen3 à Qwen3.8 : le passage à très grande échelle
Qwen3, lancé en avril 2025 par Alibaba Cloud, prolonge la formule avec un mode hybride de raisonnement, 36 000 milliards de tokens d’entraînement, la prise en charge de 119 langues et une licence Apache 2.0.
En août 2026, Qwen3.8 franchit une nouvelle étape avec son modèle MoE de 2 400 milliards de paramètres. Une version plus légère de 27B l’accompagne, elle aussi sous Apache 2.0, selon Alibaba Cloud.
Côté adoption, la courbe impressionne tout autant.
Alibaba Cloud indiquait déjà des dizaines de millions de téléchargements fin 2024.
Au premier semestre 2026, la famille Qwen a dépassé les 3 milliards de téléchargements dans le monde et inspiré plus de 300 000 modèles dérivés, toujours selon Alibaba Cloud.
Une réussite technique, mais pas sans controverses
Cette progression tient à des choix techniques qui ont visiblement porté, autour des architectures transformer et MoE, ainsi qu’à de bonnes performances en code et en multilingue.
Mais il vaut mieux garder un peu de recul.
L’essor de Qwen s’accompagne aussi de critiques récurrentes sur la censure de certains sujets, sur des biais jugés pro-Pékin, et sur les tensions géopolitiques que son usage suscite en Occident, sans compter les accusations de copie technologique.
Autrement dit, Qwen n’est plus seulement un projet signé Alibaba.
C’est désormais un acteur central de l’IA générative ouverte, et un sujet de débat à l’échelle mondiale.