Qwen : comprendre l’écosystème d’Alibaba avant de commencer
Apple a choisi Qwen pour lancer Apple Intelligence en Chine, et les modèles ouverts d’Alibaba comptent parmi les plus téléchargés au monde. Depuis le printemps, la gamme a changé presque chaque mois : Qwen Chat s’appelle désormais Qwen Studio, Qwen3.8 a remplacé Qwen3.5, et Alibaba garde ses meilleurs modèles pour son API avant d’en ouvrir une partie. Ce premier guide pose les bases : qui fait Qwen, quels modèles existent réellement, comment y accéder gratuitement, et ce qu’il faut savoir avant d’y confier vos données depuis la France.
Qwen désigne la famille de modèles d’IA développée par Alibaba, le géant chinois du commerce en ligne et du cloud. En France, on la connaît surtout par ses modèles ouverts, que l’on installe sur son ordinateur, et par son chat gratuit. En Chine, l’application Qwen est devenue l’un des assistants les plus utilisés du pays, avec 167 millions d’utilisateurs mensuels en mai selon le cabinet QuestMobile.
Cet article ouvre la série Maîtriser Qwen de A à Z. Il présente l’entreprise, la gamme actuelle, les trois façons d’utiliser Qwen et sa place face à ChatGPT, Claude et Gemini. Les articles suivants entrent ensuite dans le détail de chaque usage.
Qwen, c’est quoi exactement
Alibaba publie ses premiers modèles Qwen en 2023, sous l’égide de son laboratoire Tongyi. La marque recouvre deux types de modèles. Les premiers sont ouverts : Alibaba en publie les poids sur Hugging Face, et chacun peut les télécharger, les modifier et les faire tourner chez lui. Les seconds sont propriétaires et ne se consomment que par le chat ou l’API d’Alibaba Cloud.
L’équipe a connu un tournant en mars. Junyang Lin, le responsable technique qui incarnait Qwen auprès des développeurs, a annoncé son départ le 3 mars, et le directeur technique d’Alibaba, Zhou Jingren, a repris la main sur le projet. Dans les mois qui ont suivi, les modèles phares sont restés fermés. Alibaba a ensuite rouvert en partie ses poids en août, mais sous des licences plus restrictives pour les très grandes entreprises.
Lors de sa conférence Apsara, le 22 septembre, Alibaba a annoncé que Qwen 4 était en cours d’entraînement. Aucune date de sortie n’a été donnée.
La gamme Qwen actuelle
Les noms de modèles se succèdent vite, et la plupart des guides en ligne décrivent encore la gamme du printemps. Voici les modèles qui comptent aujourd’hui.
| Modèle | Accès | À quoi il sert |
|---|---|---|
| Qwen3.8-Max | API et Qwen Studio depuis le 3 août, poids ouverts en version texte le 12 août | Le modèle le plus puissant, pour les tâches complexes, le code et les agents |
| Qwen3.7-Plus | API et Qwen Studio | Le modèle intermédiaire, qui offre un bon équilibre entre qualité et prix |
| Qwen3.8-Flash | API depuis le 26 août | Le modèle rapide et bon marché, pour le volume |
| Qwen3.8-27B | Poids ouverts sous Apache 2.0 depuis le 14 août | Le meilleur modèle ouvert à installer sur un ordinateur puissant |
| Qwen3.6 27B et 35B-A3B | Poids ouverts sous Apache 2.0 depuis avril | Des modèles locaux solides en code, dont une version rapide à experts |
| Qwen3.5 de 0,8B à 9B | Poids ouverts sous Apache 2.0 depuis mars | Les petits modèles pour les machines modestes et les smartphones |
| Qwen3.8-Omni-Flash | API depuis le 18 septembre | La conversation vocale et l’analyse de vidéos en temps réel |
| Qwen-Image-3.0 | Qwen Studio uniquement | La génération et la retouche d’images |
Deux évolutions simplifient le paysage. Depuis Qwen3.5, les modèles principaux lisent les images et les vidéos : la famille Qwen-VL, autrefois séparée, a été intégrée au tronc commun. Les modèles phares acceptent en outre un million de tokens de contexte, soit plusieurs centaines de milliers de mots.
À quoi sert un million de tokens
Cette fenêtre permet de soumettre d’un bloc un contrat de plusieurs centaines de pages, un an de comptes rendus de réunion ou le code complet d’une application. Le modèle peut alors croiser des informations très éloignées les unes des autres, ce qu’un découpage en morceaux rend difficile.
Deux précautions restent utiles. D’abord, les modèles retrouvent moins bien une information noyée au milieu d’un très long texte qu’au début ou à la fin : placez donc votre consigne en tête, puis rappelez-la après le document. Ensuite, chaque token envoyé se paie sur l’API, et le tarif augmente au-delà de 256 000 tokens sur certains modèles. Pour interroger souvent la même base documentaire, une recherche documentaire de type RAG coûte bien moins cher.
Les trois façons d’utiliser Qwen
Qwen Studio est le chat gratuit d’Alibaba, accessible sur chat.qwen.ai et en application. C’est la porte d’entrée la plus simple, sans installation ni carte bancaire.
L’API Model Studio d’Alibaba Cloud s’adresse aux développeurs et aux entreprises qui intègrent Qwen dans leurs outils. Elle propose une région à Francfort pour garder les données en Europe. Le guide de l’API Qwen détaille les prix et la mise en production.
L’installation locale fait tourner un modèle ouvert sur votre propre machine, avec Ollama ou LM Studio. Vos données ne sortent plus de chez vous. Le guide pour installer Qwen en local vous aide à choisir le modèle adapté à votre ordinateur.
Qwen Studio : le chat gratuit
Qwen Chat a changé de nom le 10 avril pour devenir Qwen Studio, en conservant les comptes, l’historique et les fonctions. Alibaba le présente comme une plateforme d’accès unifié à ses modèles ouverts et propriétaires. Il faut un compte pour choisir son modèle, et Qwen3.8-Max y reste utilisable gratuitement.
Le service réunit la conversation, la réflexion approfondie, la recherche web, une recherche approfondie qui rédige des rapports, l’analyse d’images, de vidéos et de documents, la génération et la retouche d’images, la conversation vocale et les artefacts, ces petites pages ou applications générées à la volée. L’application mobile propose une interface en français.
Alibaba n’a publié ni forfait payant ni quota précis pour Qwen Studio hors de Chine. Les limites existent pourtant, et elles varient selon le compte, la région et le modèle. En Chine, l’application Qwen a lancé en août des abonnements pour ses fonctions de bureautique, entre 19 et 128 yuans par mois, tandis que la conversation reste gratuite.
Qwen Studio est gratuit, mais Qwen Code, l’agent de programmation d’Alibaba, ne l’est plus depuis le 15 avril. Beaucoup de pages en ligne affirment encore le contraire. Le guide Coder avec Qwen présente les formules qui ont remplacé l’accès gratuit.
Utiliser Qwen depuis la France
Qwen Studio fonctionne depuis la France sans restriction, et aucune autorité européenne de protection des données n’a pris de mesure publique contre Qwen à ce jour, contrairement à DeepSeek. Les conversations sont toutefois traitées hors de l’Union européenne. Pour des données personnelles ou confidentielles, préférez l’API dans la région de Francfort ou un modèle installé chez vous.
Côté réglementation, Alibaba ne figure pas parmi les signataires du code de bonnes pratiques qui accompagne l’AI Act pour les modèles d’IA à usage général. La liste publiée par la Commission européenne au 31 juillet ne compte d’ailleurs aucune entreprise chinoise.
Enfin, les modèles Qwen appliquent la censure chinoise sur les sujets politiques sensibles. Une étude publiée en mars sur Qwen3-32B montre que le modèle connaît les faits liés à Tiananmen ou au Falun Gong, mais qu’il a appris à les taire ou à les déformer. Cette censure persiste quand vous installez le modèle chez vous. Pour le code, la rédaction ou l’analyse de documents sans lien avec ces sujets, elle ne se remarque pas.
Qwen face à ChatGPT, Claude et Gemini
Sur le classement LMArena, qui s’appuie sur les votes des utilisateurs, Qwen3.8-Max occupait la 22e place en texte au 13 septembre. Les premières places reviennent aux modèles d’Anthropic, de Google et d’OpenAI. L’indice d’Artificial Analysis le classe 24e, en soulignant sa lenteur, autour de 39 tokens par seconde.
Qwen reprend l’avantage sur deux terrains. Le premier est le code web : Qwen3.8-Max se classe 4e du classement Frontend de Code Arena. Le second, et le plus important, est l’ouverture. ChatGPT, Claude et Gemini ne se téléchargent pas, alors que Qwen offre des modèles récents et performants à installer chez soi, sous une licence qui autorise l’usage commercial. Le chinois Kimi K3 et DeepSeek restent ses principaux concurrents sur ce terrain.
Ce qu’il faut retenir
Qwen réunit un chat gratuit, Qwen Studio, une API avec une région européenne, et une gamme de modèles ouverts parmi les plus complètes du marché. Pour découvrir l’outil, Qwen Studio suffit. Pour protéger vos données, le local ou l’API à Francfort s’imposent. Face aux leaders américains, Qwen reste un cran en dessous sur les modèles fermés, mais il domine sur les modèles que l’on peut installer soi-même.
Les commandes /think et /no_think ne fonctionnent plus depuis Qwen3.5. Ce guide montre comment régler la réflexion aujourd’hui, dans le chat, par l’API et en local, avec les techniques de prompt qui marchent.