Aller au contenu
    GLM
    Guide IA · Série Z.ai 1/4

    Z.ai : le guide complet pour bien démarrer

    Le 16 juin 2026, Z.ai publie GLM-5.2 en open source sous licence MIT. Le modèle dépasse GPT-5.5 sur plusieurs benchmarks de code, embarque une fenêtre de contexte d’un million de tokens, et coûte une fraction du prix des modèles américains équivalents. Il arrive quelques jours après le tour de vis américain sur les modèles propriétaires les plus avancés, ce qui lui donne une visibilité inédite. Reste à savoir par où entrer dans l’écosystème — chat, Coding Plan, API, agents. Ce premier guide vous rend opérationnel en quinze minutes.

    Ouvrez un onglet sur chat.z.ai. Vous tombez sur une interface de chat sobre : un bandeau en haut à droite, un champ de saisie en bas. Pas de tutoriel, pas de pop-up. Tapez votre demande, choisissez un modèle, envoyez. En trois minutes, vous avez généré un prototype d’application web fonctionnelle ou une présentation complète — gratuitement, sans carte bancaire.

    C’est cette simplicité qui rend Z.ai déroutant au départ. L’outil ne vous guide pas. Il suppose que vous savez ce que vous voulez. Ce guide pose donc les quatre questions auxquelles il faut répondre pour démarrer correctement : qu’est-ce que Z.ai exactement, comment ouvrir un compte, quel modèle choisir, et quel plan payer (ou pas).

    Z.ai en une phrase : le laboratoire chinois derrière GLM

    Z.ai, c’est le nom international de Zhipu AI depuis le rebranding de 2025. L’entreprise est née en 2019 d’un spin-off de l’Université Tsinghua à Pékin. L’IDC la classe parmi les principaux acteurs chinois des grands modèles de langage, et elle a surtout marqué 2026 d’une première mondiale : son entrée en bourse à Hong Kong le 8 janvier 2026 sous le nom « Knowledge Atlas » (code HKEX 02513) fait d’elle la première société de modèles de fondation cotée au monde.

    Son produit phare s’appelle GLM (General Language Model). La gamme compte aujourd’hui une quinzaine de modèles, du léger GLM-4.5-Air au plus puissant, GLM-5.2. Depuis juillet 2025, tous les modèles majeurs sortent également sous licence MIT — vous pouvez les télécharger, les héberger chez vous et les utiliser commercialement sans contrainte. Peu de laboratoires de premier plan maintiennent cette politique.

    Deux éléments distinguent Z.ai. D’abord, GLM-5 et ses successeurs ont été entraînés sur des puces Huawei Ascend, sans GPU Nvidia — une réponse directe aux restrictions américaines à l’exportation. Ensuite, Z.ai figure sur l’Entity List du Département du Commerce américain depuis janvier 2025, ce qui a des conséquences concrètes sur l’usage en entreprise (voir plus bas).

    L’écosystème Z.ai en cinq briques

    Quand on parle de « Z.ai », on parle en réalité de cinq produits distincts qui partagent les mêmes modèles mais s’adressent à des usages différents. Les confondre fait perdre du temps.

    Produit Pour qui Accès
    chat.z.ai Tout le monde, usage conversationnel Gratuit, compte Google
    GLM Coding Plan Développeurs dans Claude Code, Cline, OpenCode Abonnement, à partir de ~13 $/mois
    API Z.ai Développeurs qui intègrent GLM dans leurs apps Paiement à l’usage
    AutoGLM & GLM-PC Agents autonomes mobile et desktop Application, extension
    Poids open source Entreprises qui auto-hébergent Hugging Face, licence MIT

    Pour ce guide, on se concentre d’abord sur les deux premières briques : chat.z.ai (pour découvrir) et le Coding Plan (pour les développeurs qui veulent remplacer ou compléter leur abonnement Claude). Les autres briques sont ensuite traitées dans les guides suivants de la série.

    Créer son compte et faire tourner son premier prompt

    L’inscription prend moins de deux minutes. Rendez-vous sur chat.z.ai. Cliquez sur « Sign in » en haut à droite. Deux options : compte Google ou adresse email classique. La connexion Google est la plus rapide — un clic, un choix de compte, c’est fait.

    L’interface est en anglais et en chinois. Pas de version française. Ce n’est pas bloquant, car les modèles GLM comprennent parfaitement le français et répondent dans la langue de la requête. Vous pouvez ainsi écrire votre premier prompt directement en français, il sera traité sans dégradation de qualité.

    01
    Aller sur chat.z.ai et se connecter avec Google

    Aucune vérification téléphone, aucune carte bancaire. Le compte est actif immédiatement. L’accès fonctionne depuis l’Europe sans VPN.

    02
    Choisir un modèle dans le menu déroulant

    GLM-4.7 est le choix par défaut pour commencer. GLM-5.2, le modèle le plus puissant, pour les tâches complexes. GLM-4.7-Flash pour les essais rapides — gratuit, sans quota.

    03
    Taper un prompt et activer les outils

    Les icônes en bas du champ activent la recherche web, la lecture de documents et la lecture de dépôts. Tous sont inclus dans le plan gratuit avec un quota mensuel.

    Pour calibrer l’outil sur un usage réel, lancez-lui par exemple une tâche concrète : « Crée une page web responsive de réservation pour un restaurant, avec formulaire et sélection de date. » GLM construit le plan, génère le HTML, le CSS et le JavaScript, puis vous renvoie un prototype fonctionnel que vous pouvez prévisualiser. C’est ce type de génération de bout en bout qui a bâti la réputation de GLM en 2026.

    Choisir le bon modèle : GLM-5.2, 5-Turbo, 4.7 ou Flash

    Z.ai affiche une douzaine de modèles dans le sélecteur. Trois suffisent à couvrir 95 % des besoins. Les autres sont des variantes spécialisées (vision, OCR, reconnaissance vocale) traitées dans le guide suivant.

    Modèle Pour quelles tâches Contexte Prix API (entrée/sortie par 1M tokens)
    GLM-5.2 Tâches longues, code complexe, agents autonomes 1M 1,40 $ / 4,40 $
    GLM-5-Turbo Workflows agents multi-étapes, vitesse 200K 1,20 $ / 4,00 $
    GLM-4.7 Usage quotidien, rédaction, code standard 200K 0,39 $ / 1,75 $
    GLM-4.7-Flash Tests, complétions simples, prototypes 200K Gratuit (chat)

    GLM-5.2 est le modèle le plus puissant de la gamme. Publié le 16 juin 2026, il dépasse GPT-5.5 sur plusieurs benchmarks de code et talonne Claude Opus 4.8 à environ 1 % sur FrontierSWE. Son architecture Mixture-of-Experts compte 753 milliards de paramètres dont 40 activés par token, et sa fenêtre d’un million de tokens tient une base de code de taille moyenne entière en mémoire — source, tests, configuration et historique compris.

    GLM-5-Turbo est la version pensée pour la vitesse : idéale pour des agents qui enchaînent beaucoup d’actions courtes (automatisation, gestion de tickets, scraping structuré). GLM-4.7 correspond grosso modo au niveau de Claude Sonnet 4.5 — il fait 90 % du travail courant pour 30 % du prix. GLM-4.7-Flash, enfin, est la version gratuite dans le chat, utile pour tester l’outil ou lancer des appels peu exigeants. Pour le choix précis modèle par modèle, le guide suivant détaille chaque cas d’usage.

    La règle de base pour économiser du quota

    GLM-5.2 et GLM-5-Turbo consomment 3× le quota standard en heures de pointe (14h-18h heure de Pékin, soit 8h-12h heure de Paris) et 2× en heures creuses. Z.ai applique un bonus temporaire : 1× en heures creuses jusqu’à fin septembre 2026. Travailler l’après-midi et le soir en Europe revient alors à étirer fortement sa capacité réelle, sans surcoût.

    Comprendre les plans : gratuit, Lite, Pro, Max

    Le plan gratuit de chat.z.ai est généreux : accès à GLM-4.7-Flash en illimité, accès rationné aux autres modèles, et quatre MCP natifs (recherche web, lecture de pages, lecture de dépôts, compréhension visuelle). Pour un usage conversationnel ponctuel, il suffit donc.

    Dès qu’on passe à un usage intensif ou qu’on veut brancher GLM sur un IDE comme Claude Code ou Cline, il faut donc basculer sur le GLM Coding Plan. C’est l’abonnement phare de Z.ai, celui qui a bâti sa réputation en 2026 comme alternative économique à Claude Pro et Claude Max.

    Plan Prix de base Prix annuel (/mois) Quota (fenêtre 5h)
    Gratuit 0 $ GLM-4.7-Flash illimité
    Lite 18 $/mois 12,60 $ ~80 prompts
    Pro 72 $/mois 50,40 $ ~400 prompts
    Max 160 $/mois 112 $ ~1 600 prompts

    Le tarif part de 18 $/mois pour le plan Lite. Z.ai applique ensuite une remise selon l’engagement : 10 % au mois, 20 % au trimestre, 30 % à l’année. Sur un engagement annuel, le Lite tombe à 12,60 $/mois, le Pro à 50,40 $ et le Max à 112 $. Les prix promotionnels de 3 $/mois qui circulaient fin 2025 ont disparu lors de la refonte tarifaire de février 2026.

    Tous les plans donnent également accès à GLM-5.2, GLM-5-Turbo et GLM-4.7. Le quota se compte en prompts sur des fenêtres de 5 heures, avec un plafond hebdomadaire — c’est cette limite, et non le prix affiché, que rencontrent les gros utilisateurs. Le Coding Plan se branche sur Claude Code, Cline, OpenCode et une vingtaine d’outils via un endpoint compatible Anthropic ; l’installation détaillée fait l’objet d’un guide dédié plus loin dans la série.

    Pour situer : le plan Lite en annuel (12,60 $/mois) reste sous le prix de Claude Pro (20 $/mois), tout en visant un usage codage. Au-delà, les plans Pro et Max passent ainsi au-dessus de Claude côté tarif : ils s’adressent aux développeurs qui font tourner des sessions d’agents longues et nombreuses.

    Ce que Z.ai ne fait pas encore bien

    Z.ai a des points faibles qu’il faut également connaître avant de basculer tout son workflow dessus. Les passer sous silence serait malhonnête.

    Le débit reste un point faible des modèles GLM, historiquement plus lents que les modèles frontier américains sur les tâches interactives. Sur des tâches agentiques longues où le modèle travaille seul, l’écart compte beaucoup moins. Mais en pair-programming, il se ressent.

    L’absence de vision sur GLM-5.2 est sa principale limite. C’est un modèle texte et code : pour traiter une image ou une capture d’écran, il faut alors passer par GLM-5V-Turbo, un modèle distinct de la gamme. Les praticiens qui ont testé GLM-5.2 pointent d’ailleurs tous ce manque face aux modèles américains multimodaux.

    La stabilité infrastructure a fait grincer des dents début 2026 : dégradations de qualité ponctuelles et limites hebdomadaires moins prévisibles que celles de Claude. Vérifiez donc le compteur dans votre tableau de bord avant de lancer une session longue.

    La conformité entreprise reste un sujet. Z.ai figure sur l’Entity List américaine depuis janvier 2025. Pour une startup européenne indépendante, ce n’est pas bloquant, car l’interdiction concerne les exports américains vers Z.ai, pas l’usage de Z.ai en Europe. Pour une entreprise qui travaille avec des clients américains ou manipule des données sensibles, cette dépendance à une infrastructure chinoise peut poser un problème de gouvernance. L’auto-hébergement des poids MIT devient alors pertinent — nous le détaillons plus loin dans la série.

    Ce que cela change pour vous

    Pour commencer avec Z.ai cette semaine, trois étapes suffisent. Créez un compte sur chat.z.ai avec votre compte Google. Passez ensuite une heure à tester GLM-4.7 et GLM-5.2 sur vos cas d’usage réels — rédaction, synthèse, code. Enfin, si vous codez régulièrement, prenez le plan Lite (12,60 $/mois en annuel) et branchez-le sur votre IDE, comme nous le verrons dans un guide dédié.

    Notre avis : Z.ai ne remplace pas universellement Claude ou ChatGPT. Ses modèles excellent sur le code et les tâches agentiques longues, tiennent également la route sur la rédaction et la recherche, et restent un peu faibles sur les nuances culturelles occidentales et sur l’image. La combinaison qui fonctionne en 2026 : garder un compte Claude Pro pour les tâches critiques, ajouter un GLM Coding Lite pour le développement en volume. Une vingtaine de dollars par mois pour deux outils qui couvrent l’essentiel du spectre.

    Les trois guides suivants vous emmènent étape par étape : choisir le bon modèle GLM, coder avec le Coding Plan, puis lancer des agents autonomes qui travaillent sans supervision.

    Guide suivant
    Choisir le bon modèle GLM

    Le tableau de décision par cas d’usage pour ne plus lancer le mauvais modèle et épuiser son quota en deux heures.

    Choisir son modèle GLM
    Mise à jour : 25 juin 2026
    Étiquettes: