GLM 5.2 : open source, 744B paramètres, six fois moins cher que GPT-5.5
Z.ai publie GLM 5.2 sous licence MIT. 744 milliards de paramètres, 1 million de tokens de contexte. Les benchmarks placent ce modèle ouvert au niveau de Claude Opus 4.8 et GPT-5.5, pour 1,40 $ le million de tokens.
Auteur : Attuoman Prince Josias
Publié le
Z.ai a publié GLM 5.2 le 13 juin 2026 sous licence MIT : 744 milliards de paramètres, 1 million de tokens de contexte, pour 1,40 $ le million de tokens en entrée.
GPT-5.5 et Claude Opus 4.8 facturent tous deux 5 $ pour la même quantité : GLM 5.2 divise la facture par six en entrée, et par sept en sortie (4,40 $ contre 30 $).
Sur l'Intelligence Index v4.1, GLM 5.2 prend la première place avec 51 points. Sur le code, Claude Opus 4.8 garde l'avantage avec 69,2% contre 62,1% sur SWE-bench Pro.
Les poids du modèle sont librement téléchargeables sur HuggingFace : possibilité de l'héberger soi-même, le modifier, l'intégrer dans un produit commercial, sans restriction géographique.
La sortie arrive un jour après la suspension de Claude Fable 5 par le gouvernement américain, offrant une alternative sans verrou régional aux développeurs concernés.
Ce résumé (uniquement ce résumé, pas l'article) est généré par Claude Sonnet 5, relu et validé par Attuoman Prince Josias, auteur de l'article.
Z.ai a publié GLM 5.2 le 13 juin 2026 sous licence MIT. Le modèle pèse 744 milliards de paramètres, accepte 1 million de tokens en contexte, et coûte 1,40 $ par million de tokens en entrée. GPT-5.5 d'OpenAI facture 5 $ pour la même quantité. Claude Opus 4.8 d'Anthropic aussi. Z.ai divise la facture par six.
Z.ai en bref
Z.ai (ex-Zhipu AI) est une startup IA basée à Pékin. Des chercheurs de l'Université Tsinghua l'ont fondée en 2019. L'équipe développe la gamme GLM depuis ses débuts. L'entité cotée Knowledge Atlas Technology (HKEX: 2513) a gagné 48 % en bourse le jour de l'annonce. JPMorgan a relevé sa cible à 1 400 HKD.
Specs techniques
| Spécification | Valeur |
|---|---|
| Paramètres totaux | 744 milliards |
| Paramètres actifs par token | ~40 milliards (MoE, 384 experts) |
| Contexte | 1 000 000 tokens |
| Sortie max | 131 072 tokens |
| Données d'entraînement | 28,5 trillions de tokens |
| Licence | MIT (aucune restriction) |
L'architecture Mixture of Experts active 40 milliards de paramètres par token sur les 744 milliards disponibles. Vous obtenez la puissance d'un modèle massif sans en payer le coût de calcul complet.
Benchmarks
GLM 5.2 occupe la première place de l'Artificial Analysis Intelligence Index v4.1 avec 51 points. Gemini 3.5 Flash suit à 50 points. Sur les benchmarks de code, Claude Opus 4.8 garde l'avantage.
| Benchmark | GLM 5.2 | Claude Opus 4.8 | GPT-5.5 | Gemini 3.1 Pro |
|---|---|---|---|---|
| SWE-bench Pro | 62,1 % | 69,2 % | 58,6 % | 54,2 % |
| Terminal-Bench 2.1 | 81,0 | 85,0 | N/A | N/A |
| Intelligence Index v4.1 | 51 (#1) | N/A | ~50 | 46 |
| Code Arena (LMArena) | 1 595 (#2) | N/A | ~1 524 | N/A |
Claude Opus 4.8 mène sur SWE-bench Pro : 69,2 % contre 62,1 % (source : SWE-bench Pro Leaderboard, scaffold Anthropic). GLM 5.2 dépasse GPT-5.5 de 3,5 points sur ce même test. Sur le classement global d'intelligence et le Design Arena, Z.ai prend la tête.
Prix
| Modèle | Input ($/M tokens) | Output ($/M tokens) | Licence |
|---|---|---|---|
| GLM 5.2 | 1,40 $ | 4,40 $ | MIT (ouvert) |
| GPT-5.5 | 5,00 $ | 30,00 $ | Fermé |
| Claude Opus 4.8 | 5,00 $ | 25,00 $ | Fermé |
En sortie, un million de tokens coûte 4,40 $ avec GLM 5.2 contre 30 $ avec GPT-5.5. Si vous dépensez 3 000 $ par mois en API OpenAI, la même charge revient à 440 $ sur GLM 5.2. Pour le cache d'entrée, Z.ai propose 0,26 $ par million de tokens.
Licence MIT
Z.ai a mis les poids du modèle en ligne le 16 juin 2026 sur HuggingFace, sous licence MIT. Vous pouvez télécharger GLM 5.2, le modifier, l'intégrer dans un produit commercial, le redistribuer. Aucune restriction géographique ni d'usage.
Jusqu'à cette sortie, les modèles comparables à GPT-5.5 ou Claude Opus restaient propriétaires. Vous passiez par l'API d'OpenAI ou d'Anthropic. Z.ai offre une troisième option : vous hébergez le modèle, vous gardez vos données. OpenRouter, Cloudflare Workers AI et Featherless le proposent aussi dans leurs catalogues si vous préférez ne rien installer.
Limites
Simon Willison, développeur et blogueur IA, a testé GLM 5.2 sur des tâches créatives. Le modèle génère 43 000 tokens en sortie par tâche. GLM 5.1 en produisait 26 000. La qualité progresse, la consommation de tokens aussi (source : simonwillison.net).
Sur SWE-bench Pro, Claude Opus 4.8 conserve 7 points d'avance. Pour les tâches de refactoring sur des codebases larges, Opus reste devant. Z.ai n'a pas publié de scores MMLU ni HumanEval au lancement.
Contexte
Z.ai a publié GLM 5.2 un jour après la suspension de Claude Fable 5 par le gouvernement américain (12 juin 2026). Les restrictions d'exportation américaines poussent des développeurs hors des écosystèmes OpenAI et Anthropic. Ces développeurs trouvent dans GLM 5.2 une alternative sans verrou régional, gratuite, et performante.
L'action de Knowledge Atlas Technology est passée de 116 HKD à l'IPO (8 janvier 2026) à 1 993 HKD au plus haut (29 mai), avant de se stabiliser autour de 1 559 HKD. Bank of America cible 1 250 HKD.
Mis à jour le 23 juin 2026.
Une newsletter par semaine, gratuite.
Actus IA, tutoriels et outils. Zero spam, desabonnement en 1 clic.
Notez cet article