GLM 5.2 is a large-scale reasoning model from Z.ai. It supports text input and output with a 1M-token context window, and is suited for long-horizon agent workflows, project-level software engineering,...
Catégorie de performance
Flagship
Z.ai GLM 5.2 est un modèle flagship de Z.ai : le plus performant de leur gamme.
Meilleur modèle de ce fournisseur. Performances maximales sur les benchmarks, idéal pour les tâches exigeantes.
Tarification
Ce modèle est inclus dans les plans Elosia
Abordable
Coût réduit. Adapté à un usage soutenu et aux interactions volumineuses.
Architecture MoE (~750B au total, 40B actifs) — meilleur modèle open-weight pour le codage agentique long-terme (SWE-bench Pro 62,1, devant GPT-5.5)
Fenêtre de contexte de 1M tokens (jusqu'à 128K en sortie), rendue exploitable par l'attention parcimonieuse IndexShare — dépôts entiers et documents longs en une seule passe
Compétitif avec les modèles frontier sur le raisonnement difficile — GPQA Diamond 91,2 et AIME 2026 99,2, au niveau des meilleurs modèles occidentaux
Open-weight sous licence MIT — auto-hébergement commercial sans restriction, poids sur HuggingFace et ModelScope
Économique à $0,98/M en entrée et $3,08/M en sortie — une fraction du coût des modèles frontier comparables pour le codage long-terme
Limites
Uniquement texte : pas d'entrée image ni multimodale
Benchmarks phares auto-rapportés par Z.ai ; vérification indépendante encore limitée
Optimisé étroitement pour le codage, l'agentique et le raisonnement — moins performant sur l'usage conversationnel général (autour de #25 sur Text Arena)