Passer au contenu principal

GLM · Général · GLM-5.3

GLM-5.3 : caractéristiques, besoins GPU, hébergement et déploiement

GLM-5.3 est une version Actuel de la branche Général de GLM, certifiée depuis sa révision officielle.

Illustration technique de déploiement pour GLM-5.3
Flux de déploiement de référence ; les faits d’architecture exacts sont indiqués séparément.
Paramètres totaux744,0B
Paramètres actifs40,0B
Fenêtre de contexte1 048 576 tokens
Statut de la versionActuel · Actuel
Architecture du modèleGlmMoeDsaForCausalLM
ModalitésTexte
LicenceLicence GLM-5.3
État de déploiementDéployable avec une configuration certifiée
État commercialUsage commercial autorisé sous conditions
Annonce2026-08-14
API disponible2026-08-14
Poids ouverts publiés2026-08-28

Architecture, points forts et usages

GLM-5.3 est une version officielle auto-hébergeable de Z.ai dans la branche GLM Général. Elle utilise GlmMoeDsaForCausalLM avec 744B / 40B MoE et un contexte vérifié de 1,048,576 tokens.

GLM-5.3 utilise GlmMoeDsaForCausalLM avec 744B / 40B MoE. Le profil vérifié indique 78 couches, une largeur cachée de 6144 et 64 têtes d’attention lorsque ces valeurs sont publiées.

Architecture GlmMoeDsaForCausalLM vérifiée
Contexte certifié de 1,048,576 tokens
Provenance officielle du checkpoint
Inférence LLM privée
Flux agentiques
Traitement de documents longs

Checkpoints et quantifications certifiés

Seules les variantes exactes, rattachées à cette version et certifiées par leur source sont affichées.

GLM-5.3

zai-org/GLM-5.3

Officiel · FP8 · safetensors

Environnement d’exécution certifié: SGLang vLLM 0.28.0 Tokenspeed Transformers 5.15.0 KTransformers Unsloth

Précision / quantificationFormatBitsConfiance éditeurÉtat de déploiement
FP8safetensors8OfficielEnvironnement d’exécution certifié

Matériel recommandé

Utilisez uniquement les configurations d’exécution certifiées avec la précision exacte du checkpoint. Le classement matériel vérifie poids, cache KV, surcharge, architecture GPU et topologie.

Mémoire estimée des poids713.69 GB
Cache KV14.63 GB
Surcharge de l’environnement d’exécution187.74 GB
Total avec marge de sécurité1135.91 GB
Dimensionnement de référence techniquement compatible

Aucun inventaire FusionPointAI actuel ne satisfait tous les critères d’environnement d’exécution, d’architecture, de topologie et de mémoire pour ce checkpoint. Utilisez l’estimateur pour le matériel compatible mondial.

Licence et considérations d’auto-hébergement

Les 744 B de poids résidents doivent tenir sur les GPU choisis. Le contexte et la concurrence ajoutent la mémoire du cache KV.

GLM-5.3 est publié sous Licence GLM-5.3. Le lien officiel de licence et la date de vérification sont conservés.

Usage commercial autorisé sous conditions. L’usage commercial est soumis à conditions. Consultez les conditions officielles indiquées avant tout déploiement.

Alternatives et variantes associées

GLM-5.2, GLM-5.1, GLM-5

Chronologie des versions

zai/glm/glm-5-3 @ f3d68daa9a0dd3fbe261b5b84df3871adcfc4a189125bb4aff6d7cd953ebd3ed

Source officielle

Questions fréquentes

Quelle VRAM faut-il pour GLM-5.3 ?

L’estimation dépend de la précision, du contexte et de la concurrence et utilise les données certifiées.

Quels environnements d’exécution prennent en charge GLM-5.3 ?

Des preuves officielles sur les environnements d’exécution sont certifiées pour sglang, vllm, tokenspeed, transformers, ktransformers, unsloth.

GLM-5.3 peut-il être utilisé commercialement ?

La classification enregistrée est Usage commercial autorisé sous conditions. Consultez les conditions officielles de Licence GLM-5.3.

Références officielles

Dernière vérification: 2026-09-03