Saltar al contenido principal

GLM · Visión · GLM-4.6V

GLM-4.6V: especificaciones, GPU, hosting y despliegue

GLM-4.6V es una versión Actual de la línea Visión de GLM, certificada desde su revisión oficial.

Ilustración técnica de despliegue para GLM-4.6V
Flujo de referencia; los datos exactos se muestran aparte.
Parámetros totales107,7B
Parámetros activos12,0B
Ventana de contexto131.072 tokens
Estado de versiónActual · Actual
ArquitecturaGlm4vMoeForConditionalGeneration
ModalidadesMultimodal
Licenciamit
Estado de despliegueDesplegable con una configuración certificada
Estado comercialUso comercial permitido
Fecha de lanzamiento2025-12-07

Arquitectura, fortalezas y usos

GLM-4.6V es una versión oficial autoalojable de Z.ai en la línea GLM Visión. Usa Glm4vMoeForConditionalGeneration con 107.71B / 12B MoE y un contexto verificado de 131,072 tokens.

GLM-4.6V usa Glm4vMoeForConditionalGeneration con 107.71B / 12B MoE. El perfil registra 46 capas, ancho oculto 4096 y 96 cabezas de atención cuando se publican.

Arquitectura Glm4vMoeForConditionalGeneration verificada
Contexto certificado de 131,072 tokens
Proveniencia oficial del checkpoint
Inferencia LLM privada
Flujos con agentes
Documentos de contexto largo

Checkpoints y cuantizaciones certificados

Solo se muestran variantes exactas, vinculadas a esta versión y certificadas por su fuente.

GLM-4.6V

zai-org/GLM-4.6V

Oficial · BF16 · safetensors

Entorno de ejecución certificado: Transformers vLLM SGLang

Precisión / cuantizaciónFormatoBitsConfianza del editorEstado de despliegue
BF16safetensors16OficialEntorno de ejecución certificado

GLM-4.6V-FP8

zai-org/GLM-4.6V-FP8

Oficial · FP8 · safetensors

Entorno de ejecución certificado: Transformers vLLM SGLang

Precisión / cuantizaciónFormatoBitsConfianza del editorEstado de despliegue
FP8safetensors8OficialEntorno de ejecución certificado

GLM-4.6V

ZhipuAI/GLM-4.6V

Oficial · Desconocido · unknown

Precisión / cuantizaciónFormatoBitsConfianza del editorEstado de despliegue

Hardware recomendado

Use solo configuraciones de entorno de ejecución certificadas con la precisión exacta. El ranking comprueba pesos, caché KV, sobrecarga, arquitectura GPU y topología.

Memoria estimada de pesos206.64 GB
KV cache1.44 GB
Sobrecarga del entorno de ejecución52.71 GB
Total con margen de seguridad323.38 GB
Dimensionamiento de referencia técnicamente compatible

Ningún inventario actual de FusionPointAI cumple todos los requisitos de entorno de ejecución, arquitectura, topología y memoria para este checkpoint. Use el estimador para hardware compatible global.

Licencia y autoalojamiento

Los 107.71 B de pesos residentes deben caber en las GPU. Contexto y concurrencia añaden caché KV.

GLM-4.6V se publica bajo mit. Se conservan la URL oficial y la fecha de verificación.

Uso comercial permitido. La licencia oficial permite el uso comercial; todas sus obligaciones siguen vigentes.

Alternativas y variantes hermanas

GLM-4.6V Flash, GLM-4.5V, GLM-4.6V

Cronología de la versión

zai/glm/glm-4-6v @ 4620f5ad6d0915735654f157ecb5d0183a93b9b0a7a4fece25ab7f3983158f50

Fuente oficial

Preguntas frecuentes

¿Cuánta VRAM requiere GLM-4.6V?

La estimación depende de precisión, contexto y concurrencia y usa datos certificados.

¿Qué entornos de ejecución admiten GLM-4.6V?

Hay pruebas oficiales certificadas para transformers, vllm, sglang.

¿Puede usarse GLM-4.6V comercialmente?

La clasificación es Uso comercial permitido. Consulte los términos oficiales de mit.

Referencias oficiales

Última verificación: 2026-09-03