GLM / GLM-4.6V

Transformation options for GLM-4.6V

根据注册表证据、定价组件和运行时兼容性对每个版本进行验证。

技术转换状态

支持转换

Verified public open-weight release with authoritative checkpoint evidence.

架构

Glm4vMoeForConditionalGeneration

107.71B parameters · 131072 context

支持的转换

quantization

按版本验证

runtime packaging

按版本验证

managed hosting

按版本验证

蒸馏

按版本验证

gpu targeting

按版本验证

评估和基准测试

按版本验证

download

按版本验证

已发布的软件包

工程就绪

GLM-4.6V FP8 生产包 - 可下载生产构建

GLM · GLM-4.6V

软件包配置: 可下载生产构建

转换操作: FP8 量化, 评估和基准测试

目标 GPU: 在构建器中选择硬件

运行时打包: transformers

已配置交付: 下载模型包

交付选项: 下载模型包 / 使用 FusionPointAI 托管 / 下载 + 托管

FP8transformers 下载模型包使用 FusionPointAI 托管下载 + 托管

USD 70,160.00
一次性工程服务

工程就绪

GLM-4.6V FP8 生产包 - GPU 定向托管生产

GLM · GLM-4.6V

软件包配置: GPU 定向托管生产

转换操作: FP8 量化, 运行时打包, 评估和基准测试

目标 GPU: NVIDIA H200 SXM 141GB

GPU 数量: 2

运行时打包: transformers

已配置交付: 下载 + 托管

交付选项: 下载模型包 / 使用 FusionPointAI 托管 / 下载 + 托管

FP8GPU 定向2 × NVIDIA H200 SXM 141GBtransformers运行时优化 下载模型包使用 FusionPointAI 托管下载 + 托管

USD 76,160.00
一次性工程服务

工程就绪

GLM-4.6V FP8 生产包 - GPU 定向托管生产

GLM · GLM-4.6V

软件包配置: GPU 定向托管生产

转换操作: FP8 量化, 运行时打包, 评估和基准测试

目标 GPU: NVIDIA H100 SXM 80GB

GPU 数量: 2

运行时打包: transformers

已配置交付: 下载 + 托管

交付选项: 下载模型包 / 使用 FusionPointAI 托管 / 下载 + 托管

FP8GPU 定向2 × NVIDIA H100 SXM 80GBtransformers运行时优化 下载模型包使用 FusionPointAI 托管下载 + 托管

USD 76,160.00
一次性工程服务

工程就绪

GLM-4.6V FP8 生产包 - GPU 定向托管生产

GLM · GLM-4.6V

软件包配置: GPU 定向托管生产

转换操作: FP8 量化, 运行时打包, 评估和基准测试

目标 GPU: NVIDIA H100 PCIe 80GB

GPU 数量: 2

运行时打包: transformers

已配置交付: 下载 + 托管

交付选项: 下载模型包 / 使用 FusionPointAI 托管 / 下载 + 托管

FP8GPU 定向2 × NVIDIA H100 PCIe 80GBtransformers运行时优化 下载模型包使用 FusionPointAI 托管下载 + 托管

USD 76,160.00
一次性工程服务

工程就绪

GLM-4.6V FP8 生产包 - GPU 定向托管生产

GLM · GLM-4.6V

软件包配置: GPU 定向托管生产

转换操作: FP8 量化, 运行时打包, 评估和基准测试

目标 GPU: NVIDIA A100 SXM 80GB

GPU 数量: 2

运行时打包: transformers

已配置交付: 下载 + 托管

交付选项: 下载模型包 / 使用 FusionPointAI 托管 / 下载 + 托管

FP8GPU 定向2 × NVIDIA A100 SXM 80GBtransformers运行时优化 下载模型包使用 FusionPointAI 托管下载 + 托管

USD 76,160.00
一次性工程服务

工程就绪

GLM-4.6V FP8 生产包 - GPU 定向托管生产

GLM · GLM-4.6V

软件包配置: GPU 定向托管生产

转换操作: FP8 量化, 运行时打包, 评估和基准测试

目标 GPU: NVIDIA l40s

GPU 数量: 3

运行时打包: transformers

已配置交付: 下载 + 托管

交付选项: 下载模型包 / 使用 FusionPointAI 托管 / 下载 + 托管

FP8GPU 定向3 × NVIDIA l40stransformers运行时优化 下载模型包使用 FusionPointAI 托管下载 + 托管

USD 76,160.00
一次性工程服务

工程就绪

GLM-4.6V FP8 生产包 - GPU 定向托管生产

GLM · GLM-4.6V

软件包配置: GPU 定向托管生产

转换操作: FP8 量化, 运行时打包, 评估和基准测试

目标 GPU: NVIDIA L4

GPU 数量: 6

运行时打包: transformers

已配置交付: 下载 + 托管

交付选项: 下载模型包 / 使用 FusionPointAI 托管 / 下载 + 托管

FP8GPU 定向6 × NVIDIA L4transformers运行时优化 下载模型包使用 FusionPointAI 托管下载 + 托管

USD 76,160.00
一次性工程服务

设计已验证

GLM-4.6V DISTILLATION 生产包 - 质量保留蒸馏

GLM · GLM-4.6V

软件包配置: 质量保留蒸馏

转换操作: 蒸馏, 评估和基准测试

目标 GPU: 在构建器中选择硬件

运行时打包: transformers

已配置交付: 下载模型包

交付选项: 下载模型包 / 使用 FusionPointAI 托管 / 下载 + 托管

DISTILLATION质量保留transformers 下载模型包使用 FusionPointAI 托管下载 + 托管

USD 150,535.00
一次性工程服务

设计已验证

GLM-4.6V DISTILLATION 生产包 - 吞吐优化蒸馏

GLM · GLM-4.6V

软件包配置: 吞吐优化蒸馏

转换操作: 蒸馏, 评估和基准测试

目标 GPU: 在构建器中选择硬件

运行时打包: transformers

已配置交付: 下载模型包

交付选项: 下载模型包 / 使用 FusionPointAI 托管 / 下载 + 托管

DISTILLATION吞吐量优化transformers 下载模型包使用 FusionPointAI 托管下载 + 托管

USD 150,535.00
一次性工程服务