Готов к инженерной работе
Qwen3-VL 32B Instruct FP8 Производственный пакет
Qwen / Qwen3-VL 32B Instruct · FP8 · Статус инженерной работы: Готов к инженерной работе
Lineage трансформации
Базовый релизQwen3-VL 32B Instruct
Инженерия моделейFP8 Квантизация, Runtime-пакетирование, Оценка и бенчмаркинг
Варианты поставкиСкачать пакет / Хостинг FusionPointAI / Скачать + хостинг
Прозрачная цена
- Инженерия базовой моделиUSD 17,400.00
- FP8 КвантизацияUSD 5,900.00
- Runtime-пакетированиеUSD 2,800.00
- Оценка и бенчмаркингUSD 3,600.00
- Скачать пакетUSD 1,500.00
- Настройка управляемого развертыванияUSD 3,200.00
- Разовая инженерияUSD 34,400.00
Ежемесячный хостинг
- 1 x nvidia-h200-sxm-141gbUSD 2,345.00
- Ежемесячный хостингUSD 2,345.00
Квантизация
ИсточникИсточник
TransformationРасчет до измерения в ходе инженерной работы
Топология GPU
1 × nvidia-h200-sxm-141gb
transformers
Загрузка или управляемый хостинг
Артефакт, конфигурация, токенизатор и контрольные суммы
Выделение GPU, runtime, endpoint и мониторинг