Перейти к основному содержимому

NVIDIA Nemotron · Omni · Nemotron 3 Nano Omni

NVIDIA Nemotron 3 Nano Omni 30B-A3B Reasoning FP8: характеристики, требования к GPU, хостинг и развертывание

NVIDIA Nemotron 3 Nano Omni 30B-A3B Reasoning FP8 — версия Текущий направления Omni семейства NVIDIA Nemotron, подтвержденная официальной ревизией.

Техническая схема развертывания NVIDIA Nemotron 3 Nano Omni 30B-A3B Reasoning FP8
Эталонный поток; точные данные указаны отдельно.
Всего параметров31,0B
Активные параметры3,0B
Окно контекста262 144 tokens
Статус версииТекущий · Текущий
АрхитектураNemotronH_Nano_Omni_Reasoning_V3
МодальностиТекст, Изображение, Аудио, Видео
ЛицензияСоглашение об открытой лицензии на модель NVIDIA
Статус развертыванияРазвертывается с сертифицированной конфигурацией
Коммерческий статусКоммерческое использование разрешено с условиями
Дата выпуска2026-04-24

Архитектура, преимущества и сценарии

NVIDIA Nemotron 3 Nano Omni 30B-A3B Reasoning FP8 — официальная модель NVIDIA для самостоятельного хостинга в направлении NVIDIA Nemotron Omni. Архитектура NemotronH_Nano_Omni_Reasoning_V3, 31B / 3B MoE и проверенный контекст 262,144 токенов.

NVIDIA Nemotron 3 Nano Omni 30B-A3B Reasoning FP8 использует NemotronH_Nano_Omni_Reasoning_V3 с 31B / 3B MoE. Профиль содержит 64 слоев, ширину 8192 и 64 голов внимания, если они опубликованы.

Проверенная архитектура NemotronH_Nano_Omni_Reasoning_V3
Сертифицированный контекст 262,144 токенов
Официальное происхождение чекпоинта
Частный LLM-инференс
Агентные процессы
Обработка длинных документов

Сертифицированные чекпоинты и квантования

Показаны только точные варианты этой версии, подтвержденные источником.

Nemotron-3-Nano-Omni-30B-A3B-Reasoning-FP8

nvidia/Nemotron-3-Nano-Omni-30B-A3B-Reasoning-FP8

Официальный · FP8 · safetensors

Проверенная среда выполнения: vLLM SGLang TensorRT-LLM Llama.cpp

Точность / квантованиеФорматБитыДоверие к издателюСтатус развертывания
FP8safetensors8ОфициальныйПроверенная среда выполнения

Рекомендуемое оборудование

Используйте только сертифицированные конфигурации среды выполнения с точной разрядностью чекпоинта. Рейтинг проверяет веса, KV-кэш, накладные расходы, архитектуру GPU и топологию.

Оценка памяти весов29.74 GB
KV-кэш1 GB
Накладные расходы среды выполнения10.25 GB
Итого с запасом50.83 GB

Рекомендуемое соотношение цены и качества

1× NVIDIA H200 SXM 141GB

141 GB общая VRAM · nvswitch

90.17 GB запаса · Ограниченная мощность

USD 2 345 / месяц

Самый дешевый подходящий вариант

3× NVIDIA L4 24GB

72 GB общая VRAM · pcie

21.17 GB запаса · Доступно

USD 750 / месяц

Максимальная производительность

1× NVIDIA H200 SXM 141GB

141 GB общая VRAM · nvswitch

90.17 GB запаса · Ограниченная мощность

USD 2 345 / месяц

Лицензия и самостоятельный хостинг

Все 31 B резидентных весов должны поместиться на выбранных GPU. Контекст и параллельность увеличивают KV-кэш.

NVIDIA Nemotron 3 Nano Omni 30B-A3B Reasoning FP8 опубликована под лицензией Соглашение об открытой лицензии на модель NVIDIA. Сохраняются официальный URL и дата проверки.

Коммерческое использование разрешено с условиями. Коммерческое использование допускается на условиях. Перед развертыванием изучите официальные условия по ссылке.

История версии

Частые вопросы

Сколько VRAM требуется для NVIDIA Nemotron 3 Nano Omni 30B-A3B Reasoning FP8?

Оценка зависит от точности, контекста и параллельности и использует сертифицированные данные.

Какие среды выполнения поддерживают NVIDIA Nemotron 3 Nano Omni 30B-A3B Reasoning FP8?

Официальные подтверждения сертифицированы для vllm, sglang, tensorrt-llm, llama.cpp.

Можно ли использовать NVIDIA Nemotron 3 Nano Omni 30B-A3B Reasoning FP8 коммерчески?

Сохраненная классификация: Коммерческое использование разрешено с условиями. Смотрите официальные условия Соглашение об открытой лицензии на модель NVIDIA.

Официальные источники

Последняя проверка: 2026-08-26