Saltar al contenido principal

Qwen · Omni · Qwen3-Omni

Qwen3-Omni 30B-A3B Instruct: especificaciones, GPU, hosting y despliegue

Qwen3-Omni 30B-A3B Instruct es una versión Actual de la línea Omni de Qwen, certificada desde su revisión oficial.

Ilustración técnica de despliegue para Qwen3-Omni 30B-A3B Instruct
Flujo de referencia; los datos exactos se muestran aparte.
Parámetros totales30,0B
Parámetros activos3,0B
Ventana de contexto32.768 tokens
Estado de versiónActual · Actual
ArquitecturaQwen3OmniMoeForConditionalGeneration
ModalidadesTexto, Imagen, Audio, Vídeo
LicenciaLicencia Apache 2.0
Estado de despliegueDesplegable con una configuración certificada
Estado comercialUso comercial permitido
Fecha de lanzamiento2025-09-20

Arquitectura, fortalezas y usos

Qwen3-Omni 30B-A3B Instruct es una versión oficial autoalojable de Qwen en la línea Qwen Omni. Usa Qwen3OmniMoeForConditionalGeneration con 30B / 3B MoE y un contexto verificado de 32,768 tokens.

Qwen3-Omni 30B-A3B Instruct usa Qwen3OmniMoeForConditionalGeneration con 30B / 3B MoE. El perfil registra 64 capas, ancho oculto 8192 y 64 cabezas de atención cuando se publican.

Arquitectura Qwen3OmniMoeForConditionalGeneration verificada
Contexto certificado de 32,768 tokens
Proveniencia oficial del checkpoint
Inferencia LLM privada
Flujos con agentes
Documentos de contexto largo

Checkpoints y cuantizaciones certificados

Solo se muestran variantes exactas, vinculadas a esta versión y certificadas por su fuente.

Qwen3-Omni-30B-A3B-Instruct

Qwen/Qwen3-Omni-30B-A3B-Instruct

Oficial · BF16 · safetensors

Entorno de ejecución certificado: Transformers

Precisión / cuantizaciónFormatoBitsConfianza del editorEstado de despliegue
BF16safetensors16OficialEntorno de ejecución certificado

Hardware recomendado

Use solo configuraciones de entorno de ejecución certificadas con la precisión exacta. El ranking comprueba pesos, caché KV, sobrecarga, arquitectura GPU y topología.

Memoria estimada de pesos57.56 GB
KV cache2 GB
Sobrecarga del entorno de ejecución15.44 GB
Total con margen de seguridad92.99 GB

Mejor relación calidad-precio

2× NVIDIA A100 SXM 80GB

160 GB VRAM total · nvlink

67.01 GB de margen · Disponible

$1.830,00 / mes

Opción viable de menor coste

4× NVIDIA L4 24GB

96 GB VRAM total · pcie

3.01 GB de margen · Disponible

$1.000,00 / mes

Máximo rendimiento

2× NVIDIA A100 SXM 80GB

160 GB VRAM total · nvlink

67.01 GB de margen · Disponible

$1.830,00 / mes

Licencia y autoalojamiento

Los 30 B de pesos residentes deben caber en las GPU. Contexto y concurrencia añaden caché KV.

Qwen3-Omni 30B-A3B Instruct se publica bajo Licencia Apache 2.0. Se conservan la URL oficial y la fecha de verificación.

Uso comercial permitido. La licencia oficial permite el uso comercial; todas sus obligaciones siguen vigentes.

Alternativas y variantes hermanas

千问3-Omni-30B-A3B-Instruct

Cronología de la versión

qwen/qwen/qwen3-omni-30b-a3b-instruct @ 760edcedc32f3a85f57a3c45e9b43771ae1f57dc4210ad48ae710ac08303cf7b

Fuente oficial

Preguntas frecuentes

¿Cuánta VRAM requiere Qwen3-Omni 30B-A3B Instruct?

La estimación depende de precisión, contexto y concurrencia y usa datos certificados.

¿Qué entornos de ejecución admiten Qwen3-Omni 30B-A3B Instruct?

Hay pruebas oficiales certificadas para transformers.

¿Puede usarse Qwen3-Omni 30B-A3B Instruct comercialmente?

La clasificación es Uso comercial permitido. Consulte los términos oficiales de Licencia Apache 2.0.

Referencias oficiales

Última verificación: 2026-08-26