Saltar para o conteúdo principal

Qwen · Geral · Qwen3

Qwen3 30B-A3B Instruct 2507: especificações, requisitos GPU, alojamento e implementação

Qwen3 30B-A3B Instruct 2507 é uma versão Recente da linha Geral de Qwen, certificada pela revisão oficial.

Ilustração técnica de implementação para Qwen3 30B-A3B Instruct 2507
Fluxo de referência; os dados exatos são apresentados separadamente.
Parâmetros totais30,5B
Parâmetros ativos3,3B
Janela de contexto262 144 tokens
Estado da versãoRecente · Recente
ArquiteturaQwen3MoeForCausalLM
ModalidadesTexto
LicençaLicença Apache 2.0
Estado de implementaçãoImplementável com configuração certificada
Estado comercialUso comercial permitido
Data de lançamento2025-07-28

Arquitetura, vantagens e usos

Qwen3 30B-A3B Instruct 2507 é uma versão oficial autoalojável da Qwen na linha Qwen Geral. Usa Qwen3MoeForCausalLM com 30.5B / 3.3B MoE e contexto verificado de 262,144 tokens.

Qwen3 30B-A3B Instruct 2507 usa Qwen3MoeForCausalLM com 30.5B / 3.3B MoE. O perfil regista 48 camadas, largura 2048 e 32 cabeças de atenção quando publicados.

Arquitetura Qwen3MoeForCausalLM verificada
Contexto certificado de 262,144 tokens
Proveniência oficial do checkpoint
Inferência LLM privada
Fluxos de agentes
Documentos de contexto longo

Checkpoints e quantizações certificados

São mostradas apenas variantes exatas desta versão, certificadas pela fonte.

Qwen3-30B-A3B-Instruct-2507

Qwen/Qwen3-30B-A3B-Instruct-2507

Oficial · BF16 · safetensors

Ambiente de execução certificado: Transformers

Precisão / quantizaçãoFormatoBitsConfiança no editorEstado de implementação
BF16safetensors16OficialAmbiente de execução certificado

Hardware recomendado

Use apenas configurações de ambiente de execução certificadas com a precisão exata. A classificação verifica pesos, cache KV, sobrecarga, arquitetura GPU e topologia.

Memória estimada dos pesos58.51 GB
KV cache0.75 GB
Sobrecarga do ambiente de execução15.39 GB
Total com margem de segurança92.57 GB

Melhor valor recomendado

2× NVIDIA A100 SXM 80GB

160 GB VRAM total · nvlink

67.43 GB de margem · Disponível

USD 1 830 / mês

Opção viável de menor custo

4× NVIDIA L4 24GB

96 GB VRAM total · pcie

3.43 GB de margem · Disponível

USD 1 000 / mês

Maior desempenho

2× NVIDIA A100 SXM 80GB

160 GB VRAM total · nvlink

67.43 GB de margem · Disponível

USD 1 830 / mês

Licença e alojamento próprio

Os 30.5 B de pesos residentes têm de caber nas GPUs. Contexto e concorrência adicionam cache KV.

Qwen3 30B-A3B Instruct 2507 é publicado sob Licença Apache 2.0. O URL oficial e a data de verificação são guardados.

Uso comercial permitido. A licença oficial permite o uso comercial; todas as suas obrigações continuam aplicáveis.

Alternativas e variantes irmãs

Qwen3 235B-A22B, Qwen3 8B, Qwen3.8 2.4T-A95B, Qwen3.8 27B

Cronologia da versão

qwen/qwen/qwen3-30b-a3b-instruct @ 329411abe27fa043aad38ecf002e0a4a193baf50ce0e3f9af9a03ca23df423a2

Fonte oficial

Perguntas frequentes

Quanta VRAM requer Qwen3 30B-A3B Instruct 2507?

A estimativa depende da precisão, contexto e concorrência e usa dados certificados.

Que ambientes de execução suportam Qwen3 30B-A3B Instruct 2507?

Existem provas oficiais certificadas para transformers.

Qwen3 30B-A3B Instruct 2507 pode ser usado comercialmente?

A classificação guardada é Uso comercial permitido. Consulte os termos oficiais de Licença Apache 2.0.

Referências oficiais

Última verificação: 2026-08-26