跳到主要内容

Qwen · 全模态 · Qwen3-Omni

Qwen3-Omni 30B-A3B Instruct:规格、GPU 需求、托管与部署

Qwen3-Omni 30B-A3B Instruct 是 Qwen 家族全模态分支中的当前版本,并由官方修订认证。

Qwen3-Omni 30B-A3B Instruct 技术部署示意图
参考部署流程;精确架构事实另行列出。
总参数30.0B
激活参数3.0B
上下文窗口32,768 tokens
版本状态当前 · 当前
架构Qwen3OmniMoeForConditionalGeneration
模态文本, 图像, 音频, 视频
许可证Apache 2.0 许可证
部署状态具备认证配置,可部署
商业状态允许商业使用
发布日期2025-09-20

架构、优势与用途

Qwen3-Omni 30B-A3B Instruct 是 Qwen 在 Qwen 全模态分支中的官方可自托管版本,采用 Qwen3OmniMoeForConditionalGeneration、30B / 3B MoE,认证上下文为 32,768 词元。

Qwen3-Omni 30B-A3B Instruct 使用 Qwen3OmniMoeForConditionalGeneration 和 30B / 3B MoE。官方资料发布时记录 64 层、隐藏维度 8192 和 64 个注意力头。

已验证的 Qwen3OmniMoeForConditionalGeneration 架构
32,768 词元认证上下文
官方检查点来源
私有 LLM 推理
智能体工作流
长文档处理

已认证检查点与量化

仅显示与此版本关联并经来源认证的精确变体。

Qwen3-Omni-30B-A3B-Instruct

Qwen/Qwen3-Omni-30B-A3B-Instruct

官方 · BF16 · safetensors

已验证运行环境: Transformers

精度 / 量化格式位数发布者可信度部署状态
BF16safetensors16官方已验证运行环境

推荐硬件

仅使用与精确检查点精度匹配的认证运行时组合。硬件排序会检查权重、KV 缓存、开销、GPU 架构与拓扑。

估算权重内存57.56 GB
KV 缓存2 GB
运行时开销15.44 GB
含安全余量总计92.99 GB

推荐性价比方案

2× NVIDIA A100 SXM 80GB

160 GB 总 VRAM · nvlink

67.01 GB 余量 · 可用

USD 1,830 / 月

最低成本可行方案

4× NVIDIA L4 24GB

96 GB 总 VRAM · pcie

3.01 GB 余量 · 可用

USD 1,000 / 月

最高性能

2× NVIDIA A100 SXM 80GB

160 GB 总 VRAM · nvlink

67.01 GB 余量 · 可用

USD 1,830 / 月

许可证与自托管注意事项

全部 30 B 常驻权重必须装入所选 GPU;上下文与并发会增加 KV 缓存。

Qwen3-Omni 30B-A3B Instruct 采用 Apache 2.0 许可证 发布,并保留版本级官方 URL 与验证日期。

允许商业使用. 官方许可允许商业使用,但仍须遵守其全部义务。

替代方案与同代变体

千问3-Omni-30B-A3B-Instruct

发布历程

qwen/qwen/qwen3-omni-30b-a3b-instruct @ 760edcedc32f3a85f57a3c45e9b43771ae1f57dc4210ad48ae710ac08303cf7b

官方来源

常见问题

Qwen3-Omni 30B-A3B Instruct 需要多少 VRAM?

估算取决于精度、上下文和并发,并使用认证数据。

哪些运行时支持 Qwen3-Omni 30B-A3B Instruct?

transformers 已有认证的上游证据。

Qwen3-Omni 30B-A3B Instruct 可用于商业用途吗?

存储分类为允许商业使用;请查阅官方 Apache 2.0 许可证 条款。

官方来源

最近验证: 2026-08-26